Ein Token ist die kleinste Einheit, in der ein KI-Modell Text liest, schreibt und abrechnet. Es ist weder ein Wort noch ein Buchstabe: Es ist ein Fragment. Im Deutschen und Englischen entspricht ein Token im Schnitt etwa 4 Zeichen oder ungefähr 0,75 Wörtern. Alles, was Sie an einer KI-API zahlen, wird in Tokens gemessen, bei Eingabe und Ausgabe.
Auf einen Blick
| Was es ist | Die Einheit, in die das Modell Text zerlegt |
| Durchschnittsgröße | ~4 Zeichen · ~0,75 Wörter |
| Schnelle Faustregel | 1.000 Tokens ≈ 750 Wörter ≈ 1,5 Seiten |
| Wie abgerechnet wird | Nach Eingabe- und Ausgabe-Tokens, zu unterschiedlichen Preisen |
Wie Text zerlegt wird
Das Modell sieht keine Wörter, es sieht Tokens. Häufige Wörter sind meist ein einziges Token; seltene, Eigennamen, lange Zahlen oder Wörter in anderen Sprachen zerfallen in mehrere. Deshalb kann derselbe Text übersetzt je nach Sprache mehr oder weniger kosten: Der Inhalt ändert sich nicht, die Anzahl der Stücke schon.
Eingabe und Ausgabe werden unterschiedlich berechnet
Jede Anfrage zahlt zweierlei: die Tokens, die Sie senden (Eingabe: Ihr Prompt, die Anweisungen, der Kontext), und die, die das Modell zurückgibt (Ausgabe: seine Antwort). Die Ausgabe kostet pro Token deutlich mehr als die Eingabe, deshalb wiegt eine lange Antwort auf der Rechnung schwerer, als es scheint.
Warum das Ihre Rechnung bestimmt
Ihre Kosten hängen nicht davon ab, wie viele Anfragen Sie stellen, sondern wie viele Tokens Sie bewegen. Ein Prompt mit einem ganzen hineinkopierten Dokument kann mehr kosten als hundert kurze Fragen. Die Formel ist immer dieselbe: Tokens × Preis pro Token × Anfragevolumen. Daraus ergeben sich die Kosten pro Aufgabe, die Kennzahl, auf die es wirklich ankommt.
Zählen Sie Ihre eigenen
Tragen Sie Ihre Eingabe- und Ausgabe-Tokens und Ihr Monatsvolumen in den Token-Kostenrechner ein und vergleichen Sie zwischen Modellen: Sie sehen in einer Minute, woher Ihre Ausgaben kommen. Wenn die Zahl Sie überrascht, beginnen Sie mit den 7 Hebeln, um die Rechnung zu senken.
Häufige Fragen
Wie viele Wörter sind 1.000 Tokens? Rund 750 Wörter oder etwa 1,5 Seiten Fließtext. Das ist ein Durchschnitt: Zahlen, Eigennamen und seltenere Sprachen verbrauchen mehr Tokens pro Wort.
Werden Eingabe und Ausgabe gleich berechnet? Nein. Die Ausgabe kostet pro Token mehrfach so viel wie die Eingabe, deshalb ist das Begrenzen der Antwortlänge einer der schnellsten Sparhebel.
Zählt der System-Prompt mit? Ja. Alles, was Sie senden, zählt bei jeder Anfrage als Eingabe, auch feste Anweisungen — es sei denn, Sie nutzen Prompt-Caching, um sie nicht jedes Mal zu bezahlen.
Bei e-ficient messen wir die Kosten pro Aufgabe von Unternehmen, die KI bereits produktiv einsetzen, und sagen Ihnen, wie viel Sie mit jedem Hebel bei Ihrem realen Volumen sparen würden. Das erste Audit ist kostenfrei, wenn Sie einen Plan mit drei Monaten Laufzeit abschließen, und liefert innerhalb von 72 Stunden eine Diagnose.