Bei KI zahlst du je Token, nicht je gestellter Frage.
Ein Token ist der kleinste Textbaustein, den ein Sprachmodell verarbeitet. Was er kostet, warum die Ausgabe teurer ist und ein Rechenbeispiel dazu.

Ein Token ist der kleinste Textbaustein, den ein Sprachmodell verarbeitet. Was er kostet, warum die Ausgabe teurer ist und ein Rechenbeispiel dazu.


Ein Token ist die kleinste Einheit, in die ein Sprachmodell Text zerlegt, bevor es ihn verarbeitet, meist ein Wortteil von drei bis vier Zeichen12. Am 12. September 2026 kostet eine Million Token bei Claude Fable 5.1 10 US-Dollar in der Eingabe und 50 US-Dollar in der Ausgabe3. Abgerechnet wird nach Tokens, nicht je Anfrage34.
Wer ein Angebot für einen KI-Assistenten auf dem Tisch hat, entscheidet mit dieser einen Kennzahl über den Preis. Alle Beträge hier sind Listenpreise der Anbieter in US-Dollar, ohne Umsatzsteuer.
Kein Wort, sondern ein Wortteil. Anthropic schreibt, ein Token entspreche für Claude etwa 3,5 englischen Zeichen1. OpenAI nennt als Faustregel rund vier Zeichen oder 0,75 Wörter je Token für englischen Text2. Beide Angaben gelten ausdrücklich für Englisch und nicht für Deutsch.
Für Deutsch liegt der Verbrauch höher, weil Umlaute und lange zusammengesetzte Wörter in mehr Teile zerfallen. Eine belegte deutsche Kennzahl dafür konnte ich nicht finden. Alle Rechnungen hier sind deshalb Schätzungen auf Basis der englischen Faustregeln.
Das Bild, das im Alltag trägt: Tokens sind das Papier, auf dem die KI arbeitet. Du zahlst nicht für die Frage, sondern für jedes Blatt, das du hineinlegst, und für jedes Blatt, das die Maschine beschreibt. Wer jedes Mal das ganze Handbuch mitschickt, legt jedes Mal hundert Blatt hinein.
Kernaussage
Ein Handbuch mit 100 Seiten in jeder Anfrage kostet bei 4.000 Anfragen im Monat zwischen 70 und 2.800 US-Dollar, je nach Modell und Zwischenspeicher34. Die Listenpreise gelten am 12. September 2026 und ändern sich mehrmals im Jahr.
Das hängt am Modell und an der Richtung. Auf der Preisseite von Anthropic kostet Claude Fable 5.1 je Million Token 10 US-Dollar für die Eingabe und 50 US-Dollar für die Ausgabe3. Claude Haiku 4.5 kostet 1 und 5 US-Dollar3.
Bei OpenAI kostet gpt-6-astra 10,00 US-Dollar Eingabe und 50,00 US-Dollar Ausgabe je Million Token4. Das kleinere gpt-5.6-terra liegt bei 2,00 und 12,00 US-Dollar4. Zwischen astra und terra liegt damit ein Faktor von fünf bei der Eingabe.
Dazu kommt der Zwischenspeicher. Anthropic weist für Claude Fable 5.1 ein Lesen aus dem Zwischenspeicher von 0,25 US-Dollar je Million Token aus, das Schreiben kostet 12,50 US-Dollar3. OpenAI nennt für zwischengespeicherte Eingaben bei gpt-6-astra 1,00 US-Dollar4.
Ein Beispiel zeigt die Spanne. Ein technisches Handbuch mit 100 Seiten zu je rund 2.500 Zeichen hat 250.000 Zeichen, nach den Faustregeln der Anbieter also grob 70.000 Token12. Je nach Ansatz liegt der Wert zwischen 62.500 und 71.400 Token12. Die Preise dafür stehen auf den Preisseiten der beiden Anbieter34.
| Modell | Eingabe je Million Token | Eine Anfrage | 4.000 Anfragen im Monat |
|---|---|---|---|
| Claude Fable 5.1 | 10 US-Dollar | 0,70 US-Dollar | 2.800 US-Dollar |
| gpt-6-astra | 10,00 US-Dollar | 0,70 US-Dollar | 2.800 US-Dollar |
| Claude Haiku 4.5 | 1 US-Dollar | 0,07 US-Dollar | 280 US-Dollar |
| Fable 5.1 aus dem Zwischenspeicher | 0,25 US-Dollar | 0,0175 US-Dollar | 70 US-Dollar |
Die 4.000 Anfragen sind zwanzig Mitarbeitende mit je zehn Anfragen an zwanzig Arbeitstagen. Gerechnet ist nur die Eingabe, die Antwort kommt oben drauf. Das Befüllen des Zwischenspeichers kostet bei 70.000 Token einmalig rund 0,88 US-Dollar3.
Derselbe Anwendungsfall kostet also zwischen 70 und 2.800 US-Dollar im Monat, je nach Modell und je nachdem, ob der wiederkehrende Teil zwischengespeichert wird34. Diese Entscheidung trifft in den meisten Betrieben bisher niemand bewusst. Alle hier genannten Beträge standen am 12. September 2026 unverändert auf den Preisseiten der beiden Anbieter34.
Der Preis hängt an der Textmenge, nicht an der Zahl der Fragen. Wer die KI jedes Mal dasselbe Handbuch lesen lässt, zahlt es jedes Mal. Deshalb ist die erste Verbesserung nie ein größeres Modell, sondern weniger mitgeschickter Text. Drei Punkte helfen sofort.
Wie sich solche Beträge neben Förderung und Lizenzkosten einordnen, steht im Beitrag KI-Förderung und KI-Kosten im Mittelstand in NRW. Was ein Modell mit diesen Token überhaupt macht, steht im Beitrag Sprachmodell einfach erklärt. Bei der Auswahl der Anwendungsfälle unterstütze ich in meiner Beratung zur KI-Strategie.
Meine Empfehlung aus Erfahrung
Meine Einschätzung: Ich würde vor jedem Angebot eine einzige Zahl erheben, nämlich wie viel Text bei euch je Anfrage tatsächlich mitgeschickt wird. Danach sieht man in zehn Minuten, ob ein Pauschalpreis fair ist oder geraten. Die deutsche Kennzahl für Token je Zeichen würde ich am eigenen Dokument messen, weil die Faustregeln der Anbieter für Englisch gelten. Das ist eine halbe Stunde Arbeit und spart später Diskussionen.
Die erste Frage lautet, welches Modell im Hintergrund arbeitet und was eine Million Token dort kostet. Die zweite lautet, welcher Teil der Anfrage zwischengespeichert wird. Beide Antworten passen in zwei Sätze, und beide entscheiden über den Betrag am Monatsende. Mehr brauchst du nicht.
Wenn ein Angebot darauf keine klare Antwort gibt, ist der Preis nicht kalkuliert, sondern gesetzt. Das muss kein Nachteil sein, solange die Menge begrenzt ist. Es wird zum Nachteil, sobald die Nutzung wächst und niemand weiß, woran der Betrag hängt.
Meist 625 bis 715 je Normseite, nach den Faustregeln der Anbieter bei 2.500 Zeichen und etwa vier Zeichen je Token[1][2]. Beide Angaben beziehen sich ausdrücklich auf englischen Text. Für Deutsch liegt der Verbrauch höher, eine belegte deutsche Kennzahl gibt es nicht.
Die Anbieter rechnen Eingabe und Ausgabe getrennt ab. Bei Claude Fable 5.1 stehen 10 US-Dollar Eingabe gegen 50 US-Dollar Ausgabe je Million Token[3], bei gpt-6-astra 10,00 gegen 50,00 US-Dollar[4]. Lange Antworten sind deshalb der teuerste Teil einer Anwendung.
Der Zwischenspeicher hält den wiederkehrenden Teil deiner Anfrage bereit, statt ihn jedes Mal neu zu verarbeiten. Anthropic weist für das Lesen 0,25 US-Dollar je Million Token aus, für das Schreiben 12,50 US-Dollar[3]. OpenAI nennt für zwischengespeicherte Eingaben 1,00 US-Dollar[4].
Nein. Die genannten Beträge sind Preise für den Zugang über die Schnittstelle, abgerechnet je Million Token[3][4]. Feste Tarife für einzelne Nutzer rechnen anders ab, OpenAI nennt für die Standardlizenz seines Geschäftstarifs 21 Euro je Monat[5]. Wer beides vergleicht, vergleicht zwei verschiedene Abrechnungsmodelle.
Stand 4. September 2026 · geprüft am 12. September 2026

Kosten und Nutzen sind zwei von sieben Bereichen im Reifegradmodell. Der Check zeigt dir, welcher Anwendungsfall sich zuerst rechnet.