Zum Inhalt springen

Bei KI zahlst du je Token, nicht je gestellter Frage.

Ein Token ist der kleinste Textbaustein, den ein Sprachmodell verarbeitet. Was er kostet, warum die Ausgabe teurer ist und ein Rechenbeispiel dazu.

Oliver Leifken
Oliver Leifken
Der Roboter zerlegt einen weißen Streifen in gleich große Bausteine und legt sie in einer Reihe aus, drei davon orange

Ein Token ist die kleinste Einheit, in die ein Sprachmodell Text zerlegt, bevor es ihn verarbeitet, meist ein Wortteil von drei bis vier Zeichen12. Am 12. September 2026 kostet eine Million Token bei Claude Fable 5.1 10 US-Dollar in der Eingabe und 50 US-Dollar in der Ausgabe3. Abgerechnet wird nach Tokens, nicht je Anfrage34.

Wer ein Angebot für einen KI-Assistenten auf dem Tisch hat, entscheidet mit dieser einen Kennzahl über den Preis. Alle Beträge hier sind Listenpreise der Anbieter in US-Dollar, ohne Umsatzsteuer.

Was genau ist ein Token?

Kein Wort, sondern ein Wortteil. Anthropic schreibt, ein Token entspreche für Claude etwa 3,5 englischen Zeichen1. OpenAI nennt als Faustregel rund vier Zeichen oder 0,75 Wörter je Token für englischen Text2. Beide Angaben gelten ausdrücklich für Englisch und nicht für Deutsch.

Für Deutsch liegt der Verbrauch höher, weil Umlaute und lange zusammengesetzte Wörter in mehr Teile zerfallen. Eine belegte deutsche Kennzahl dafür konnte ich nicht finden. Alle Rechnungen hier sind deshalb Schätzungen auf Basis der englischen Faustregeln.

Das Bild, das im Alltag trägt: Tokens sind das Papier, auf dem die KI arbeitet. Du zahlst nicht für die Frage, sondern für jedes Blatt, das du hineinlegst, und für jedes Blatt, das die Maschine beschreibt. Wer jedes Mal das ganze Handbuch mitschickt, legt jedes Mal hundert Blatt hinein.

Kernaussage

Ein Handbuch mit 100 Seiten in jeder Anfrage kostet bei 4.000 Anfragen im Monat zwischen 70 und 2.800 US-Dollar, je nach Modell und Zwischenspeicher34. Die Listenpreise gelten am 12. September 2026 und ändern sich mehrmals im Jahr.

Was kostet ein Token wirklich?

Das hängt am Modell und an der Richtung. Auf der Preisseite von Anthropic kostet Claude Fable 5.1 je Million Token 10 US-Dollar für die Eingabe und 50 US-Dollar für die Ausgabe3. Claude Haiku 4.5 kostet 1 und 5 US-Dollar3.

Bei OpenAI kostet gpt-6-astra 10,00 US-Dollar Eingabe und 50,00 US-Dollar Ausgabe je Million Token4. Das kleinere gpt-5.6-terra liegt bei 2,00 und 12,00 US-Dollar4. Zwischen astra und terra liegt damit ein Faktor von fünf bei der Eingabe.

Dazu kommt der Zwischenspeicher. Anthropic weist für Claude Fable 5.1 ein Lesen aus dem Zwischenspeicher von 0,25 US-Dollar je Million Token aus, das Schreiben kostet 12,50 US-Dollar3. OpenAI nennt für zwischengespeicherte Eingaben bei gpt-6-astra 1,00 US-Dollar4.

Was kostet ein Handbuch in jeder Anfrage?

Ein Beispiel zeigt die Spanne. Ein technisches Handbuch mit 100 Seiten zu je rund 2.500 Zeichen hat 250.000 Zeichen, nach den Faustregeln der Anbieter also grob 70.000 Token12. Je nach Ansatz liegt der Wert zwischen 62.500 und 71.400 Token12. Die Preise dafür stehen auf den Preisseiten der beiden Anbieter34.

Modell Eingabe je Million Token Eine Anfrage 4.000 Anfragen im Monat
Claude Fable 5.1 10 US-Dollar 0,70 US-Dollar 2.800 US-Dollar
gpt-6-astra 10,00 US-Dollar 0,70 US-Dollar 2.800 US-Dollar
Claude Haiku 4.5 1 US-Dollar 0,07 US-Dollar 280 US-Dollar
Fable 5.1 aus dem Zwischenspeicher 0,25 US-Dollar 0,0175 US-Dollar 70 US-Dollar

Die 4.000 Anfragen sind zwanzig Mitarbeitende mit je zehn Anfragen an zwanzig Arbeitstagen. Gerechnet ist nur die Eingabe, die Antwort kommt oben drauf. Das Befüllen des Zwischenspeichers kostet bei 70.000 Token einmalig rund 0,88 US-Dollar3.

Derselbe Anwendungsfall kostet also zwischen 70 und 2.800 US-Dollar im Monat, je nach Modell und je nachdem, ob der wiederkehrende Teil zwischengespeichert wird34. Diese Entscheidung trifft in den meisten Betrieben bisher niemand bewusst. Alle hier genannten Beträge standen am 12. September 2026 unverändert auf den Preisseiten der beiden Anbieter34.

Was heißt das für deinen Betrieb?

Der Preis hängt an der Textmenge, nicht an der Zahl der Fragen. Wer die KI jedes Mal dasselbe Handbuch lesen lässt, zahlt es jedes Mal. Deshalb ist die erste Verbesserung nie ein größeres Modell, sondern weniger mitgeschickter Text. Drei Punkte helfen sofort.

  • Frage jeden Anbieter nach zwei Dingen: welches Modell läuft, und wird der wiederkehrende Teil zwischengespeichert. Die Antwort zeigt, ob jemand gerechnet hat.
  • Setze für Standardaufgaben das kleinere Modell ein. Beim Eingabepreis liegt zwischen Claude Fable 5.1 und Claude Haiku 4.5 der Faktor zehn3.
  • Plane in US-Dollar mit Aufschlag und prüfe die Preislisten zweimal im Jahr. Sie ändern sich mehrmals jährlich.

Wie sich solche Beträge neben Förderung und Lizenzkosten einordnen, steht im Beitrag KI-Förderung und KI-Kosten im Mittelstand in NRW. Was ein Modell mit diesen Token überhaupt macht, steht im Beitrag Sprachmodell einfach erklärt. Bei der Auswahl der Anwendungsfälle unterstütze ich in meiner Beratung zur KI-Strategie.

Meine Empfehlung aus Erfahrung

Meine Einschätzung: Ich würde vor jedem Angebot eine einzige Zahl erheben, nämlich wie viel Text bei euch je Anfrage tatsächlich mitgeschickt wird. Danach sieht man in zehn Minuten, ob ein Pauschalpreis fair ist oder geraten. Die deutsche Kennzahl für Token je Zeichen würde ich am eigenen Dokument messen, weil die Faustregeln der Anbieter für Englisch gelten. Das ist eine halbe Stunde Arbeit und spart später Diskussionen.

Welche zwei Fragen stellst du jedem Anbieter?

Die erste Frage lautet, welches Modell im Hintergrund arbeitet und was eine Million Token dort kostet. Die zweite lautet, welcher Teil der Anfrage zwischengespeichert wird. Beide Antworten passen in zwei Sätze, und beide entscheiden über den Betrag am Monatsende. Mehr brauchst du nicht.

Wenn ein Angebot darauf keine klare Antwort gibt, ist der Preis nicht kalkuliert, sondern gesetzt. Das muss kein Nachteil sein, solange die Menge begrenzt ist. Es wird zum Nachteil, sobald die Nutzung wächst und niemand weiß, woran der Betrag hängt.

Häufige Fragen

Wie viele Token hat eine Seite Text?

Meist 625 bis 715 je Normseite, nach den Faustregeln der Anbieter bei 2.500 Zeichen und etwa vier Zeichen je Token[1][2]. Beide Angaben beziehen sich ausdrücklich auf englischen Text. Für Deutsch liegt der Verbrauch höher, eine belegte deutsche Kennzahl gibt es nicht.

Warum kostet die Antwort mehr als die Frage?

Die Anbieter rechnen Eingabe und Ausgabe getrennt ab. Bei Claude Fable 5.1 stehen 10 US-Dollar Eingabe gegen 50 US-Dollar Ausgabe je Million Token[3], bei gpt-6-astra 10,00 gegen 50,00 US-Dollar[4]. Lange Antworten sind deshalb der teuerste Teil einer Anwendung.

Was ist der Zwischenspeicher und warum ist er so viel billiger?

Der Zwischenspeicher hält den wiederkehrenden Teil deiner Anfrage bereit, statt ihn jedes Mal neu zu verarbeiten. Anthropic weist für das Lesen 0,25 US-Dollar je Million Token aus, für das Schreiben 12,50 US-Dollar[3]. OpenAI nennt für zwischengespeicherte Eingaben 1,00 US-Dollar[4].

Gelten diese Preise auch für Claude Pro oder ein ChatGPT-Abo?

Nein. Die genannten Beträge sind Preise für den Zugang über die Schnittstelle, abgerechnet je Million Token[3][4]. Feste Tarife für einzelne Nutzer rechnen anders ab, OpenAI nennt für die Standardlizenz seines Geschäftstarifs 21 Euro je Monat[5]. Wer beides vergleicht, vergleicht zwei verschiedene Abrechnungsmodelle.

Quellen

  1. Anthropic: Glossary, Abschnitt Tokens, abgerufen am 11. September 2026
  2. OpenAI: Concepts, Abschnitt Tokens, abgerufen am 11. September 2026
  3. Anthropic: Preisseite, Preise je Million Token (2026), abgerufen am 12. September 2026
  4. OpenAI: Pricing, Entwicklerdokumentation (2026), abgerufen am 12. September 2026
  5. OpenAI: Preisseite für Unternehmenstarife (2026), abgerufen am 12. September 2026

Stand 4. September 2026 · geprüft am 12. September 2026

Oliver Leifken
Oliver LeifkenZertifizierter KI-Strategieberater. Über zehn Jahre Projekte in der Banken-IT, heute Beratung und Umsetzung für den Mittelstand.Über mich
Und bei dir?

Bevor du ein Angebot vergleichst, prüfe den Stand.

Kosten und Nutzen sind zwei von sieben Bereichen im Reifegradmodell. Der Check zeigt dir, welcher Anwendungsfall sich zuerst rechnet.

Jetzt deinen KI-Reifegrad prüfen Kostenfrei, ohne Termin. Ergebnis sofort, auf Wunsch per E-Mail.
Schreib mir per WhatsApp