KI-Token-Zähler und Kontextfenster-Check
Fügen Sie beliebigen Text ein und sehen Sie, wie viele Tokens daraus voraussichtlich werden, ob er in ein bestimmtes Kontextfenster passt und was er zu Ihren eigenen API-Preisen kosten würde. Alles läuft in Ihrem Browser — der Text wird nie hochgeladen.
Passt das ins Kontextfenster?
| Kontextfenster | Ihr Text | Passt es? |
|---|
Das Kontextfenster teilen sich Ihre Eingabe, die Antwort des Modells und alles, was die App im Hintergrund ergänzt (System-Prompt, abgerufene Dokumente, Chatverlauf). Lassen Sie Luft — das Fenster randvoll zu machen ist der Weg zu abgeschnittenen Antworten.
Was würde das kosten?
Für die Eingabekosten braucht es den oben eingefügten Text — fügen Sie etwas ein, um sie zu berechnen.
Wie diese Schätzung funktioniert (und warum sie nicht exakt ist)
Echte Tokenisierung lässt ein modellspezifisches BPE-Vokabular über Ihren Text laufen — und jede Modellfamilie nutzt ein anderes, sodass die „wahre“ Zahl je Modell abweicht. Das im Browser sauber zu tun hieße, pro Familie ein mehrere Megabyte großes Vokabular auszuliefern, was diese Seite langsam machen würde — für eine Zahl, die Sie nur ungefähr brauchen.
Stattdessen kommt hier ein zeichen- und wortbasierter Schätzer zum Einsatz, gewichtet nach Leerzeichen, Satzzeichen und Ziffern; bei gewöhnlicher englischer Prosa liegt er auf etwa 10–15 % genau. Zwei bekannte Verzerrungen: Code und stark interpunktierter Text werden dichter tokenisiert, als die Schätzung nahelegt, und nicht-lateinische Schriften (Chinesisch, Japanisch, Arabisch, Hindi) brauchen deutlich mehr Tokens pro Zeichen als Englisch — oft das 2- bis 3-Fache.
Wenn Sie es für die Abrechnung exakt brauchen, nutzen Sie den Tokenizer-Endpunkt Ihres Anbieters. Für „Passt das?“ und „Was kostet das ungefähr?“ ist eine Schätzung genau das Richtige.
Was ein Token wirklich ist
Modelle lesen weder Zeichen noch Wörter — sie lesen Tokens, Stücke irgendwo dazwischen. Häufige Wörter sind meist ein Token; längere oder ungewöhnliche werden in mehrere zerlegt. „Unbelievable“ ergibt vielleicht drei Tokens, „the“ genau eines. In englischer Prosa umfasst ein Token im Schnitt etwa vier Zeichen, also rund drei Viertel eines Wortes.
Alles wird in Tokens berechnet und begrenzt: was Sie senden, was zurückkommt und wie viel das Modell auf einmal fassen kann.
Warum Ihr Text dichter ist, als Sie denken
- Code wird ungünstig tokenisiert — Einrückung, Klammern und camelCase kosten allesamt Tokens. Eine Datei mit 500 Zeilen kann weit mehr Tokens ergeben, als ihre Zeichenzahl vermuten lässt.
- Nicht-englischer Text ist teuer. Sprachen ohne lateinische Schrift kosten oft das 2- bis 3-Fache an Tokens pro Zeichen, weshalb derselbe Prompt auf Japanisch um ein Vielfaches teurer sein kann als auf Englisch.
- Wiederholung ist billig, Struktur nicht. Das Gerüst aus JSON und Markdown summiert sich über viele Aufrufe schnell.
Kontextfenster ≠ Ihr Budget
Ein Fenster von einer Million Tokens heißt nicht, dass Sie eine Million Tokens schicken sollten. Bei sehr langen Eingaben lässt die Qualität der Aufmerksamkeit zur Mitte hin nach, die Latenz steigt und die Kosten wachsen linear. Retrieval — also nur die relevanten Passagen zu holen — ist dem Vollstopfen des Fensters meist überlegen und dazu günstiger.
FAQ
Wie genau ist dieser Zähler?
Bei gewöhnlicher englischer Prosa auf etwa 10–15 % genau. Bei Code und nicht-lateinischen Schriften liegt der tatsächliche Wert höher als die Schätzung. Für exakte Abrechnungswerte nutzen Sie den Tokenizer Ihres Anbieters.
Wird mein Text irgendwohin hochgeladen?
Nein. Die Berechnung läuft in Ihrem Browser. Keine Anfrage, kein Logging, keine Speicherung.
Warum zeigen Sie keine Modellpreise?
Weil sie sich ändern. Und ein veralteter Preis, der wie eine gesicherte Angabe aussieht, ist schlimmer als gar kein Preis. Tragen Sie die aktuellen Preise Ihres Anbieters ein — das Rechnen übernimmt das Tool.
Verbrauchen Bilder und Audio Tokens?
Ja — multimodale Eingaben werden ebenfalls in Tokens umgerechnet, wobei der Umrechnungsfaktor je nach Anbieter und Auflösung variiert. Dieses Tool deckt nur Text ab.
Passend dazu: Was ist RAG? · Welches KI-Modell für welche Aufgabe · Alle kostenlosen Tools