LLM-Token-Zähler
Füge einen Prompt, ein Dokument oder einen Chatverlauf ein, um Tokens zu zählen und die Kosten verschiedener Modelle zu vergleichen.
Standard-Listenpreise pro 1 Million Tokens, geprüft am 2026-09-25. Bearbeite jeden Preis passend zu deinem Tarif. Die Token-Zahlen für Claude und Gemini sind Schätzungen.
LLM-API-Preise pro Million Tokens
| Modell | Input | Output | Prompt mit 1.000 Wörtern* |
|---|---|---|---|
| Claude Fable 5.1 · Anthropic | $10.00 | $50.00 | $0.0133 |
| Claude Opus 5 · Anthropic | $5.00 | $25.00 | $0.0067 |
| Claude Sonnet 5 · Anthropic | $2.00 | $10.00 | $0.0027 |
| Claude Haiku 4.5 · Anthropic | $1.00 | $5.00 | $0.0013 |
| GPT-6 Astra · OpenAI | $10.00 | $50.00 | $0.0133 |
| GPT-6 Sol · OpenAI | $2.00 | $10.00 | $0.0027 |
| GPT-6 Luna · OpenAI | $0.10 | $0.50 | $0.0001 |
| Gemini 3.1 Pro · Google | $2.00 | $12.00 | $0.0027 |
| Gemini 3.8 Flash · Google | $0.75 | $3.75 | $0.0010 |
| Gemini 3.5 Flash-Lite · Google | $0.30 | $2.50 | $0.0004 |
*Etwa 1.333 Tokens englischer Input. Preise laut Anbieter am 2026-09-25; Batch-, Cache- und Long-Context-Tarife weichen ab.
So funktioniert es
Dein Text wird mit dem o200k-Byte-Pair-Tokenizer zerlegt, den OpenAI veröffentlicht. Kosten = Input-Tokens × Input-Preis + Output-Tokens × Output-Preis, mal Anzahl der Anfragen. Der Tokenizer (etwa 1 MB) lädt beim ersten Einsatz, alles läuft in deinem Browser.
Was ist ein Token?
Ein Token ist die Einheit, die ein Sprachmodell liest und schreibt — im Englischen meist ein Wortstück aus drei bis vier Zeichen. Die „Tokenisierung“ zerlegt Text in diese Stücke; Code, Zahlen und nicht-englische Texte brauchen oft mehr Tokens pro Wort.
Sind diese Token-Zahlen exakt?
Die OpenAI-Zählung nutzt den Open-Source-Tokenizer o200k und ist für darauf basierende Modelle exakt. Anthropic und Google verwenden eigene Tokenizer, daher sind die Werte für Claude und Gemini hier Schätzungen und können spürbar abweichen, besonders bei Code und nicht-englischem Text. Für abrechnungsgenaue Zahlen nutze den Token-Count-Endpunkt des jeweiligen Anbieters.
Wird mein Text irgendwohin gesendet?
Nein. Die Tokenisierung läuft komplett in deinem Browser. Nichts, was du einfügst, wird hochgeladen, protokolliert oder gespeichert.
Warum kosten Output-Tokens mehr?
Text zu erzeugen ist rechenintensiver als ihn zu lesen, deshalb verlangen Anbieter pro Output-Token ein Vielfaches. Lange Antworten — und Reasoning- oder Thinking-Tokens, die als Output abgerechnet werden — machen oft den Großteil der Kosten einer Anfrage aus.