0
Tokens (GPT, exakt)
0
Wörter
0
Zeichen
—
Zeichen pro Token

Standard-Listenpreise pro 1 Million Tokens, geprüft am 2026-09-25. Bearbeite jeden Preis passend zu deinem Tarif. Die Token-Zahlen für Claude und Gemini sind Schätzungen.

LLM-API-Preise pro Million Tokens

ModellInputOutputPrompt mit 1.000 Wörtern*
Claude Fable 5.1 · Anthropic$10.00$50.00$0.0133
Claude Opus 5 · Anthropic$5.00$25.00$0.0067
Claude Sonnet 5 · Anthropic$2.00$10.00$0.0027
Claude Haiku 4.5 · Anthropic$1.00$5.00$0.0013
GPT-6 Astra · OpenAI$10.00$50.00$0.0133
GPT-6 Sol · OpenAI$2.00$10.00$0.0027
GPT-6 Luna · OpenAI$0.10$0.50$0.0001
Gemini 3.1 Pro · Google$2.00$12.00$0.0027
Gemini 3.8 Flash · Google$0.75$3.75$0.0010
Gemini 3.5 Flash-Lite · Google$0.30$2.50$0.0004

*Etwa 1.333 Tokens englischer Input. Preise laut Anbieter am 2026-09-25; Batch-, Cache- und Long-Context-Tarife weichen ab.

So funktioniert es

Dein Text wird mit dem o200k-Byte-Pair-Tokenizer zerlegt, den OpenAI veröffentlicht. Kosten = Input-Tokens × Input-Preis + Output-Tokens × Output-Preis, mal Anzahl der Anfragen. Der Tokenizer (etwa 1 MB) lädt beim ersten Einsatz, alles läuft in deinem Browser.

Was ist ein Token?

Ein Token ist die Einheit, die ein Sprachmodell liest und schreibt — im Englischen meist ein Wortstück aus drei bis vier Zeichen. Die „Tokenisierung“ zerlegt Text in diese Stücke; Code, Zahlen und nicht-englische Texte brauchen oft mehr Tokens pro Wort.

Sind diese Token-Zahlen exakt?

Die OpenAI-Zählung nutzt den Open-Source-Tokenizer o200k und ist für darauf basierende Modelle exakt. Anthropic und Google verwenden eigene Tokenizer, daher sind die Werte für Claude und Gemini hier Schätzungen und können spürbar abweichen, besonders bei Code und nicht-englischem Text. Für abrechnungsgenaue Zahlen nutze den Token-Count-Endpunkt des jeweiligen Anbieters.

Wird mein Text irgendwohin gesendet?

Nein. Die Tokenisierung läuft komplett in deinem Browser. Nichts, was du einfügst, wird hochgeladen, protokolliert oder gespeichert.

Warum kosten Output-Tokens mehr?

Text zu erzeugen ist rechenintensiver als ihn zu lesen, deshalb verlangen Anbieter pro Output-Token ein Vielfaches. Lange Antworten — und Reasoning- oder Thinking-Tokens, die als Output abgerechnet werden — machen oft den Großteil der Kosten einer Anfrage aus.