LLM token teller
Plak een prompt, document of chatlog om tokens te tellen en de kosten per model te vergelijken.
Standaard catalogusprijzen per 1 miljoen tokens, gecontroleerd op 2026-09-25. Pas elke prijs aan aan je eigen abonnement. De tokenaantallen voor Claude en Gemini zijn schattingen.
LLM API-prijzen per miljoen tokens
| Model | Input | Output | Prompt van 1.000 woorden* |
|---|---|---|---|
| Claude Fable 5.1 · Anthropic | $10.00 | $50.00 | $0.0133 |
| Claude Opus 5 · Anthropic | $5.00 | $25.00 | $0.0067 |
| Claude Sonnet 5 · Anthropic | $2.00 | $10.00 | $0.0027 |
| Claude Haiku 4.5 · Anthropic | $1.00 | $5.00 | $0.0013 |
| GPT-6 Astra · OpenAI | $10.00 | $50.00 | $0.0133 |
| GPT-6 Sol · OpenAI | $2.00 | $10.00 | $0.0027 |
| GPT-6 Luna · OpenAI | $0.10 | $0.50 | $0.0001 |
| Gemini 3.1 Pro · Google | $2.00 | $12.00 | $0.0027 |
| Gemini 3.8 Flash · Google | $0.75 | $3.75 | $0.0010 |
| Gemini 3.5 Flash-Lite · Google | $0.30 | $2.50 | $0.0004 |
*Ongeveer 1.333 tokens Engelse input. Prijzen zoals vermeld door elke aanbieder op 2026-09-25; tarieven voor batch, cache en lange context wijken af.
Zo werkt het
Je tekst wordt opgesplitst met de o200k byte-pair-tokenizer die OpenAI publiceert. Kosten = input-tokens × inputprijs + output-tokens × outputprijs, maal het aantal verzoeken. De tokenizer (ongeveer 1 MB) laadt bij het eerste gebruik en alles draait in je browser.
Wat is een token?
Een token is de eenheid die een taalmodel leest en schrijft — in het Engels meestal een woorddeel van drie tot vier tekens. ‘Tokenisatie’ splitst tekst in die stukjes; code, getallen en niet-Engelse tekst hebben vaak meer tokens per woord nodig.
Zijn deze tokenaantallen exact?
De OpenAI-telling gebruikt de open-source o200k-tokenizer en is exact voor modellen die daarop gebaseerd zijn. Anthropic en Google gebruiken hun eigen tokenizers, dus de cijfers voor Claude en Gemini zijn hier schattingen en kunnen merkbaar afwijken, vooral bij code en niet-Engelse tekst. Gebruik voor factuurnauwkeurige aantallen het token-telendpoint van de betreffende aanbieder.
Wordt mijn tekst ergens naartoe gestuurd?
Nee. De tokenisatie draait volledig in je browser. Niets wat je plakt wordt geüpload, gelogd of opgeslagen.
Waarom kosten output-tokens meer?
Tekst genereren kost meer rekenkracht dan tekst lezen, dus aanbieders rekenen per output-token een veelvoud. Lange antwoorden — en reasoning- of thinking-tokens, die als output worden gefactureerd — bepalen vaak het grootste deel van de kosten van een verzoek.