0
Tokens (GPT, exact)
0
Woorden
0
Tekens
—
Tekens per token

Standaard catalogusprijzen per 1 miljoen tokens, gecontroleerd op 2026-09-25. Pas elke prijs aan aan je eigen abonnement. De tokenaantallen voor Claude en Gemini zijn schattingen.

LLM API-prijzen per miljoen tokens

ModelInputOutputPrompt van 1.000 woorden*
Claude Fable 5.1 · Anthropic$10.00$50.00$0.0133
Claude Opus 5 · Anthropic$5.00$25.00$0.0067
Claude Sonnet 5 · Anthropic$2.00$10.00$0.0027
Claude Haiku 4.5 · Anthropic$1.00$5.00$0.0013
GPT-6 Astra · OpenAI$10.00$50.00$0.0133
GPT-6 Sol · OpenAI$2.00$10.00$0.0027
GPT-6 Luna · OpenAI$0.10$0.50$0.0001
Gemini 3.1 Pro · Google$2.00$12.00$0.0027
Gemini 3.8 Flash · Google$0.75$3.75$0.0010
Gemini 3.5 Flash-Lite · Google$0.30$2.50$0.0004

*Ongeveer 1.333 tokens Engelse input. Prijzen zoals vermeld door elke aanbieder op 2026-09-25; tarieven voor batch, cache en lange context wijken af.

Zo werkt het

Je tekst wordt opgesplitst met de o200k byte-pair-tokenizer die OpenAI publiceert. Kosten = input-tokens × inputprijs + output-tokens × outputprijs, maal het aantal verzoeken. De tokenizer (ongeveer 1 MB) laadt bij het eerste gebruik en alles draait in je browser.

Wat is een token?

Een token is de eenheid die een taalmodel leest en schrijft — in het Engels meestal een woorddeel van drie tot vier tekens. ‘Tokenisatie’ splitst tekst in die stukjes; code, getallen en niet-Engelse tekst hebben vaak meer tokens per woord nodig.

Zijn deze tokenaantallen exact?

De OpenAI-telling gebruikt de open-source o200k-tokenizer en is exact voor modellen die daarop gebaseerd zijn. Anthropic en Google gebruiken hun eigen tokenizers, dus de cijfers voor Claude en Gemini zijn hier schattingen en kunnen merkbaar afwijken, vooral bij code en niet-Engelse tekst. Gebruik voor factuurnauwkeurige aantallen het token-telendpoint van de betreffende aanbieder.

Wordt mijn tekst ergens naartoe gestuurd?

Nee. De tokenisatie draait volledig in je browser. Niets wat je plakt wordt geüpload, gelogd of opgeslagen.

Waarom kosten output-tokens meer?

Tekst genereren kost meer rekenkracht dan tekst lezen, dus aanbieders rekenen per output-token een veelvoud. Lange antwoorden — en reasoning- of thinking-tokens, die als output worden gefactureerd — bepalen vaak het grootste deel van de kosten van een verzoek.