0
Tokens (GPT, exakt)
0
Ord
0
Tecken
—
Tecken per token

Ordinarie listpriser per 1 miljon tokens, kontrollerade 2026-09-25. Ändra valfritt pris så att det matchar din plan. Tokenantalen för Claude och Gemini är uppskattningar.

LLM API-priser per miljon tokens

ModellInputOutputPrompt på 1 000 ord*
Claude Fable 5.1 · Anthropic$10.00$50.00$0.0133
Claude Opus 5 · Anthropic$5.00$25.00$0.0067
Claude Sonnet 5 · Anthropic$2.00$10.00$0.0027
Claude Haiku 4.5 · Anthropic$1.00$5.00$0.0013
GPT-6 Astra · OpenAI$10.00$50.00$0.0133
GPT-6 Sol · OpenAI$2.00$10.00$0.0027
GPT-6 Luna · OpenAI$0.10$0.50$0.0001
Gemini 3.1 Pro · Google$2.00$12.00$0.0027
Gemini 3.8 Flash · Google$0.75$3.75$0.0010
Gemini 3.5 Flash-Lite · Google$0.30$2.50$0.0004

*Ungefär 1 333 tokens engelsk input. Priser enligt respektive leverantör den 2026-09-25; priser för batch, cache och lång kontext skiljer sig.

Så fungerar det

Din text delas upp med o200k-tokenizern (byte-pair) som OpenAI publicerar. Kostnad = input-tokens × inputpris + output-tokens × outputpris, gånger antalet anrop. Tokenizern (cirka 1 MB) laddas första gången och allt körs i din webbläsare.

Vad är en token?

En token är den enhet en språkmodell läser och skriver — på engelska oftast en orddel på tre till fyra tecken. ”Tokenisering” delar upp text i sådana bitar; kod, siffror och text på andra språk än engelska kräver ofta fler tokens per ord.

Är tokenantalen exakta?

OpenAI-räkningen använder open source-tokenizern o200k och är exakt för modeller som bygger på den. Anthropic och Google använder egna tokenizers, så siffrorna för Claude och Gemini här är uppskattningar och kan skilja sig märkbart, särskilt för kod och text på andra språk än engelska. För exakta faktureringssiffror, använd respektive leverantörs endpoint för tokenräkning.

Skickas min text någonstans?

Nej. Tokeniseringen körs helt i din webbläsare. Inget du klistrar in laddas upp, loggas eller sparas.

Varför kostar output-tokens mer?

Att generera text kräver mer beräkningskraft än att läsa den, så leverantörerna tar betalt flera gånger mer per output-token. Långa svar — och reasoning- eller thinking-tokens, som faktureras som output — står ofta för större delen av kostnaden för ett anrop.