0
Token (GPT, esatti)
0
Parole
0
Caratteri
—
Caratteri per token

Prezzi di listino standard per 1 milione di token, verificati il 2026-09-25. Modifica qualsiasi prezzo in base al tuo piano. I conteggi di token per Claude e Gemini sono stime.

Prezzi API degli LLM per milione di token

ModelloInputOutputPrompt di 1.000 parole*
Claude Fable 5.1 · Anthropic$10.00$50.00$0.0133
Claude Opus 5 · Anthropic$5.00$25.00$0.0067
Claude Sonnet 5 · Anthropic$2.00$10.00$0.0027
Claude Haiku 4.5 · Anthropic$1.00$5.00$0.0013
GPT-6 Astra · OpenAI$10.00$50.00$0.0133
GPT-6 Sol · OpenAI$2.00$10.00$0.0027
GPT-6 Luna · OpenAI$0.10$0.50$0.0001
Gemini 3.1 Pro · Google$2.00$12.00$0.0027
Gemini 3.8 Flash · Google$0.75$3.75$0.0010
Gemini 3.5 Flash-Lite · Google$0.30$2.50$0.0004

*Circa 1.333 token di input in inglese. Prezzi pubblicati da ciascun fornitore il 2026-09-25; le tariffe batch, con cache e a contesto lungo sono diverse.

Come funziona

Il testo viene suddiviso con il tokenizer byte-pair o200k pubblicato da OpenAI. Costo = token di input × prezzo di input + token di output × prezzo di output, moltiplicato per il numero di richieste. Il tokenizer (circa 1 MB) si carica al primo utilizzo e tutto funziona nel tuo browser.

Che cos’è un token?

Un token è l’unità che un modello linguistico legge e scrive: di solito un pezzo di parola di tre o quattro caratteri in inglese. La «tokenizzazione» divide il testo in questi pezzi; codice, numeri e testi non in inglese richiedono spesso più token per parola.

Questi conteggi di token sono esatti?

Il conteggio OpenAI usa il tokenizer open source o200k ed è esatto per i modelli basati su di esso. Anthropic e Google usano tokenizer propri, quindi i valori per Claude e Gemini sono stime e possono differire in modo sensibile, soprattutto con codice e testi non in inglese. Per numeri esatti ai fini della fatturazione, usa l’endpoint di conteggio dei token di ciascun fornitore.

Il mio testo viene inviato da qualche parte?

No. La tokenizzazione avviene interamente nel tuo browser. Nulla di ciò che incolli viene caricato, registrato o salvato.

Perché i token di output costano di più?

Generare testo richiede più calcolo che leggerlo, perciò i fornitori fanno pagare molto di più ogni token di output. Le risposte lunghe, e i token di ragionamento, fatturati come output, sono spesso la voce principale del costo di una richiesta.