Compteur de tokens LLM
Collez un prompt, un document ou un historique de chat pour compter les tokens et comparer son coût selon les modèles.
Prix catalogue standard pour 1 million de tokens, vérifiés le 2026-09-25. Modifiez n’importe quel prix selon votre offre. Les nombres de tokens pour Claude et Gemini sont des estimations.
Prix des API LLM par million de tokens
| Modèle | Entrée | Sortie | Prompt de 1 000 mots* |
|---|---|---|---|
| Claude Fable 5.1 · Anthropic | $10.00 | $50.00 | $0.0133 |
| Claude Opus 5 · Anthropic | $5.00 | $25.00 | $0.0067 |
| Claude Sonnet 5 · Anthropic | $2.00 | $10.00 | $0.0027 |
| Claude Haiku 4.5 · Anthropic | $1.00 | $5.00 | $0.0013 |
| GPT-6 Astra · OpenAI | $10.00 | $50.00 | $0.0133 |
| GPT-6 Sol · OpenAI | $2.00 | $10.00 | $0.0027 |
| GPT-6 Luna · OpenAI | $0.10 | $0.50 | $0.0001 |
| Gemini 3.1 Pro · Google | $2.00 | $12.00 | $0.0027 |
| Gemini 3.8 Flash · Google | $0.75 | $3.75 | $0.0010 |
| Gemini 3.5 Flash-Lite · Google | $0.30 | $2.50 | $0.0004 |
*Environ 1 333 tokens d’entrée en anglais. Prix publiés par chaque fournisseur le 2026-09-25 ; les tarifs batch, avec cache et à contexte long sont différents.
Comment ça marche
Votre texte est découpé avec le tokenizer byte-pair o200k publié par OpenAI. Coût = tokens d’entrée × prix d’entrée + tokens de sortie × prix de sortie, multiplié par le nombre de requêtes. Le tokenizer (environ 1 Mo) se charge à la première utilisation et tout s’exécute dans votre navigateur.
Qu’est-ce qu’un token ?
Un token est l’unité qu’un modèle de langage lit et écrit : généralement un morceau de mot de trois à quatre caractères en anglais. La « tokenisation » découpe le texte en ces morceaux ; le code, les nombres et les textes non anglais nécessitent souvent plus de tokens par mot.
Ces nombres de tokens sont-ils exacts ?
Le décompte OpenAI utilise le tokenizer open source o200k et il est exact pour les modèles qui l’utilisent. Anthropic et Google ont leurs propres tokenizers : les chiffres affichés pour Claude et Gemini sont donc des estimations et peuvent différer sensiblement, surtout pour le code et les textes non anglais. Pour des chiffres exacts de facturation, utilisez l’endpoint de comptage de tokens de chaque fournisseur.
Mon texte est-il envoyé quelque part ?
Non. La tokenisation se fait entièrement dans votre navigateur. Rien de ce que vous collez n’est envoyé, journalisé ni stocké.
Pourquoi les tokens de sortie coûtent-ils plus cher ?
Générer du texte demande plus de calcul que le lire : les fournisseurs facturent donc plusieurs fois plus cher chaque token de sortie. Les réponses longues, ainsi que les tokens de raisonnement, facturés comme de la sortie, représentent souvent l’essentiel du coût d’une requête.