0
Tokens (GPT, exatos)
0
Palavras
0
Caracteres
—
Caracteres por token

Preços de tabela padrão por 1 milhão de tokens, verificados em 2026-09-25. Edite qualquer preço para refletir seu plano. As contagens de tokens de Claude e Gemini são estimativas.

Preços de API de LLM por milhão de tokens

ModeloEntradaSaídaPrompt de 1.000 palavras*
Claude Fable 5.1 · Anthropic$10.00$50.00$0.0133
Claude Opus 5 · Anthropic$5.00$25.00$0.0067
Claude Sonnet 5 · Anthropic$2.00$10.00$0.0027
Claude Haiku 4.5 · Anthropic$1.00$5.00$0.0013
GPT-6 Astra · OpenAI$10.00$50.00$0.0133
GPT-6 Sol · OpenAI$2.00$10.00$0.0027
GPT-6 Luna · OpenAI$0.10$0.50$0.0001
Gemini 3.1 Pro · Google$2.00$12.00$0.0027
Gemini 3.8 Flash · Google$0.75$3.75$0.0010
Gemini 3.5 Flash-Lite · Google$0.30$2.50$0.0004

*Cerca de 1.333 tokens de entrada em inglês. Preços divulgados por cada provedor em 2026-09-25; tarifas de lote, com cache e de contexto longo são diferentes.

Como funciona

Seu texto é dividido com o tokenizador byte-pair o200k publicado pela OpenAI. Custo = tokens de entrada × preço de entrada + tokens de saída × preço de saída, multiplicado pelo número de requisições. O tokenizador (cerca de 1 MB) é carregado no primeiro uso e tudo roda no seu navegador.

O que é um token?

Um token é a unidade que um modelo de linguagem lê e escreve: geralmente um pedaço de palavra de três a quatro caracteres em inglês. A “tokenização” divide o texto nesses pedaços; código, números e textos em idiomas que não o inglês costumam precisar de mais tokens por palavra.

Essas contagens de tokens são exatas?

A contagem da OpenAI usa o tokenizador de código aberto o200k e é exata para os modelos baseados nele. A Anthropic e o Google usam tokenizadores próprios, então os números de Claude e Gemini aqui são estimativas e podem variar bastante, principalmente com código e textos que não estão em inglês. Para números exatos de cobrança, use o endpoint de contagem de tokens de cada provedor.

Meu texto é enviado para algum lugar?

Não. A tokenização acontece inteiramente no seu navegador. Nada do que você cola é enviado, registrado ou armazenado.

Por que os tokens de saída custam mais?

Gerar texto exige mais processamento do que lê-lo, por isso os provedores cobram várias vezes mais por token de saída. Respostas longas, e os tokens de raciocínio ou pensamento, que são cobrados como saída, costumam ser a maior parte do custo de uma requisição.