0
Токени (GPT, точно)
0
Слова
0
Символи
—
Символів на токен

Стандартні ціни за 1 мільйон токенів, перевірено 2026-09-25. Відредагуйте будь-яку ціну під свій тариф. Кількість токенів для Claude і Gemini — оцінка.

Ціни API LLM за мільйон токенів

МодельВхідВихідПромпт на 1 000 слів*
Claude Fable 5.1 · Anthropic$10.00$50.00$0.0133
Claude Opus 5 · Anthropic$5.00$25.00$0.0067
Claude Sonnet 5 · Anthropic$2.00$10.00$0.0027
Claude Haiku 4.5 · Anthropic$1.00$5.00$0.0013
GPT-6 Astra · OpenAI$10.00$50.00$0.0133
GPT-6 Sol · OpenAI$2.00$10.00$0.0027
GPT-6 Luna · OpenAI$0.10$0.50$0.0001
Gemini 3.1 Pro · Google$2.00$12.00$0.0027
Gemini 3.8 Flash · Google$0.75$3.75$0.0010
Gemini 3.5 Flash-Lite · Google$0.30$2.50$0.0004

*Приблизно 1 333 токени англійського тексту. Ціни за даними кожного провайдера на 2026-09-25; тарифи для пакетних, кешованих запитів і довгого контексту відрізняються.

Як це працює

Текст розбивається на токени за допомогою опублікованого OpenAI токенізатора o200k (byte-pair). Вартість = вхідні токени × ціна входу + вихідні токени × ціна виходу, помножене на кількість запитів. Токенізатор (близько 1 MB) завантажується під час першого використання, і все працює у вашому браузері.

Що таке токен?

Токен — це одиниця, яку мовна модель читає й пише: зазвичай частина слова з трьох-чотирьох символів англійською. «Токенізація» розбиває текст на такі частини; код, числа та неанглійський текст часто потребують більше токенів на слово.

Ці підрахунки токенів точні?

Підрахунок OpenAI використовує токенізатор з відкритим кодом o200k і точний для моделей, що на ньому побудовані. Anthropic і Google мають власні токенізатори, тож цифри для Claude і Gemini тут — оцінки й можуть помітно відрізнятися, особливо для коду та неанглійського тексту. Для точних цифр як у рахунку використовуйте ендпоінт підрахунку токенів кожного провайдера.

Мій текст кудись надсилається?

Ні. Токенізація повністю відбувається у вашому браузері. Нічого з того, що ви вставляєте, не завантажується, не логується й не зберігається.

Чому вихідні токени дорожчі?

Генерація тексту потребує більше обчислень, ніж його читання, тому провайдери беруть за вихідний токен у кілька разів більше. Довгі відповіді — а також токени міркувань, що оплачуються як вихідні, — часто становлять більшу частину вартості запиту.