Đếm token LLM
Dán prompt, tài liệu hoặc lịch sử chat để đếm token và so sánh chi phí giữa các mô hình.
Giá niêm yết tiêu chuẩn cho mỗi 1 triệu token, kiểm tra ngày 2026-09-25. Bạn có thể sửa giá cho khớp gói của mình. Số token của Claude và Gemini là ước tính.
Giá API LLM cho mỗi triệu token
| Mô hình | Đầu vào | Đầu ra | Prompt 1.000 từ* |
|---|---|---|---|
| Claude Fable 5.1 · Anthropic | $10.00 | $50.00 | $0.0133 |
| Claude Opus 5 · Anthropic | $5.00 | $25.00 | $0.0067 |
| Claude Sonnet 5 · Anthropic | $2.00 | $10.00 | $0.0027 |
| Claude Haiku 4.5 · Anthropic | $1.00 | $5.00 | $0.0013 |
| GPT-6 Astra · OpenAI | $10.00 | $50.00 | $0.0133 |
| GPT-6 Sol · OpenAI | $2.00 | $10.00 | $0.0027 |
| GPT-6 Luna · OpenAI | $0.10 | $0.50 | $0.0001 |
| Gemini 3.1 Pro · Google | $2.00 | $12.00 | $0.0027 |
| Gemini 3.8 Flash · Google | $0.75 | $3.75 | $0.0010 |
| Gemini 3.5 Flash-Lite · Google | $0.30 | $2.50 | $0.0004 |
*Khoảng 1.333 token đầu vào tiếng Anh. Giá do từng nhà cung cấp niêm yết ngày 2026-09-25; giá batch, bộ nhớ đệm và ngữ cảnh dài khác nhau.
Cách hoạt động
Văn bản được tách bằng tokenizer byte-pair o200k do OpenAI công bố. Chi phí = token đầu vào × giá đầu vào + token đầu ra × giá đầu ra, nhân với số request. Tokenizer (khoảng 1 MB) được tải khi dùng lần đầu và mọi thứ chạy trong trình duyệt của bạn.
Token là gì?
Token là đơn vị mà mô hình ngôn ngữ đọc và viết — trong tiếng Anh thường là một mảnh từ dài ba đến bốn ký tự. “Tokenization” tách văn bản thành các mảnh này; mã nguồn, con số và văn bản không phải tiếng Anh thường cần nhiều token hơn cho mỗi từ.
Số token này có chính xác không?
Số của OpenAI dùng tokenizer mã nguồn mở o200k và chính xác với các mô hình xây dựng trên nó. Anthropic và Google dùng tokenizer riêng, nên số liệu Claude và Gemini ở đây là ước tính và có thể chênh lệch đáng kể, nhất là với mã nguồn và văn bản không phải tiếng Anh. Để có số chính xác như khi tính tiền, hãy dùng endpoint đếm token của từng nhà cung cấp.
Văn bản của tôi có bị gửi đi đâu không?
Không. Việc tách token diễn ra hoàn toàn trong trình duyệt của bạn. Không có gì bạn dán vào bị tải lên, ghi lại hay lưu trữ.
Vì sao token đầu ra đắt hơn?
Tạo văn bản tốn nhiều tài nguyên tính toán hơn đọc văn bản, nên các nhà cung cấp tính giá mỗi token đầu ra cao gấp nhiều lần. Các câu trả lời dài — và token suy luận hay suy nghĩ, vốn được tính như đầu ra — thường chiếm phần lớn chi phí của một request.