นับโทเคน LLM
วางพรอมต์ เอกสาร หรือบันทึกแชต เพื่อนับโทเคนและเปรียบเทียบค่าใช้จ่ายระหว่างโมเดล
ราคามาตรฐานต่อ 1 ล้านโทเคน ตรวจสอบเมื่อ 2026-09-25 แก้ราคาให้ตรงกับแพ็กเกจของคุณได้ จำนวนโทเคนของ Claude และ Gemini เป็นค่าประมาณ
ราคา LLM API ต่อล้านโทเคน
| โมเดล | อินพุต | เอาต์พุต | พรอมต์ 1,000 คำ* |
|---|---|---|---|
| Claude Fable 5.1 · Anthropic | $10.00 | $50.00 | $0.0133 |
| Claude Opus 5 · Anthropic | $5.00 | $25.00 | $0.0067 |
| Claude Sonnet 5 · Anthropic | $2.00 | $10.00 | $0.0027 |
| Claude Haiku 4.5 · Anthropic | $1.00 | $5.00 | $0.0013 |
| GPT-6 Astra · OpenAI | $10.00 | $50.00 | $0.0133 |
| GPT-6 Sol · OpenAI | $2.00 | $10.00 | $0.0027 |
| GPT-6 Luna · OpenAI | $0.10 | $0.50 | $0.0001 |
| Gemini 3.1 Pro · Google | $2.00 | $12.00 | $0.0027 |
| Gemini 3.8 Flash · Google | $0.75 | $3.75 | $0.0010 |
| Gemini 3.5 Flash-Lite · Google | $0.30 | $2.50 | $0.0004 |
*อินพุตภาษาอังกฤษประมาณ 1,333 โทเคน ราคาตามที่ผู้ให้บริการแต่ละรายประกาศเมื่อ 2026-09-25 ราคาแบบแบตช์ แคช และคอนเท็กซ์ยาวจะต่างออกไป
ทำงานอย่างไร
ข้อความของคุณถูกแบ่งด้วยตัวตัดโทเคนแบบ byte-pair o200k ที่ OpenAI เผยแพร่ ค่าใช้จ่าย = โทเคนอินพุต × ราคาอินพุต + โทเคนเอาต์พุต × ราคาเอาต์พุต คูณด้วยจำนวนคำขอ ตัวตัดโทเคน (ประมาณ 1 MB) โหลดเมื่อใช้งานครั้งแรก และทุกอย่างทำงานในเบราว์เซอร์ของคุณ
โทเคนคืออะไร?
โทเคนคือหน่วยที่โมเดลภาษาอ่านและเขียน — ในภาษาอังกฤษมักเป็นชิ้นส่วนของคำยาวสามถึงสี่ตัวอักษร การ “ตัดโทเคน” คือการแบ่งข้อความเป็นชิ้นเหล่านี้ โค้ด ตัวเลข และข้อความที่ไม่ใช่ภาษาอังกฤษมักใช้โทเคนต่อคำมากกว่า
จำนวนโทเคนเหล่านี้แม่นยำไหม?
ค่าของ OpenAI ใช้ตัวตัดโทเคน o200k แบบโอเพนซอร์ส และแม่นยำสำหรับโมเดลที่สร้างบนตัวนี้ Anthropic และ Google ใช้ตัวตัดโทเคนของตัวเอง ตัวเลขของ Claude และ Gemini ที่นี่จึงเป็นค่าประมาณและอาจต่างกันพอสมควร โดยเฉพาะกับโค้ดและข้อความที่ไม่ใช่ภาษาอังกฤษ หากต้องการตัวเลขตรงกับการเรียกเก็บเงิน ให้ใช้เอนด์พอยต์นับโทเคนของผู้ให้บริการแต่ละราย
ข้อความของฉันถูกส่งไปที่ไหนไหม?
ไม่ การตัดโทเคนทำงานในเบราว์เซอร์ของคุณทั้งหมด สิ่งที่คุณวางจะไม่ถูกอัปโหลด บันทึก หรือจัดเก็บ
ทำไมโทเคนเอาต์พุตถึงแพงกว่า?
การสร้างข้อความใช้การประมวลผลมากกว่าการอ่าน ผู้ให้บริการจึงคิดราคาต่อโทเคนเอาต์พุตสูงกว่าหลายเท่า คำตอบยาว ๆ — และโทเคนการให้เหตุผลหรือการคิด ซึ่งคิดเงินแบบเอาต์พุต — มักเป็นค่าใช้จ่ายหลักของคำขอ