Anthropic เปิดตัว Claude Haiku 5.5 ราคาถูกลง 75% พร้อม Context 1M

Anthropic เปิดตัว Claude Haiku 5.5 โมเดลขนาดเล็กที่เร็วและประหยัดที่สุดเท่าที่เคยมีมา โดยออกแบบมาเพื่อรองรับงานปริมาณมหาศาล เช่น การสรุปความ การบีบอัดข้อมูล การจัดประเภท และการทำงานเป็น subagent ตัวโมเดลยังคงรักษาจุดแข็งด้วย context window ขนาด 1M tokens และรองรับการสร้าง output ได้สูงสุด 128K tokens
ด้านราคาเริ่มต้นที่ $0.10 ต่อหนึ่งล้าน input tokens และ $0.50 ต่อหนึ่งล้าน output tokens ซึ่งถูกกว่า Claude Haiku 4.5 ถึง 90% สำหรับ prompt ที่มีขนาดไม่เกิน 100K tokens ปัจจุบันเปิดให้ใช้งานทั่วไป (generally available) แล้วผ่าน Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry และ Claude Platform บน AWS
สิ่งที่ Anthropic เปิดตัว
Haiku 5.5 เป็นโมเดลตระกูล Haiku รุ่นแรกที่สามารถปรับระดับความพยายามในการประมวลผลได้ (adjustable effort) โดยระบบ Adaptive thinking จะถูกเปิดใช้งานเป็นค่าเริ่มต้น และมีค่า effort parameter อยู่ที่ระดับ medium
โมเดลรุ่นนี้รองรับข้อมูลทั้งข้อความและรูปภาพ โดยให้ผลลัพธ์เป็นข้อความ และมีฐานข้อมูลความรู้ (knowledge cutoff) ล่าสุดถึงเดือนมิถุนายน 2026 นอกจากนี้ในเวอร์ชัน beta สำหรับงานแบบ Batch จะรองรับ output ได้สูงถึง 300K tokens
ข้อควรระวังสำคัญมีสองประการ คือ การกำหนดค่า temperature, top_p หรือ top_k ที่ไม่ใช่ค่าเริ่มต้นจะทำให้เกิด error 400 ทันที นอกจากนี้ tokenizer ตัวใหม่จะนับจำนวน tokens เพิ่มขึ้นประมาณ 30% เมื่อเทียบกับ Haiku 4.5 โดยผู้ใช้สามารถศึกษารายละเอียดได้จาก migration guide
ราคา: โครงสร้างแบบ 2 ระดับ
การคิดค่าบริการแบ่งตามขนาดของ prompt tokens โดยหากไม่เกิน 100K tokens ค่า input จะอยู่ที่ $0.10 และ output $0.50 ต่อล้าน tokens ส่วนค่า Cache reads อยู่ที่ $0.01 และ 5-minute cache writes อยู่ที่ $0.125 แต่หากใช้งานเกิน 100K tokens ราคาจะปรับเพิ่มเป็น $0.50 สำหรับ input และ $2.50 สำหรับ output
เมื่อเทียบกับ Haiku 4.5 ที่เคยคิดราคา input $1 และ output $5 ทาง Anthropic ระบุว่าความต้องการใช้งานส่วนใหญ่ (ราว 90%) มีขนาดต่ำกว่า 100K tokens ซึ่งเมื่อคำนวณตาม tokenizer ใหม่แล้ว Haiku 5.5 จะมีค่าใช้จ่ายถูกลงเฉลี่ย 75% และหากใช้งานผ่าน Batch processing จะประหยัดเพิ่มได้อีก 50%
อย่างไรก็ตาม GPT-6 Luna มีราคาเริ่มต้นสำหรับ context ระยะสั้นที่เท่ากัน แต่จุดเปลี่ยนราคาของ Luna จะอยู่ที่ 272K tokens ขึ้นไป ในราคา $0.20 สำหรับ input ซึ่งอาจทำให้ Luna มีความคุ้มค่ากว่าสำหรับ prompt ขนาดประมาณ 150K tokens
Benchmarks
ผลการทดสอบประสิทธิภาพที่รายงานโดย Anthropic (อ้างอิงจาก system card):
- OSWorld 2.1 (offline subset): ทำได้ 72.4% สูงกว่า GPT-6 Luna (48.9%) และ Haiku 4.5 (15.7%) อย่างมาก
- Terminal-Bench 4.0: ทำได้ 39.2% ขณะที่ Luna อยู่ที่ 16.4% และ Haiku 4.5 ทำไม่ได้เลย (0.0%)
- FrontierCode 1.1 (Main): ทำได้ 46.4% สูงกว่า Luna เล็กน้อยที่ 42.4%
- Humanity’s Last Exam: 45.9% (ไม่ใช้เครื่องมือ) และ 57.4% (ใช้เครื่องมือ)
- GDPval-AA v2.1: ได้คะแนน 1620 เทียบกับ Luna ที่ 1437 และ Haiku 4.5 ที่ 735
แม้ประสิทธิภาพจะก้าวกระโดด แต่ Sonnet 5.5 ยังคงเป็นผู้นำในทุกหมวดหมู่การทดสอบ ซึ่ง Anthropic แนะนำให้ใช้ Sonnet 5.5 หรือ Opus 5.5 สำหรับงานพัฒนาซอฟต์แวร์เชิง agent ที่มีความซับซ้อนสูง
กรณีการใช้งานที่ดีที่สุด
Haiku 5.5 เหมาะสำหรับงาน 3 ประเภทหลัก ได้แก่:
- งาน subagent: ใช้ร่วมกับโมเดลใหญ่อย่าง Opus 5.5 หรือ Sonnet 5.5 เช่น การให้ Haiku 5.5 ดึงข้อมูลเฉพาะจุดจากไฟล์เอกสารขนาดใหญ่ ในขณะที่โมเดลหลักทำหน้าที่สรุปภาพรวม
- การตอบคำถามและสรุปเอกสารจำนวนมาก: เหมาะกับองค์กรที่ต้องประมวลผลเอกสารหลักล้านครั้งต่อสัปดาห์
- งานที่เน้นความเร็วสูง: เช่น ระบบสนับสนุนลูกค้าแบบเรียลไทม์ และการใช้งานผ่านเบราว์เซอร์ (browser use)
Haiku 5.5 เทียบกับคู่แข่งที่ใกล้เคียงที่สุด
| คุณสมบัติ | Claude Haiku 5.5 | GPT-6 Luna | Gemini 3.5 Flash-Lite |
|---|---|---|---|
| Input / output (ต่อ 1M) | $0.10 / $0.50 | $0.10 / $0.50 | $0.30 / $2.50 |
| ราคาสำหรับ prompt ยาว | $0.50 / $2.50 เมื่อเกิน 100K | $0.20 / $0.75 เมื่อเกิน 272K | อัตราเดียวคงที่ |
| Cache read (ต่อ 1M) | $0.01 | $0.01 | $0.03 + ค่าจัดเก็บ |
| Context window | 1M tokens | 1,050,000 tokens | 1,048,576 tokens |
| Max output | 128K tokens | 128,000 tokens | 65,536 tokens |
| Inputs | ข้อความ, รูปภาพ | ข้อความ, รูปภาพ | ข้อความ, รูปภาพ, วิดีโอ, เสียง, PDF |
| การควบคุมการใช้เหตุผล | Adaptive thinking + effort | reasoning.effort (none ถึง max) | รองรับ Thinking |
| การใช้งานคอมพิวเตอร์ | รองรับ SDK (beta) | รองรับ (Responses API) | รองรับ (Preview) |
| ส่วนลดแบบ Batch | 50% | 50% | 50% |
| Knowledge cutoff | มิ.ย. 2026 | 18 พ.ค. 2026 | ไม่ระบุ |
| ช่องทางใช้งาน | API, Bedrock, GCP, Azure | OpenAI API | Gemini API |
แหล่งที่มา: Anthropic docs, Anthropic announcement, OpenAI model page, OpenAI pricing, Google model page, Google pricing ข้อมูลราคามาตรฐาน ตรวจสอบเมื่อวันที่ 7 ตุลาคม 2026
Interactive Explainer
สรุปประเด็นสำคัญ
- ราคาประหยัดเพียง $0.10 (input) และ $0.50 (output) ต่อล้าน tokens สำหรับ prompt ไม่เกิน 100K
- รองรับ Context 1M และมีระบบ Adaptive thinking ที่ปรับแต่งความลึกในการคิดได้
- ประสิทธิภาพใน OSWorld 2.1 โดดเด่นที่ 72.4% เหนือกว่าโมเดลรุ่นก่อนหลายเท่าตัว
- วางตัวเป็น subagent ประสิทธิภาพสูงเพื่อทำงานร่วมกับโมเดลตระกูล Opus และ Sonnet
ความคิดเห็น (0)
เข้าสู่ระบบเพื่อร่วมแสดงความเห็น
สมัครสมาชิกมาเป็นคนแรกที่แสดงความเห็นกันเลยโบร
