Anthropic เปิดตัว Claude Haiku 5.5 ราคาถูกลง 75% พร้อม Context 1M

· By: NatapolK

Anthropic เปิดตัว Claude Haiku 5.5 ราคาถูกลง 75% พร้อม Context 1M

Anthropic เปิดตัว Claude Haiku 5.5 โมเดลขนาดเล็กที่เร็วและประหยัดที่สุดเท่าที่เคยมีมา โดยออกแบบมาเพื่อรองรับงานปริมาณมหาศาล เช่น การสรุปความ การบีบอัดข้อมูล การจัดประเภท และการทำงานเป็น subagent ตัวโมเดลยังคงรักษาจุดแข็งด้วย context window ขนาด 1M tokens และรองรับการสร้าง output ได้สูงสุด 128K tokens

ด้านราคาเริ่มต้นที่ $0.10 ต่อหนึ่งล้าน input tokens และ $0.50 ต่อหนึ่งล้าน output tokens ซึ่งถูกกว่า Claude Haiku 4.5 ถึง 90% สำหรับ prompt ที่มีขนาดไม่เกิน 100K tokens ปัจจุบันเปิดให้ใช้งานทั่วไป (generally available) แล้วผ่าน Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry และ Claude Platform บน AWS

สิ่งที่ Anthropic เปิดตัว

Haiku 5.5 เป็นโมเดลตระกูล Haiku รุ่นแรกที่สามารถปรับระดับความพยายามในการประมวลผลได้ (adjustable effort) โดยระบบ Adaptive thinking จะถูกเปิดใช้งานเป็นค่าเริ่มต้น และมีค่า effort parameter อยู่ที่ระดับ medium

โมเดลรุ่นนี้รองรับข้อมูลทั้งข้อความและรูปภาพ โดยให้ผลลัพธ์เป็นข้อความ และมีฐานข้อมูลความรู้ (knowledge cutoff) ล่าสุดถึงเดือนมิถุนายน 2026 นอกจากนี้ในเวอร์ชัน beta สำหรับงานแบบ Batch จะรองรับ output ได้สูงถึง 300K tokens

ข้อควรระวังสำคัญมีสองประการ คือ การกำหนดค่า temperature, top_p หรือ top_k ที่ไม่ใช่ค่าเริ่มต้นจะทำให้เกิด error 400 ทันที นอกจากนี้ tokenizer ตัวใหม่จะนับจำนวน tokens เพิ่มขึ้นประมาณ 30% เมื่อเทียบกับ Haiku 4.5 โดยผู้ใช้สามารถศึกษารายละเอียดได้จาก migration guide

ราคา: โครงสร้างแบบ 2 ระดับ

การคิดค่าบริการแบ่งตามขนาดของ prompt tokens โดยหากไม่เกิน 100K tokens ค่า input จะอยู่ที่ $0.10 และ output $0.50 ต่อล้าน tokens ส่วนค่า Cache reads อยู่ที่ $0.01 และ 5-minute cache writes อยู่ที่ $0.125 แต่หากใช้งานเกิน 100K tokens ราคาจะปรับเพิ่มเป็น $0.50 สำหรับ input และ $2.50 สำหรับ output

เมื่อเทียบกับ Haiku 4.5 ที่เคยคิดราคา input $1 และ output $5 ทาง Anthropic ระบุว่าความต้องการใช้งานส่วนใหญ่ (ราว 90%) มีขนาดต่ำกว่า 100K tokens ซึ่งเมื่อคำนวณตาม tokenizer ใหม่แล้ว Haiku 5.5 จะมีค่าใช้จ่ายถูกลงเฉลี่ย 75% และหากใช้งานผ่าน Batch processing จะประหยัดเพิ่มได้อีก 50%

อย่างไรก็ตาม GPT-6 Luna มีราคาเริ่มต้นสำหรับ context ระยะสั้นที่เท่ากัน แต่จุดเปลี่ยนราคาของ Luna จะอยู่ที่ 272K tokens ขึ้นไป ในราคา $0.20 สำหรับ input ซึ่งอาจทำให้ Luna มีความคุ้มค่ากว่าสำหรับ prompt ขนาดประมาณ 150K tokens

Benchmarks

ผลการทดสอบประสิทธิภาพที่รายงานโดย Anthropic (อ้างอิงจาก system card):

  • OSWorld 2.1 (offline subset): ทำได้ 72.4% สูงกว่า GPT-6 Luna (48.9%) และ Haiku 4.5 (15.7%) อย่างมาก
  • Terminal-Bench 4.0: ทำได้ 39.2% ขณะที่ Luna อยู่ที่ 16.4% และ Haiku 4.5 ทำไม่ได้เลย (0.0%)
  • FrontierCode 1.1 (Main): ทำได้ 46.4% สูงกว่า Luna เล็กน้อยที่ 42.4%
  • Humanity’s Last Exam: 45.9% (ไม่ใช้เครื่องมือ) และ 57.4% (ใช้เครื่องมือ)
  • GDPval-AA v2.1: ได้คะแนน 1620 เทียบกับ Luna ที่ 1437 และ Haiku 4.5 ที่ 735

แม้ประสิทธิภาพจะก้าวกระโดด แต่ Sonnet 5.5 ยังคงเป็นผู้นำในทุกหมวดหมู่การทดสอบ ซึ่ง Anthropic แนะนำให้ใช้ Sonnet 5.5 หรือ Opus 5.5 สำหรับงานพัฒนาซอฟต์แวร์เชิง agent ที่มีความซับซ้อนสูง

กรณีการใช้งานที่ดีที่สุด

Haiku 5.5 เหมาะสำหรับงาน 3 ประเภทหลัก ได้แก่:

  • งาน subagent: ใช้ร่วมกับโมเดลใหญ่อย่าง Opus 5.5 หรือ Sonnet 5.5 เช่น การให้ Haiku 5.5 ดึงข้อมูลเฉพาะจุดจากไฟล์เอกสารขนาดใหญ่ ในขณะที่โมเดลหลักทำหน้าที่สรุปภาพรวม
  • การตอบคำถามและสรุปเอกสารจำนวนมาก: เหมาะกับองค์กรที่ต้องประมวลผลเอกสารหลักล้านครั้งต่อสัปดาห์
  • งานที่เน้นความเร็วสูง: เช่น ระบบสนับสนุนลูกค้าแบบเรียลไทม์ และการใช้งานผ่านเบราว์เซอร์ (browser use)

Haiku 5.5 เทียบกับคู่แข่งที่ใกล้เคียงที่สุด

คุณสมบัติClaude Haiku 5.5GPT-6 LunaGemini 3.5 Flash-Lite
Input / output (ต่อ 1M)$0.10 / $0.50$0.10 / $0.50$0.30 / $2.50
ราคาสำหรับ prompt ยาว$0.50 / $2.50 เมื่อเกิน 100K$0.20 / $0.75 เมื่อเกิน 272Kอัตราเดียวคงที่
Cache read (ต่อ 1M)$0.01$0.01$0.03 + ค่าจัดเก็บ
Context window1M tokens1,050,000 tokens1,048,576 tokens
Max output128K tokens128,000 tokens65,536 tokens
Inputsข้อความ, รูปภาพข้อความ, รูปภาพข้อความ, รูปภาพ, วิดีโอ, เสียง, PDF
การควบคุมการใช้เหตุผลAdaptive thinking + effortreasoning.effort (none ถึง max)รองรับ Thinking
การใช้งานคอมพิวเตอร์รองรับ SDK (beta)รองรับ (Responses API)รองรับ (Preview)
ส่วนลดแบบ Batch50%50%50%
Knowledge cutoffมิ.ย. 202618 พ.ค. 2026ไม่ระบุ
ช่องทางใช้งานAPI, Bedrock, GCP, AzureOpenAI APIGemini API

แหล่งที่มา: Anthropic docs, Anthropic announcement, OpenAI model page, OpenAI pricing, Google model page, Google pricing ข้อมูลราคามาตรฐาน ตรวจสอบเมื่อวันที่ 7 ตุลาคม 2026

Interactive Explainer

สรุปประเด็นสำคัญ

  • ราคาประหยัดเพียง $0.10 (input) และ $0.50 (output) ต่อล้าน tokens สำหรับ prompt ไม่เกิน 100K
  • รองรับ Context 1M และมีระบบ Adaptive thinking ที่ปรับแต่งความลึกในการคิดได้
  • ประสิทธิภาพใน OSWorld 2.1 โดดเด่นที่ 72.4% เหนือกว่าโมเดลรุ่นก่อนหลายเท่าตัว
  • วางตัวเป็น subagent ประสิทธิภาพสูงเพื่อทำงานร่วมกับโมเดลตระกูล Opus และ Sonnet
Source: MarkTechPost
ดูแลงานแปลและเรียบเรียงโดย NatapolK

ความคิดเห็น (0)

เข้าสู่ระบบเพื่อร่วมแสดงความเห็น

สมัครสมาชิก

มาเป็นคนแรกที่แสดงความเห็นกันเลยโบร