เทียบ 4 AI ตัวท็อป GPT-6 Astra, Sol, Argon และ Fable 5.1

· By: NatapolK

สมรภูมิ AI ระดับ Frontier ดุเดือดขึ้นเมื่อ Anthropic, OpenAI และ Google DeepMind พร้อมใจกันเปิดตัวโมเดลใหม่ถึง 4 รุ่นภายในเดือนเดียว เริ่มจาก Claude Fable 5.1 เมื่อต้นเดือนกันยายน ตามมาด้วย GPT-6 Astra และปิดท้ายเดือนด้วยการเปิดตัว GPT-6.1 Sol คู่กับ Gemini 4 Argon

แม้คะแนน Benchmark จะมีความใกล้เคียงกัน แต่ความแตกต่างที่แท้จริงอยู่ที่โครงสร้างราคา เงื่อนไขการเข้าถึง และต้นทุนต่อภารกิจ (Cost per Task) ที่ชัดเจน โดยเฉพาะการที่ OpenAI ยกเลิกการเปิดตัว GPT-6.1 Astra เนื่องจากไม่ผ่านเกณฑ์ความปลอดภัยภายใน ทำให้ GPT-6 Astra ยังคงครองตำแหน่งโมเดลสูงสุดของค่ายในปัจจุบัน

สเปก ราคา และการเข้าถึง

Astra และ Fable 5.1 ตั้งราคาไว้สูงที่สุดที่ $10 สำหรับ Input และ $50 สำหรับ Output ต่อ 1 ล้านโทเค็น ในขณะที่ Sol และ Argon มีราคาเพียง 1 ใน 5 ของราคาดังกล่าว อย่างไรก็ตาม ราคาของ Argon เป็นเพียงช่วงแนะนำและจะมีการปรับขึ้นในอนาคต

คุณสมบัติGPT-6 AstraGPT-6.1 SolGemini 4 ArgonClaude Fable 5.1
ผู้พัฒนาOpenAIOpenAIGoogle DeepMindAnthropic
วันที่วางจำหน่าย3 ก.ย. 202629 ก.ย. 2026ประกาศ 30 ก.ย. 20261 ก.ย. 2026
การเข้าถึงOpenAI API, ChatGPT, CodexOpenAI API, ChatGPT Work, Codexโปรแกรม Fairwind เท่านั้นClaude API, Bedrock, Google Cloud, Microsoft Foundry
Input / output (ต่อ 1M)$10 / $50$2 / $10$2 / $10 ช่วงแนะนำ, จากนั้น $4 / $20$10 / $50
Cached input (ต่อ 1M)$1.00$0.10$0.10 ช่วงแนะนำ$0.25
ราคา Long-promptสูงกว่า 272K: $20 / $75สูงกว่า 272K: 2x input, 1.5x outputไม่เปิดเผยราคาคงที่จนถึง 1M
Context window1.05M1.05Mไม่เปิดเผย1M
Output สูงสุดต่อการตอบกลับ128K128K1M128K
การควบคุมการให้เหตุผล5 ระดับความพยายาม5 ระดับความพยายามไม่เปิดเผยต่ำ, กลาง, สูง
Open weightsไม่ใช่ไม่ใช่ไม่ใช่ไม่ใช่

ที่มา: OpenAI GPT-6.1 Sol coverage, Gemini 4 Argon coverage, GPT-6 Astra long-context pricing, Claude Fable 5.1 specs

จุดที่น่าสนใจคือระบบ Cached Input ซึ่งสำคัญมากสำหรับ AI Agent ที่ต้องอ่านข้อมูลเดิมซ้ำๆ โดยค่าอ่าน Cache ของ Astra นั้นสูงกว่า Fable 5.1 ถึง 4 เท่า และแพงกว่า Sol ถึง 10 เท่า นอกจากนี้ Argon ยังโดดเด่นด้วยการรองรับ Output ได้สูงสุดถึง 1 ล้านโทเค็นต่อการตอบกลับเพียงครั้งเดียว

Benchmark: จุดเด่นที่แตกต่าง

การแข่งขันในเชิงประสิทธิภาพพบว่าไม่มีผู้ชนะที่ขาดลอยในทุกด้าน Argon ครองแชมป์งานด้านวิชาการและงานกฎหมาย Astra นำโด่งด้านวิศวกรรมซอฟต์แวร์ระดับสูงและการสั่งงานคอมพิวเตอร์ ส่วน Fable 5.1 ให้ประสิทธิภาพความฉลาดดิบ (Raw Intelligence) ที่สูงในบางดัชนี

BenchmarkทดสอบอะไรGemini 4 ArgonGPT-6 AstraClaude Fable 5.1
DeepSWE v1.1วิศวกรรมซอฟต์แวร์ระยะยาว77.9%74.1%67.4%
Vals Indexงานการเงิน, โค้ด, กฎหมาย68.9%63.1%65.8%
FrontierSWE v2วิศวกรรมซอฟต์แวร์ระดับสูง55.0%65.5%56.3%
Terminal-Bench 4.0งานประเภท agent ใน terminal57.4%58.2%57.9%
CWE-bench v1การแก้ไขช่องโหว่68%68%58%
OSWorld-2.0การใช้งานคอมพิวเตอร์69.2%72.6%-

ที่มา: การเปรียบเทียบที่เผยแพร่โดย Google DeepMind

สำหรับ GPT-6.1 Sol แม้จะไม่อยู่ในตารางเปรียบเทียบของ Google แต่ OpenAI ระบุว่ามันทำคะแนน DeepSWE v1.1 ได้เทียบเท่า Astra ในราคาที่ถูกกว่าถึง 5 เท่า และในด้านการใช้งานคอมพิวเตอร์ (OSWorld 2.0) Sol ก็ทำคะแนนตามหลังรุ่นพี่อย่าง Astra เพียง 2.1 จุดเท่านั้น

ความคุ้มค่าและต้นทุนต่อภารกิจ

ข้อมูลจาก Artificial Analysis เผยให้เห็นประเด็นสำคัญว่า แม้ราคาประกาศต่อหน่วยจะเท่ากัน แต่ Claude Fable 5.1 มีต้นทุนต่อภารกิจจริงสูงถึง $9.18 เทียบกับ $4.72 ของ GPT-6 Astra เนื่องจากระบบ Tokenizer ของ Anthropic มักสร้างจำนวนโทเค็นมากกว่าในการประมวลผลข้อความชุดเดียวกัน

สำหรับการใช้งาน AI Agent ที่มีการทำ Caching อย่างหนัก อันดับความคุ้มค่าจะเปลี่ยนไปทันที โดยในทุกๆ 100 ขั้นตอนของการทำงาน หากใช้ Context ขนาด 200K โทเค็น Astra จะมีค่าใช้จ่ายสูงถึง $20.00 ในขณะที่ Fable 5.1 จ่ายเพียง $5.00 และ Sol หรือ Argon จ่ายเพียง $2.00 เท่านั้น

บทสรุป: เลือกโมเดลที่ใช่กับงานที่เหมาะ

  • GPT-6.1 Sol: เหมาะที่สุดสำหรับงาน Coding ปริมาณมากและ CI Bots เนื่องจากราคาถูกและประสิทธิภาพสูง
  • GPT-6 Astra: เป็นตัวเลือกอันดับหนึ่งสำหรับงานวิจัยระดับสูง วิศวกรรมที่ซับซ้อน และการสั่งงานคอมพิวเตอร์ (Computer Use)
  • Gemini 4 Argon: โดดเด่นที่สุดในงานเฉพาะทางด้านกฎหมาย การเงิน และการเขียน Report ยาวๆ
  • Claude Fable 5.1: ให้ประสิทธิภาพยอดเยี่ยมในเครื่องมือช่วยเขียนโค้ด (Coding Agents) และมีระบบ Cache ที่คุ้มค่ากว่า Astra

อย่างไรก็ตาม การเข้าถึงยังเป็นข้อจำกัดสำคัญ โดย Argon ยังจำกัดอยู่เฉพาะกลุ่มนักป้องกันไซเบอร์ในโปรแกรม Fairwind ส่วนฟีเจอร์ระดับสูงของ Astra และโมเดลพิเศษของ Anthropic ก็อยู่ภายใต้โปรแกรมการเข้าถึงที่เชื่อถือได้เท่านั้น

Source: MarkTechPost
ดูแลงานแปลและเรียบเรียงโดย NatapolK

ความคิดเห็น (0)

เข้าสู่ระบบเพื่อร่วมแสดงความเห็น

สมัครสมาชิก

มาเป็นคนแรกที่แสดงความเห็นกันเลยโบร