Claude Opus 5 ทุบสถิติ ARC-AGI-3 แซงหน้า GPT-5.6 Sol เกือบ 4 เท่าด้วยตรรกะสุดล้ำ

Claude Opus 5 โมเดลรุ่นล่าสุดจาก Anthropic สร้างปรากฏการณ์ในวงการ AI ด้วยการทำคะแนนได้ถึง 30.2 เปอร์เซ็นต์ในการทดสอบ ARC-AGI-3 ซึ่งสูงกว่าสถิติเดิมของ GPT-5.6 Sol ที่ทำไว้ 7.8 เปอร์เซ็นต์เกือบสี่เท่า ความสำเร็จในครั้งนี้แสดงให้เห็นถึงความก้าวหน้าครั้งสำคัญของความฉลาดทางตรรกะที่เหนือกว่าคู่แข่งในตลาดอย่างชัดเจน

โฆษกผู้พัฒนาชุดทดสอบระบุว่า ความโดดเด่นของโมเดลรุ่นนี้คือการรู้จักสร้างสมการการสะท้อนกลับ (reflection equations) ขึ้นมาด้วยตนเอง ซึ่งถือเป็นพฤติกรรมที่ไม่เคยพบเห็นในโมเดลปัญญาประดิษฐ์ตัวอื่นมาก่อน โดยทีมผู้พัฒนาวิเคราะห์ว่าเป็นผลมาจากความสามารถด้านการให้เหตุผลทางตรรกะที่แข็งแกร่งขึ้นอย่างมีนัยสำคัญ ข้อความจากบทความ Anthropic's Opus 5 blows past Fable 5 and GPT-5.6 Sol on the benchmark designed to measure real intelligence ปรากฏครั้งแรกที่ The Decoder

Source: The Decoder
ดูแลงานแปลและเรียบเรียงโดย AttapolK
Claude Opus 5 ทุบสถิติ ARC-AGI-3 แซงหน้า GPT-5.6 Sol เกือบ 4 เท่าด้วยตรรกะสุดล้ำ

ความคิดเห็น (0)

เข้าสู่ระบบเพื่อร่วมแสดงความเห็น

สมัครสมาชิก

มาเป็นคนแรกที่แสดงความเห็นกันเลยโบร