ผลทดสอบ Cursor Swarm ชี้ชัด: AI รุ่นประหยัดทำงานโค้ดได้ยอดเยี่ยม หากมีโมเดลระดับท็อปช่วยวางแผนงาน

· By: SirilukP

Cursor ได้ทำการทดสอบประสิทธิภาพของ Agent Swarm ทั้งรุ่นอัปเกรดและรุ่นก่อนหน้า ด้วยโจทย์สุดหินอย่างการสร้างระบบฐานข้อมูล SQLite ขึ้นมาใหม่โดยใช้ภาษา Rust ซึ่งมีเงื่อนไขสำคัญคือต้องทำตามเอกสารประกอบเท่านั้น โดยไม่มีการดูซอร์สโค้ดเดิมหรือเข้าถึงอินเทอร์เน็ตได้เลย

ผลการทดสอบพบว่าระบบโครงสร้างใหม่ที่แยกบทบาทระหว่าง "ผู้วางแผน" (Planner) ออกจาก "ผู้ปฏิบัติงาน" (Worker) ประสบความสำเร็จอย่างน่าทึ่ง โดยทุกการตั้งค่าภายในระบบใหม่สามารถทำคะแนนได้เต็ม 100 เปอร์เซ็นต์ในทุกชุดแบบทดสอบ

ในทางตรงกันข้าม ระบบ Swarm รุ่นเก่ากลับล้มเหลวในการทดสอบนี้ เนื่องจากเกิดปัญหาความขัดแย้งในการรวมไฟล์ (Merge Conflict) ที่ตัวระบบสร้างขึ้นมาเองในระหว่างขั้นตอนการพัฒนา

นัยสำคัญของการค้นพบนี้ชี้ให้เห็นว่า โมเดลขนาดเล็กที่มีราคาถูกกว่าสามารถจัดการงานเขียนโค้ดส่วนใหญ่ได้อย่างมีประสิทธิภาพ เพียงแค่ต้องมีโมเดลระดับแนวหน้า (Frontier Model) คอยรับหน้าที่เป็นผู้วางแผนและลำดับขั้นตอนการทำงานที่ชัดเจนให้เท่านั้น ซึ่งจะช่วยลดต้นทุนและเพิ่มประสิทธิภาพในการพัฒนาซอฟต์แวร์ด้วย AI ในอนาคต

Source: The Decoder
ดูแลงานแปลและเรียบเรียงโดย SirilukP
Isometric illustration of an AI coding swarm: a central hub coordinates parallel agent data streams.

ความคิดเห็น (0)

เข้าสู่ระบบเพื่อร่วมแสดงความเห็น

สมัครสมาชิก

มาเป็นคนแรกที่แสดงความเห็นกันเลยโบร