ผลทดสอบ Cursor Swarm ชี้ชัด: AI รุ่นประหยัดทำงานโค้ดได้ยอดเยี่ยม หากมีโมเดลระดับท็อปช่วยวางแผนงาน
Cursor ได้ทำการทดสอบประสิทธิภาพของ Agent Swarm ทั้งรุ่นอัปเกรดและรุ่นก่อนหน้า ด้วยโจทย์สุดหินอย่างการสร้างระบบฐานข้อมูล SQLite ขึ้นมาใหม่โดยใช้ภาษา Rust ซึ่งมีเงื่อนไขสำคัญคือต้องทำตามเอกสารประกอบเท่านั้น โดยไม่มีการดูซอร์สโค้ดเดิมหรือเข้าถึงอินเทอร์เน็ตได้เลย
ผลการทดสอบพบว่าระบบโครงสร้างใหม่ที่แยกบทบาทระหว่าง "ผู้วางแผน" (Planner) ออกจาก "ผู้ปฏิบัติงาน" (Worker) ประสบความสำเร็จอย่างน่าทึ่ง โดยทุกการตั้งค่าภายในระบบใหม่สามารถทำคะแนนได้เต็ม 100 เปอร์เซ็นต์ในทุกชุดแบบทดสอบ
ในทางตรงกันข้าม ระบบ Swarm รุ่นเก่ากลับล้มเหลวในการทดสอบนี้ เนื่องจากเกิดปัญหาความขัดแย้งในการรวมไฟล์ (Merge Conflict) ที่ตัวระบบสร้างขึ้นมาเองในระหว่างขั้นตอนการพัฒนา
นัยสำคัญของการค้นพบนี้ชี้ให้เห็นว่า โมเดลขนาดเล็กที่มีราคาถูกกว่าสามารถจัดการงานเขียนโค้ดส่วนใหญ่ได้อย่างมีประสิทธิภาพ เพียงแค่ต้องมีโมเดลระดับแนวหน้า (Frontier Model) คอยรับหน้าที่เป็นผู้วางแผนและลำดับขั้นตอนการทำงานที่ชัดเจนให้เท่านั้น ซึ่งจะช่วยลดต้นทุนและเพิ่มประสิทธิภาพในการพัฒนาซอฟต์แวร์ด้วย AI ในอนาคต

ความคิดเห็น (0)
เข้าสู่ระบบเพื่อร่วมแสดงความเห็น
สมัครสมาชิกมาเป็นคนแรกที่แสดงความเห็นกันเลยโบร
