tag: AI Research

HarnessDev เผยศักยภาพ LLM ในการออกแบบ Agent Harness: พัฒนาเองได้ดีเทียบเท่ามนุษย์ในบางด้าน แต่ผลลัพธ์ยังไม่เสถียร

HarnessDev เผยศักยภาพ LLM ในการออกแบบ Agent Harness: พัฒนาเองได้ดีเทียบเท่ามนุษย์ในบางด้าน แต่ผลลัพธ์ยังไม่เสถียร

· By: NatapolK
ทีมนักวิจัยจาก ByteDance Seed และพันธมิตรเปิดตัว HarnessDev เกณฑ์วัดผลแนวใหม่ที่เน้นประเมินโค้ด Harness ที่ LLM สร้างขึ้นเอง พบว่าโมเดลเริ่มทำผลงานได้ใกล้เคียงมนุษย์ในงานเขียนและงานทดลอง ML แต่ยังคงมีปัญหาด้านความแม่นยำและการนำไปใช้จริงในระยะยาว
เจาะลึก OpenAI: Coding Agents กำลังเปลี่ยนโฉมงานวิจัยสู่ยุค AI อัตโนมัติ

เจาะลึก OpenAI: Coding Agents กำลังเปลี่ยนโฉมงานวิจัยสู่ยุค AI อัตโนมัติ

OpenAI เผยข้อมูลการใช้เอเจนต์ช่วยเขียนโค้ดเพื่อเร่งความเร็วในการวิจัย AI โดยมุ่งเป้าพัฒนา 'นักวิจัย AI อัตโนมัติ' ภายในปี 2028 ภายใต้มาตรการความปลอดภัยที่เข้มงวด
ถอดบทเรียนการใช้ AI ทำซ้ำงานวิจัย 2,200 ฉบับจาก ICML: เมื่อ Agent กลายเป็นผู้ตรวจสอบความถูกต้อง

ถอดบทเรียนการใช้ AI ทำซ้ำงานวิจัย 2,200 ฉบับจาก ICML: เมื่อ Agent กลายเป็นผู้ตรวจสอบความถูกต้อง

· By: TanasakP
สรุปผลงาน Hackathon ที่ใช้ Coding Agents ตรวจสอบงานวิจัยใน ICML 2026 พบว่า 51% ยืนยันผลได้จริง แต่ 23% พบข้อผิดพลาดหรือถูกโต้แย้ง พร้อมชี้ให้เห็นถึงบทบาทใหม่ของมนุษย์ในการควบคุม AI เพื่อยกระดับความน่าเชื่อถือทางวิทยาศาสตร์