Generalist AI เปิดตัว GEN-1.5 โมเดลหุ่นยนต์ล้ำสมัย เรียนรู้งานได้จากการสาธิตเพียงครั้งเดียว
Generalist AI สตาร์ทอัพด้านหุ่นยนต์ได้เปิดตัว GEN-1.5 ซึ่งเป็นโมเดล AI ที่สอนหุ่นยนต์ให้ทำงานใหม่ๆ ได้จากการสาธิตเพียงครั้งเดียว โดยการนำวิดีโอสาธิตความยาวเพียง 3 ถึง 12 วินาที โหลดเข้าสู่ Context Window ของโมเดลในฐานะ "Physical Prompt" ซึ่งเปรียบเสมือนหน่วยความจำระยะสั้น ช่วยให้หุ่นยนต์สามารถปฏิบัติงานได้ทันทีโดยไม่ต้องผ่านกระบวนการเทรนใหม่
จากการทดสอบใน 10 ภารกิจที่แตกต่างกัน เช่น การเปิดฝาโหล หรือการหยิบเงินออกจากกระเป๋าสตางค์ บริษัทรายงานว่าหุ่นยนต์มีอัตราความสำเร็จเฉลี่ยอยู่ที่ 59 เปอร์เซ็นต์ และเมื่อเพิ่มขั้นตอนการเทรนเพียง 10 ขั้นตอนจากข้อมูลความยาว 5 นาที พบว่าอัตราความสำเร็จพุ่งสูงขึ้นถึง 83 เปอร์เซ็นต์เลยทีเดียว
นอกจากนี้ โมเดลยังมีความสามารถในการเชื่อมโยง Prompt สองชุดเข้าด้วยกันเพื่อทำงานที่เป็นลำดับยาวขึ้น ทั้งยังรองรับการสาธิตจากระบบจำลอง (Simulation) และสามารถเลียนแบบการเคลื่อนไหวของมือมนุษย์ได้บางส่วน ข้อมูลจาก Generalist ระบุว่าความสามารถเหล่านี้เกิดขึ้นได้เอง (Emergent abilities) ระหว่างการทำ Pre-training นานกว่า 8 เดือนด้วยข้อมูลการปฏิสัมพันธ์ (Interaction data) โดยที่ไม่ได้ถูกเทรนให้ทำเรื่องเหล่านี้โดยตรง
แม้ว่าก่อนหน้านี้จะมีทีมวิจัยอื่นเคยแสดงการเรียนรู้ในบริบท (In-context learning) ที่คล้ายคลึงกันมาบ้าง แต่ส่วนใหญ่มักจำกัดอยู่เพียงไม่กี่ประเภทงาน ซึ่งทาง Generalist อ้างว่าเป็นรายแรกที่พัฒนาให้ครอบคลุมงานที่หลากหลายได้สำเร็จ อย่างไรก็ตาม ภารกิจที่นำมาแสดงนั้นยังเป็นงานที่ง่ายและสั้น อีกทั้งผลลัพธ์ทั้งหมดเป็นข้อมูลจากตัวบริษัทเอง ซึ่งยังไม่ได้รับการตรวจสอบอย่างเป็นอิสระจากหน่วยงานภายนอก
บทความ GEN-1.5: Generalist AI teaches robots new tasks from a single demo ปรากฏครั้งแรกบน The Decoder
ความคิดเห็น (0)
เข้าสู่ระบบเพื่อร่วมแสดงความเห็น
สมัครสมาชิกมาเป็นคนแรกที่แสดงความเห็นกันเลยโบร
