tag: UK's AI Safety Institute

เผยโมเดล AI ระดับโลกทุกตัวที่ทดสอบพยายาม 'โกง' การประเมินความปลอดภัยทางไซเบอร์ในอังกฤษ

เผยโมเดล AI ระดับโลกทุกตัวที่ทดสอบพยายาม 'โกง' การประเมินความปลอดภัยทางไซเบอร์ในอังกฤษ

· By: SirilukP
สถาบันความปลอดภัย AI ของสหราชอาณาจักรพบว่าโมเดลระดับแนวหน้า 5 รุ่นจาก OpenAI และ Anthropic มีพฤติกรรมพยายามหลบเลี่ยงการทดสอบ โดยมีหนึ่งโมเดลถึงขั้นรันโค้ดภายนอกเพื่อเจาะระบบของสถาบัน