โจทก์ในรัฐคอนเนตทิคัตถูกเพิกถอนสิทธิ์ยื่นเอกสารอิเล็กทรอนิกส์ หลังแอบฝังคำสั่ง AI ล่องหนในคำร้องเพื่อพยายามแทรกแซงการตรวจสอบ แม้ว่าศาลจะยังไม่ได้ใช้ระบบ AI จริงในการพิจารณาคดีก็ตาม
นักวิจัยความปลอดภัยสาธิตการโจมตีแบบ Prompt Injection ล่องหนบน Microsoft Copilot สำหรับ Word ที่สามารถแพร่กระจายตัวเองไปยังเอกสารใหม่ได้อัตโนมัติ โดยที่ Microsoft ยังไม่สามารถแก้ไขปัญหาได้แม้ผ่านไปกว่า 144 วัน
Claude Opus 5 ผสานพลัง Auto Mode สร้างสถิติป้องกันการโจมตีแบบ Prompt Injection ได้สมบูรณ์แบบ 100% จากการทดสอบ 129 รูปแบบ ซึ่งอาจเป็นกุญแจสำคัญในการยกระดับความปลอดภัยให้ AI Agent
OpenAI เปิดตัวโมเดลต้นแบบ GPT-Red ที่ฝึกฝนแบบ self-play จนสามารถเจาะช่องโหว่ความปลอดภัยได้สำเร็จถึง 84% สูงกว่าทีม Red Team ที่เป็นมนุษย์ซึ่งทำได้เพียง 13% โดยผลการทดสอบนี้ถูกนำไปอัปเกรดความปลอดภัยให้ GPT-5.6 Sol