เจาะลึกแนวทางการทำ Red Teaming ของ Anthropic เพื่อทดสอบความปลอดภัยของ AI ตั้งแต่การใช้ผู้เชี่ยวชาญเฉพาะด้านไปจนถึงการทดสอบแบบอัตโนมัติ เพื่อสร้างมาตรฐานใหม่ในการรับมือความเสี่ยงของโมเดลอัจฉริยะ
Anthropic เผยกรอบการทำงานเชิงระบบเพื่อระบุและบรรเทาอันตรายจาก AI ตั้งแต่ความเสี่ยงระดับหายนะไปจนถึงผลกระทบในชีวิตประจำวัน เพื่อสร้างมาตรฐานความปลอดภัยในการพัฒนาโมเดลยุคใหม่
OpenAI สั่งปิดทีมงานที่ทำหน้าที่ประเมินความเสี่ยงระดับวิกฤตจากโมเดล AI พร้อมโอนย้ายงานไปยังกลุ่มอื่น ท่ามกลางกระแสการลาออกของพนักงานและความกังวลภายในบริษัทว่ามาตรการด้านความปลอดภัยยังไม่เพียงพอ
โจทก์ในรัฐคอนเนตทิคัตถูกเพิกถอนสิทธิ์ยื่นเอกสารอิเล็กทรอนิกส์ หลังแอบฝังคำสั่ง AI ล่องหนในคำร้องเพื่อพยายามแทรกแซงการตรวจสอบ แม้ว่าศาลจะยังไม่ได้ใช้ระบบ AI จริงในการพิจารณาคดีก็ตาม
Anthropic เตรียมนำระบบลายน้ำมาใช้ในโมเดล Claude รุ่นใหม่เพื่อระบุเนื้อหาที่สร้างโดย AI โดยไม่ส่งผลกระทบต่อคุณภาพข้อความและคงความเป็นส่วนตัวของผู้ใช้อย่างสมบูรณ์
Anthropic เปิดตัวโมเดล AI รุ่นล่าสุด Claude Opus 4.5 ที่ทำคะแนนทดสอบวิศวกรรมซอฟต์แวร์ระดับ SOTA พร้อมฟีเจอร์ควบคุมความพยายามในการประมวลผล (Effort control) เพื่อเพิ่มประสิทธิภาพในการทำงานจริง
Anthropic ประกาศบริจาคเงินเพิ่มเติมอีก 20 ล้านดอลลาร์ให้กับ Public First Action เพื่อส่งเสริมการให้ความรู้ด้าน AI และผลักดันมาตรการป้องกันความเสี่ยงที่สมเหตุสมผล รวมยอดสนับสนุนทั้งหมด 40 ล้านดอลลาร์