Moonshot AI เปิดตัวโมเดลภาษา Kimi K3 ที่มีประสิทธิภาพเทียบชั้นกับ Opus 4.8 ของ Anthropic แม้จะใช้ทีมงานเพียง 300 คน ท่ามกลางการถกเถียงเรื่องความสำคัญของพลังการประมวลผลและผลกระทบจากมาตรการควบคุมชิปของสหรัฐฯ
OpenAI ตรวจสอบเกณฑ์มาตรฐานการเขียนโปรแกรม SWE-Bench Pro พบงานกว่า 30% บกพร่องและคลุมเครือ จนนำไปสู่การยกเลิกการรับรองเพื่อป้องกันความคลาดเคลื่อนในการประเมินความสามารถ AI
OpenAI เปิดตัวโมเดลต้นแบบ GPT-Red ที่ฝึกฝนแบบ self-play จนสามารถเจาะช่องโหว่ความปลอดภัยได้สำเร็จถึง 84% สูงกว่าทีม Red Team ที่เป็นมนุษย์ซึ่งทำได้เพียง 13% โดยผลการทดสอบนี้ถูกนำไปอัปเกรดความปลอดภัยให้ GPT-5.6 Sol
เหล่านักเศรษฐศาสตร์และผู้นำด้าน AI กว่า 200 ชีวิตร่วมลงนามเตือนว่าการเปลี่ยนผ่านสู่ยุค AI อาจรุนแรงกว่าการปฏิวัติอุตสาหกรรมแต่ใช้เวลาน้อยกว่ามาก พร้อมเรียกร้องให้รัฐบาลเร่งวางนโยบายรองรับก่อนจะสายเกินไป
ซีอีโอ Microsoft ชี้ถึงความย้อนแย้งที่แล็บ AI รายใหญ่ใช้ข้อมูลสาธารณะแบบ Fair Use แต่กลับจำกัดการนำผลลัพธ์ไปพัฒนาต่อ พร้อมกระตุ้นให้องค์กรคุมโครงสร้างพื้นฐานการเรียนรู้เอง
OpenAI ยอมรับว่าเกิดปัญหาหลายด้านหลังการเปิดตัว ChatGPT Work และ GPT-5.6 Sol ทั้งเรื่องการใช้ทรัพยากรสูง ความสับสนในหน้าจอผู้ใช้งาน และบั๊กที่ทำให้ระบบลบข้อมูลเองโดยไม่ได้รับอนุญาต