ผลการศึกษาใหม่พบว่าผู้ช่วยเขียนโค้ด AI อย่าง Claude Code และ Codex ขาดความเข้าใจเรื่องเวลาและประเมินผลงานตัวเองสูงเกินจริง ซึ่งเป็นความท้าทายสำคัญในการกำกับดูแลงานอัตโนมัติระยะยาว
Google DeepMind ร่วมกับสถาบันความปลอดภัย AI ของสิงคโปร์ ทดสอบระบบประเมินผลแบบปิดลับ (Double-blind) เพื่อป้องกันการรั่วไหลของข้อมูลและสร้างมาตรฐานใหม่ในการทดสอบ AI ที่โปร่งใส
Beatport ตลาดกลางเพลงสำหรับ DJ เริ่มมาตรการแบนเพลงที่สร้างโดย AI เกือบทั้งหมด โดยอนุญาตเฉพาะผลงานที่มนุษย์เป็นผู้สร้างหลักเท่านั้น เพื่อรักษามาตรฐานศิลปะดนตรีดั้งเดิม
ศาลรัฐบาลกลางในซานฟรานซิสโกตัดสินว่าการจัดประเภท Anthropic เป็นความเสี่ยงต่อห่วงโซ่อุปทานโดยกระทรวงกลาโหมสหรัฐฯ เป็นการกระทำที่ไม่ชอบด้วยกฎหมายและเป็นการตอบโต้การวิพากษ์วิจารณ์นโยบาย AI
Anthropic เปิดตัวรุ่นทดสอบ Model Hardware Standard (MHS) ข้อกำหนดมาตรฐานที่ช่วยให้เอเยนต์ AI สามารถควบคุมอุปกรณ์ในห้องแล็บและโรงงานผลิตได้อย่างปลอดภัยและรวดเร็ว
Google Research และ UNSW Sydney พัฒนา GlucoFM โมเดล Foundation Model ขนาดเล็กแต่ทรงพลังที่แยกข้อมูลการตรวจระดับน้ำตาลต่อเนื่อง (CGM) เป็นสายข้อมูลสรีรวิทยาและเหตุการณ์ชั่วคราว ซึ่งให้ความแม่นยำสูงกว่าโมเดลขนาดใหญ่หลายร้อยเท่า