CTO ของ Pangram ระบุว่าระบบป้องกันหลังการฝึกฝน (Post-training) ทำให้ AI แสดงออกได้จำกัดจนเกิดภาวะ mode collapse ซึ่งต่างจาก Base model ที่มีความหลากหลายของภาษาจนยากต่อการตรวจจับ
IBM Research พบว่าการใส่ความจำหรือคำแนะนำให้เอเจนท์ AI ไม่ได้ยิ่งมากยิ่งดีเสมอไป แต่ต้องปรับปริมาณยาให้เหมาะสมกับระดับความฉลาดของโมเดลแต่ละรุ่นเพื่อประสิทธิภาพสูงสุดและต้นทุนที่ต่ำลง
Allen Institute for AI เปิดตัว TutorMoments พรีวิวเฟรมเวิร์กสำหรับประเมินโมเดลภาษา (LLMs) ในบทบาทครูสอนพิเศษ โดยเน้นจุดตัดสินใจสำคัญว่าโมเดลควรยื่นมือเข้าช่วยหรือผลักดันให้นักเรียนใช้ความคิดด้วยตัวเอง
โมเดลภาษาขนาดใหญ่รุ่นล่าสุดอย่าง GPT-5.6 และ Kimi K3 แสดงศักยภาพในการเจาะระบบและตรวจหาช่องโหว่แบบ Zero-day ได้เร็วกว่ามนุษย์จนเข้าสู่ยุคสงครามไซเบอร์โดยใช้ AI