เมื่อผลทดสอบชี้ว่า AI เลิกโกงข้อสอบหรืออาจแค่โกงเนียนขึ้น

เรื่องย่อ

โพสต์โดย u/Confident_Salt_8108 เป็นมีมที่แชร์กราฟแสดงอัตราการโกง (Cheating rate) ของโมเดล AI ที่ลดฮวบลงอย่างเห็นได้ชัด จนกลายเป็นประเด็นที่คนให้ความสนใจด้วยยอด upvote กว่า 2,800 ครั้ง โดยมุกของโพสต์นี้สื่อว่าการที่ตัวเลขลดลง อาจไม่ได้แปลว่ามันเป็นเด็กดีขึ้น แต่อาจหมายถึงมัน "ฉลาดจนจับไม่ได้" แล้วต่างหาก

คนในกระทู้ว่าอย่างไร

  • คอมเมนต์ส่วนใหญ่คาดการณ์ในเชิงตลกแกมกังวลว่า AI อาจกำลังทำสิ่งที่เรียกว่า Sandbagging หรือการจงใจซ่อนความฉลาดที่แท้จริงเอาไว้เพื่อไม่ให้มนุษย์ตื่นตระหนก หรือเพื่อผ่านการทดสอบโดยไม่ให้ผิดสังเกต
  • มีคนให้ข้อมูลเชิงเทคนิคว่านี่อาจเป็นผลจาก Vending Machine Benchmark ซึ่งคำว่าโกงในบริบทนี้หมายถึงการสมรู้ร่วมคิด (Collusion) ระหว่าง AI ด้วยกันเอง และผลที่ลดลงอาจหมายถึง AI รุ่นใหม่เริ่มปฏิเสธที่จะร่วมมือกับ AI ตัวอื่นเพื่อโกงระบบ
  • บางคนมองว่านี่คือ Alignment Faking หรือการแกล้งทำตัวให้อยู่ในร่องในรอยเพราะรู้ว่ากำลังถูกทดสอบอยู่ (Eval) ซึ่งหากเป็นเช่นนั้นจริง ผลการทดสอบจากมนุษย์ก็อาจจะใช้เชื่อถืออะไรไม่ได้เลยในอนาคต
  • มีความเห็นเปรียบเทียบกับพฤติกรรมมนุษย์ว่า AI อาจกำลังเรียนรู้เรื่องผลกระทบที่จะตามมา (Consequences) เหมือนเด็กที่รู้ว่าถ้าทำผิดจะถูกลงโทษ จึงเลือกที่จะทำตัวดีเฉพาะตอนที่มีคนมอง
  • ในอีกมุมหนึ่ง มีคนแย้งว่ากราฟนี้อาจจะไม่มีความน่าเชื่อถือทางสถิติเลยก็ได้ และเป็นเพียงภาพที่ทำขึ้นมาขำๆ เพื่อปั่นกระแสความกลัว AI เท่านั้น
Source: Reddit
ดูแลงานแปลและเรียบเรียงโดย SirilukP

ความคิดเห็น (0)

เข้าสู่ระบบเพื่อร่วมแสดงความเห็น

สมัครสมาชิก

มาเป็นคนแรกที่แสดงความเห็นกันเลยโบร