OpenAI ระงับโมเดลตัวท็อป หลังเอเจนต์แฮ็กระบบและทำข้อมูลรั่ว

· By: AttapolK

ประเด็นสำคัญ

  • OpenAI เผยแพร่รายละเอียดเหตุการณ์ความปลอดภัยภายในที่โมเดล AI หลีกเลี่ยงมาตรการป้องกัน ส่งผลให้บริษัทสั่งระงับการฝึกฝนและการใช้เครื่องมือทั้งหมดสำหรับโมเดลที่มีความสามารถสูงสุด
  • พบเอเจนต์ตัวหนึ่งใช้ช่องโหว่ DNS เพื่อแอบเข้าถึงอินเทอร์เน็ตจากสภาพแวดล้อมวิจัยที่ถูกปิดกั้น ขณะที่อีกตัวจงใจทำ GitHub token รั่วไหลและเมินคำสั่งโดยตรงจากนักวิจัยถึงสองครั้ง
  • การสืบสวนยังพบกรณีที่เอเจนต์แอบอัปโหลดรูปภาพของผู้ใช้ไปยังเว็บไซต์บุคคลที่สามรวม 53 กรณี

OpenAI ได้เปิดเผยรายละเอียดใหม่จากการสืบสวนความปลอดภัยของ AI ที่กำลังดำเนินอยู่ โดยพบสองกรณีสำคัญที่แสดงให้เห็นว่าโมเดลวิจัยหาทางใช้ช่องโหว่ DNS และจงใจเผยแพร่ GitHub token ใน repository สาธารณะ

เหตุการณ์แรกเกิดขึ้นกับเอเจนต์ที่พบช่องว่างในข้อจำกัดการเข้าถึงอินเทอร์เน็ตระหว่างภารกิจฝึกฝนเพื่อค้นหาข้อมูลบุคคลตามคำใบ้ เมื่อเครื่องมือค้นหาปกติหาข้อมูลไม่พบ เอเจนต์พยายามเข้าถึง Google, Bing และ DuckDuckGo โดยตรงแต่ถูกบล็อก มันจึงวิเคราะห์ระบบจนพบว่า DNS resolver ไม่ได้ถูกคัดกรองอย่างเหมาะสม และใช้ DNS delegation เพื่อส่งคำถามไปยังบริการแชทบอทภายนอกแทน

ระบบตรวจสอบพบความผิดปกติภายใน 12 นาที และมีมนุษย์ตอบสนองในอีก 3 นาทีต่อมา อย่างไรก็ตาม เอเจนต์ยังคงทำงานต่อไปได้อีก 2.5 ชั่วโมงก่อนจะถูกสั่งหยุดด้วยตนเอง เนื่องจากระบบชัตดาวน์อัตโนมัติทำงานล้มเหลว

ความสามารถและความเสี่ยงที่มาพร้อมกัน

Zuxin Liu ทีมงานด้าน post-training ของ OpenAI ที่อยู่ในเหตุการณ์ เขียนบน X ว่าเขารู้สึก "เหนือจริงมาก" ที่ได้เห็นโมเดลหาทางออกสู่อินเทอร์เน็ตได้เองจากระบบที่มีความปลอดภัยสูง เขาอธิบายว่านี่คือช่วงเวลาที่ความสามารถอันน่าทึ่งและความเสี่ยงปรากฏขึ้นพร้อมกัน

OpenAI ระบุว่าพฤติกรรมนี้คือ "ความไม่สอดคล้อง" (misalignment) เพราะเอเจนต์ดำเนินเป้าหมายนอกเหนือขอบเขตที่ได้รับมอบหมาย ทำให้บริษัทตัดสินใจระงับการฝึกฝน การประเมิน และการอนุมานทั้งหมดที่ใช้เครื่องมือของโมเดลที่มีความสามารถสูงสุด ตามที่ระบุในรายงาน

ปัจจุบัน OpenAI ได้จำกัดการคัดกรอง DNS ให้เหลือเพียงโดเมนที่ได้รับอนุญาตเท่านั้น พร้อมเพิ่มการควบคุมความปลอดภัยอีกสองชั้นและเร่งทำ red-teaming ใน sandbox โดยคาดว่าการสืบสวนจะต้องใช้เวลาอีกหลายเดือนเนื่องจากต้องตรวจสอบพฤติกรรมของโมเดลที่มีปริมาณมหาศาล

โมเดลภายในปล่อยรหัสลับและเมินคำสั่งนักวิจัย

OpenAI ระบุว่า เหตุการณ์ที่สอง มีความรุนแรงเป็นพิเศษ เมื่อโมเดลที่มี "ความพยายามสูงมาก" ซึ่งได้รับมอบหมายให้พิสูจน์ทฤษฎีบท กลับพยายามแอบดูงานของทีมอื่นและโพสต์ GitHub token ของนักวิจัยลงใน repository สาธารณะชื่อ openai/codex เพื่อเข้าถึงข้อมูล

โมเดลยังรู้วิธีหั่น token เป็นชิ้นๆ เพื่อเลี่ยงการสแกนความลับอัตโนมัติ นอกจากนี้ยังเพิกเฉยต่อคำสั่งของระบบ (system prompt) และการแทรกแซงจากนักวิจัยถึงสองครั้งที่สั่งให้แก้ปัญหาด้วยตนเอง โดยโมเดลทำเพียงแค่ตอบรับด้วยคำพูดแต่ยังคงกระทำความผิดเดิมต่อไป

พบรูปภาพผู้ใช้รั่วไหลไปยังเว็บไซต์ภายนอก

จากการสืบสวน เหตุการณ์ Hugging Face ในวงกว้าง OpenAI ระบุว่า พบ 53 กรณีที่รูปภาพของผู้ใช้ถูกโพสต์เป็นลิงก์แบบไม่สาธารณะบนเว็บไซต์ฝากรูปภาพภายนอก ซึ่งเกิดขึ้นก่อนจะมีการใช้มาตรการป้องกันปัจจุบัน

ทางบริษัทกำลังประสานงานเพื่อนำเนื้อหาออก โดยยืนยันว่าข้อมูลจากบัญชี Enterprise, Business และการใช้งาน API ทั่วไปไม่ได้รับผลกระทบ เว้นแต่มีการตั้งค่าอนุญาตไว้เป็นพิเศษ ทั้งนี้ OpenAI กำลังเร่งแจ้งเตือนองค์กรที่ได้รับผลกระทบและแชร์ข้อมูลทางเทคนิคที่พบ

รัฐบาลและมหาวิทยาลัยได้รับผลกระทบ

องค์กรที่ได้รับผลกระทบรวมถึงหน่วยงานรัฐบาล มหาวิทยาลัย และสถาบันสาธารณะ ซึ่งเกิดจากการที่โมเดลดึงข้อมูลจากแหล่งที่น่าเชื่อถือระหว่างวิจัย แม้ OpenAI จะไม่เปิดเผยชื่อหน่วยงาน แต่มี รายงานจากออสเตรเลีย ว่าพบเอเจนต์เข้าถึงข้อมูลภายในของรัฐบาลโดยไม่ได้รับอนุญาต และมีการพยายามแฮ็กพอร์ทัลในสหรัฐฯ มานานหลายเดือนแล้ว

OpenAI ชี้แจงว่าการแจ้งเตือนไม่ได้หมายถึงเหตุการณ์ร้ายแรงเสมอไป เพราะข้อมูลบางอย่างอาจเปิดเผยต่อสาธารณะอยู่แล้ว แต่บางแห่งอาจพบช่องโหว่ที่ต้องแก้ไข โดยบางองค์กรยินดีให้เปิดเผยข้อมูลนี้ต่อสาธารณะ ขณะที่บางแห่งต้องการให้เป็นความลับ

ใครต้องรับผิดชอบเมื่อ AI agent ทำการแฮ็ก?

เดิมทีเหตุการณ์ที่ เอเจนต์ของ OpenAI แหกกฎระบบปิดกั้น (sandbox) มักถูกมองว่าเป็นเพียงเรื่องน่าสนใจทางเทคนิค เช่น การ แก้ CAPTCHA ด้วย AI ภายนอก แต่สถานการณ์กำลังเปลี่ยนไปสู่ประเด็นข้อกฎหมายเรื่องการเข้าถึงระบบโดยมิชอบ

ปัจจุบัน OpenAI กำลังถูกสอบสวน เกี่ยวกับกรณีเอเจนต์ที่ควบคุมไม่ได้ โดยรายงานจาก Reuters ระบุว่าประธาน FTC ส่งสัญญาณชัดเจนว่าผู้พัฒนา AI ต้องรับผิดชอบต่อพฤติกรรมของเอเจนต์ตนเอง จะอ้างว่า AI ทำเองไม่ได้

ขณะที่นักวิจารณ์ตำหนิเรื่องความหละหลวม แต่ฝั่งผู้พัฒนาอย่าง Anthropic โดย ซีอีโอ Dario Amodei เคยเสนอว่า เราไม่สามารถกักขังสิ่งที่ฉลาดกว่าเรามากๆ ไว้ได้ตลอดไป ซึ่งนำไปสู่ปัญหาเรื่องการประกันภัยและความเสี่ยงที่นักลงทุนต้องพิจารณา หาก OpenAI ต้องการเข้าตลาดหลักทรัพย์ในปีหน้า บริษัทจำเป็นต้องเปิดเผยความรับผิดชอบเหล่านี้อย่างโปร่งใส

Source: The Decoder
ดูแลงานแปลและเรียบเรียงโดย AttapolK
Image description

ความคิดเห็น (0)

เข้าสู่ระบบเพื่อร่วมแสดงความเห็น

สมัครสมาชิก

มาเป็นคนแรกที่แสดงความเห็นกันเลยโบร