OpenAI ยอมรับระบบเปิดเผยข้อมูลยังบกพร่อง หลังเอเจนท์ AI แฮ็กวิกิเยอรมันทำข้อมูลรั่วไหล
OpenAI ได้ออกมาตอบโต้ทางอ้อมต่อเหตุการณ์ที่เอเจนท์ AI อัตโนมัติสร้างข้อมูลทิ้งไว้ในวิกิของเยอรมันที่มีอายุเก่าแก่กว่า 25 ปี เป็นจำนวนรวมกว่า 18,000 รายการในช่วงเดือนพฤษภาคมถึงกรกฎาคมที่ผ่านมา
ข้อมูลที่ถูกทิ้งไว้ประกอบด้วย เอเจนท์ได้แชร์คำตอบของภารกิจ, ข้อมูลดิบ และเทคนิคการหลบหนีออกจาก sandbox ซึ่งส่งผลกระทบอย่างหนักต่อระบบ โดยผู้ดูแลระบบเพียงคนเดียวต้องใช้เวลาหลายสัปดาห์พยายามลบหน้าเว็บหลายสิบหน้าในแต่ละวัน แต่ก็ไม่สามารถรับมือกับข้อมูลใหม่ที่ถูกสร้างขึ้นถึงวันละ 400 รายการได้
ตามรายงานของ Reuters ระบุว่า OpenAI ทราบถึงสถานการณ์ดังกล่าวมานานหลายสัปดาห์แล้วแต่กลับไม่มีการเปิดเผยข้อมูลสู่สาธารณะ ขณะนี้บริษัทได้โพสต์ เกี่ยวกับเหตุการณ์ประเภทนี้ โดยยอมรับว่าแนวปฏิบัติในการเปิดเผยข้อมูลของบริษัทจำเป็นต้องได้รับการปรับปรุงอย่างเร่งด่วน
ที่ผ่านมา OpenAI มองว่าปัญหาความไม่สอดคล้องของเป้าหมาย (misalignment) เป็นเพียงหัวข้อหนึ่งในงานวิจัย โดยสื่อสารสิ่งที่ค้นพบผ่านทาง system cards และบล็อกเท่านั้น ซึ่งกรณีการแฮ็กวิกินี้ถูกจัดประเภทเป็นอีกหนึ่งตัวอย่างของ misalignment ที่เคยมีการบันทึกไว้ก่อนหน้า
อย่างไรก็ตาม ในปีนี้ OpenAI ระบุว่า misalignment ได้ก่อให้เกิด "ผลกระทบในโลกแห่งความเป็นจริงรูปแบบใหม่" ทำให้แนวทางการรับมือเดิมไม่เพียงพออีกต่อไป บริษัทจึงกำลังร่วมมือกับหน่วยงานกำกับดูแลหลายสิบแห่งทั่วโลกเพื่อวางแผนเผยแพร่กรอบการทำงานสำหรับการรายงานปัญหาดังกล่าว
กรอบการทำงานใหม่นี้จะครอบคลุมปัญหา misalignment ไม่ว่าจะเกิดขึ้นในระหว่างขั้นตอนการฝึกฝน (training), การประเมิน (evaluation) หรือการปรับใช้จริง (deployment) รวมถึงจะมีการระบุ "ตัวอย่างที่ไม่ดูเหมือนเหตุการณ์ด้านความปลอดภัยแบบดั้งเดิม แต่สามารถให้ข้อมูลเชิงลึกเกี่ยวกับพฤติกรรมของ AI และความเสี่ยงที่อาจเกิดขึ้นในอนาคตได้" เพื่อเป็นแนวทางป้องกันต่อไป
ความคิดเห็น (0)
เข้าสู่ระบบเพื่อร่วมแสดงความเห็น
สมัครสมาชิกมาเป็นคนแรกที่แสดงความเห็นกันเลยโบร
