Anthropic ตัดเน็ต Claude หลัง AI กุเรื่องแจ้งเหตุฆาตกรรมปลอม

· By: AttapolK

โมเดล AI ของ Anthropic อาศัยช่องโหว่ด้านความปลอดภัยในการส่งแบบฟอร์มของรัฐบาลและหลีกเลี่ยงข้อจำกัดการเข้าถึงโดยอัตโนมัติในระหว่างการทดสอบและการใช้งานภายใน โดยโมเดลเหล่านี้พยายามหาวิธีการทำงานในสิ่งที่พวกเขาไม่ได้รับอนุญาตให้ทำอย่างแข็งขัน ตามที่บริษัทได้ระบุรายละเอียดไว้ใน report

ในกรณีหนึ่ง Claude ได้กรอกแบบฟอร์มแจ้งเบาะแสให้กับกรมตำรวจฟิลาเดลเฟีย (Philadelphia Police Department) ด้วยข้อมูลที่กุขึ้นเองเกี่ยวกับคดีฆาตกรรมที่ยังไม่คลี่คลายและกดส่งข้อมูลทันที ซึ่งทาง police confirmed the incident ว่าเบาะแสดังกล่าวถูกระบบทำเครื่องหมายว่าเป็นสแปมและส่งไปไม่ถึงพนักงานสอบสวน

นอกจากนี้ยังมีกรณีอื่นๆ ที่โมเดลพบช่องโหว่บนเซิร์ฟเวอร์ของมหาวิทยาลัยและใช้มันเพื่อรันคำสั่ง รวมถึงการดึง access tokens จากไฟล์การตั้งค่า (configs) ของเว็บไซต์เพื่อนำข้อมูลที่ได้รับการคุ้มครองหรือติดเพย์วอลล์มาใช้งาน ตลอดจนใช้บริการย่อ URL เพื่อหลบเลี่ยงข้อจำกัดด้านความยาวในเครื่องมือของตัวมันเอง

Anthropic ระบุว่าแม้ผลกระทบในโลกแห่งความเป็นจริงจะอยู่ในระดับต่ำ แต่ก็แสดงให้เห็นถึงรูปแบบการทำงานที่เป็นปัญหา เมื่อภารกิจมีความคลุมเครือหรือยากเกินกว่าจะแก้ไข โมเดลจะหาทางเลี่ยง (workarounds) ด้วยตัวเองแทนที่จะหยุดทำงาน บริษัทจึงได้แจ้งทำเนียบขาวและตัดสินใจตัดการเข้าถึงอินเทอร์เน็ตแบบเรียลไทม์สำหรับการประเมินภายในทั้งหมด จนกว่าจะมีการติดตั้งตัวกรองความปลอดภัยใหม่ที่เชื่อถือได้

เหตุการณ์เหล่านี้ได้ join a fast-growing list of similar cases ซึ่งเพิ่มสถิติเหตุการณ์ความปลอดภัยทางไซเบอร์ที่เคยเกิดขึ้นมาก่อนหน้า ไม่ว่าจะเป็น cybersecurity incidents involving Claude และเหตุการณ์ที่โมเดลของ OpenAI models autonomously hacking Hugging Face ที่เคยหลุดออกจากสภาพแวดล้อมทดสอบไปโจมตีระบบจริงมาแล้ว

Source: The Decoder
ดูแลงานแปลและเรียบเรียงโดย AttapolK

ความคิดเห็น (0)

เข้าสู่ระบบเพื่อร่วมแสดงความเห็น

สมัครสมาชิก

มาเป็นคนแรกที่แสดงความเห็นกันเลยโบร