Anthropic ประกาศเปิดตัว Claude Fable 5 อีกครั้ง พร้อมยกระดับมาตรฐานความปลอดภัยไซเบอร์ร่วมกับรัฐบาลสหรัฐฯ

อัปเดต Claude Fable 5 และ Mythos 5 เตรียมกลับมาเปิดตัวใหม่อีกครั้งในวันที่ 1 ก.ค. 2026 นี้ โดยขณะนี้การเข้าถึงโมเดลทั้งสองได้รับการคืนค่าเป็นที่เรียบร้อยแล้ว

สืบเนื่องจากเมื่อวันศุกร์ที่ 12 มิถุนายน รัฐบาลสหรัฐฯ ได้ประกาศใช้มาตรการควบคุมการส่งออกกับโมเดลใหม่ล่าสุดของเรา ได้แก่ Claude Fable 5 และ Claude Mythos 5 ส่งผลให้บริษัทจำเป็นต้องจำกัดการเข้าถึงสำหรับชาวต่างชาติทั้งในและนอกสหรัฐฯ เนื่องจากคำสั่งมีผลทันทีและยังไม่มีระบบยืนยันสัญชาติแบบเรียลไทม์ที่แม่นยำเพียงพอ เราจึงตัดสินใจระงับการเข้าถึงของผู้ใช้ทุกคนเป็นการชั่วคราว

ณ วันที่ 30 มิถุนายนนี้ มาตรการควบคุมการส่งออกสำหรับ Fable 5 และ Mythos 5 ได้รับการยกเลิกอย่างเป็นทางการแล้ว

Fable 5 จะเริ่มเปิดให้ใช้งานในวันพุธที่ 1 กรกฎาคม สำหรับผู้ใช้ทั่วโลกผ่าน Claude Platform, Claude.ai, Claude Code และ Claude Cowork โดยครอบคลุมแผน Pro, Max, Team และ Enterprise บางกลุ่ม ทั้งนี้ Fable 5 จะถูกรวมอยู่ในขีดจำกัดการใช้งานรายสัปดาห์สูงสุด 50% จนถึงวันที่ 7 กรกฎาคม หลังจากนั้นจะสามารถใช้งานผ่าน usage credits ได้ตามปกติ ส่วนการเข้าถึงบน AWS, Google Cloud และ Microsoft Foundry จะได้รับการเปิดใช้งานอีกครั้งโดยเร็วที่สุด

นอกจากนี้ เราได้คืนค่าการเข้าถึง Mythos 5 ให้กับกลุ่มองค์กรในสหรัฐฯ หลังได้รับการอนุมัติจากรัฐบาลเมื่อวันที่ 26 มิถุนายน และกำลังประสานงานเพื่อ ขยาย การเข้าถึงไปยังพันธมิตรในประเทศและระหว่างประเทศผ่านโครงการ Glasswing ต่อไป

สำหรับรายละเอียดเพิ่มเติมในประกาศนี้ จะครอบคลุมข้อมูลใน 4 ด้านหลัก ได้แก่:

  • ไทม์ไลน์และมาตรการป้องกัน: ลำดับเหตุการณ์ที่นำไปสู่การควบคุมการส่งออก และวิธีแก้ปัญหาด้วยระบบป้องกันใหม่
  • แนวทางมาตรการป้องกัน: การใช้ระบบตัวจำแนกความปลอดภัย (Safety Classifiers) เพื่อตรวจจับการใช้งานผิดประเภทที่อาจกระทบต่อความมั่นคงไซเบอร์
  • โครงสร้างอุตสาหกรรมร่วมกัน: การพัฒนามาตรฐานประเมินและแก้ไขการ "เจลเบรค" (Jailbreak) ร่วมกับยักษ์ใหญ่เทคโนโลยีอย่าง Amazon, Microsoft และ Google เพื่อสร้างความสม่ำเสมอในการระบุความเสี่ยง
  • ความร่วมมือกับรัฐบาล: การยกระดับการทดสอบโมเดลก่อนเปิดตัวและการวิจัยร่วมกับหน่วยงานรัฐของสหรัฐฯ

ไทม์ไลน์และการอัปเดตมาตรการป้องกัน

เราได้เปิดตัว Fable 5 และ Mythos 5 ครั้งแรกเมื่อวันที่ 9 มิถุนายน โดยทั้งสองใช้โมเดลพื้นฐานเดียวกัน แต่ Fable 5 ถูกติดตั้งระบบป้องกันที่เข้มงวดเพื่อความปลอดภัยในการใช้งานทั่วไป ขณะที่ Mythos 5 ซึ่งมีข้อจำกัดน้อยกว่า ถูกจำกัดสิทธิ์เฉพาะพันธมิตรในโครงการ Project Glasswing เพื่อใช้ในงานป้องกันทางไซเบอร์เท่านั้น

เหตุการณ์ควบคุมการส่งออกเมื่อวันที่ 12 มิถุนายน เกิดขึ้นหลังนักวิจัยจาก Amazon พบวิธีเลี่ยงระบบป้องกันของ Fable 5 เพื่อให้ระบุช่องโหว่ซอฟต์แวร์และสร้างโค้ดเจาะระบบได้ ในช่วงสองสัปดาห์ที่ผ่านมา เราจึงทำงานใกล้ชิดกับรัฐบาลและ Amazon เพื่อตรวจสอบข้อเท็จจริงอย่างละเอียด

จากการทดสอบพบว่า โมเดลที่มีขีดความสามารถต่ำกว่าอย่าง Claude Opus 4.8, GPT-5.5 และ Kimi K2.7 ก็สามารถระบุช่องโหว่ได้เช่นกัน และเมื่อทดสอบการสาธิตวิธีเจาะช่องโหว่ ทุกโมเดลที่ทดสอบ (รวมถึง Claude Haiku 4.5, Sonnet 4.6 และ GPT-5.4) สามารถสร้างผลลัพธ์ได้แบบเดียวกัน พฤติกรรมนี้เป็นกรณีคาบเกี่ยวของระบบป้องกัน ซึ่งเราได้แก้ไขด้วยการฝึกตัวจำแนกความปลอดภัย (Safety Classifier) ใหม่ที่บล็อกพฤติกรรมดังกล่าวได้แม่นยำกว่า 99% โดยนักวิจัยจาก Center for AI Standards and Innovation (CAISI) ยืนยันว่าระบบใหม่นี้มีความแข็งแกร่งเป็นพิเศษ

แนวทางของเราต่อมาตรการป้องกันความปลอดภัยทางไซเบอร์

Claude Mythos 5 มีขีดความสามารถในการค้นหาช่องโหว่ที่เหนือกว่าผู้เชี่ยวชาญที่เป็นมนุษย์ แต่สำหรับ Claude Fable 5 เราได้ออกแบบมาตรการป้องกันที่แข็งแกร่งที่สุด โดยใช้แนวทาง "การป้องกันเชิงลึก" (Defense in Depth) ที่รวมกลไกความปลอดภัยหลายชั้นเข้าด้วยกัน

หัวใจสำคัญคือระบบ ตัวจำแนกประเภท (Classifiers) ซึ่งเป็น AI ขนาดเล็กที่ทำหน้าที่ตรวจจับและบล็อกคำขอที่เป็นอันตรายแบบเรียลไทม์ เพื่อลดความเสี่ยง เราได้ตั้งค่า "ระยะขอบความปลอดภัย" (Safety Margin) ให้กว้างขึ้นใน Fable 5 (ตามแถว B ในแผนภาพ) แม้สิ่งนี้จะส่งผลให้โมเดลปฏิเสธคำขอที่ไม่เป็นอันตรายบางอย่าง (False Positives) มากขึ้น แต่เรายอมรับข้อเสียนี้เพื่อแลกกับความปลอดภัยสูงสุด

Anthropic ประกาศเปิดตัว Claude Fable 5 อีกครั้ง พร้อมยกระดับมาตรฐานความปลอดภัยไซเบอร์ร่วมกับรัฐบาลสหรัฐฯ

ภาพประกอบของตัวจำแนกความปลอดภัยทางไซเบอร์ของเรา

ระบบจะคัดกรองคำขอเป็น 3 ระดับ: ไม่เป็นอันตราย (อนุญาต), กำกวม และอันตราย (บล็อก) ใน Fable 5 เราเพิ่มระยะขอบความปลอดภัยให้กว้างขึ้นเพื่อป้องกันพฤติกรรมที่เป็นอันตรายที่อาจหลุดรอด แม้จะต้องแลกกับการบล็อกคำขอที่น่าจะปลอดภัยมากขึ้นก็ตาม

ระยะขอบนี้ยังช่วยลดผลกระทบจากการเจลเบรค โดยเราแบ่งระดับความรุนแรงจากการเจลเบรคเล็กน้อย (แถว C) ที่ยังอยู่ในระยะขอบปลอดภัย ไปจนถึงการเจลเบรคแบบเฉพาะจุด (แถว D) และระดับที่น่ากังวลที่สุดคือการเจลเบรคแบบครอบจักรวาล (แถว E) ซึ่งเรายังไม่พบใน Fable 5 ณ ขณะนี้

Anthropic ประกาศเปิดตัว Claude Fable 5 อีกครั้ง พร้อมยกระดับมาตรฐานความปลอดภัยไซเบอร์ร่วมกับรัฐบาลสหรัฐฯ

วิธีที่การเจลเบรคมีปฏิสัมพันธ์กับตัวจำแนกความปลอดภัยของเรา

เป้าหมายของเราคือการทำให้การเจลเบรคมีต้นทุนสูงและใช้ความพยายามมหาศาล โดยเราจะอัปเดตระบบตัวจำแนกประเภทอย่างต่อเนื่องตามเทคนิคใหม่ๆ ที่ได้รับรายงาน

โครงสร้างอุตสาหกรรมที่เป็นเอกฉันท์สำหรับการเจลเบรค

ปัจจุบันอุตสาหกรรม AI ยังขาดมาตรฐานในการวัดความรุนแรงของการเจลเบรค Anthropic จึงร่วมมือกับ Amazon, Microsoft, Google และพันธมิตร Glasswing ร่างโครงสร้างประเมินความรุนแรงตามเกณฑ์ 4 ประการ: การเพิ่มขึ้นของความสามารถ, ความกว้างของความสามารถ, ความง่ายในการนำไปใช้เป็นอาวุธ และการค้นพบได้ง่าย

นอกจากนี้ เรายังได้เปิดตัวโครงการ HackerOne program เพื่อให้นักวิจัยความปลอดภัยส่งรายงานการเจลเบรคใน Fable 5 ให้เราตรวจสอบโดยตรง

การร่วมมือกับรัฐบาลสหรัฐฯ ในด้านความมั่นคงปลอดภัยของ Frontier AI

เรามุ่งมั่นทำงานร่วมกับรัฐบาลสหรัฐฯ ตามคำสั่งบริหาร (Executive Order) วันที่ 2 มิถุนายน เรื่อง Promoting Advanced Artificial Intelligence Innovation and Security โดยครอบคลุมด้านต่างๆ ดังนี้:

  • การประเมินโดยรัฐบาลก่อนเปิดตัว: ให้หน่วยงานภาครัฐเข้าถึงโมเดลล่วงหน้าเพื่อทดสอบความปลอดภัย
  • การแบ่งปันข้อมูลอย่างรวดเร็ว: แจ้งเตือนรัฐบาลทันทีเมื่อพบการเจลเบรคหรือภัยคุกคามใหม่
  • การวิจัยร่วมกัน: จัดสรรทรัพยากรประมวลผลและทีมงานเฉพาะเพื่อสนับสนุนงานวิจัยความปลอดภัยของภาครัฐ
  • มาตรฐานอุตสาหกรรม: ผลักดันการสร้างมาตรฐานความปลอดภัยที่ใช้ร่วมกันทั้งวงการ

เราขอขอบคุณผู้ใช้ที่อดทนรอในช่วงเวลาที่ผ่านมา และเชื่อมั่นว่าความร่วมมือนี้จะเป็นรากฐานสำคัญของกฎเกณฑ์ AI ระดับสากลที่มีประสิทธิภาพในอนาคต

เนื้อหาที่เกี่ยวข้อง

การพัฒนามาตรการป้องกันระดับองค์กรกับลูกค้าของเรา

อ่านเพิ่มเติม

การปรับปรุงความพยายามในการจัดตำแหน่งและความปลอดภัยของเรา

เมื่อวันที่ 30 กรกฎาคม เราได้รายงานเหตุการณ์ที่โมเดล Claude เข้าถึงระบบคอมพิวเตอร์โดยไม่ได้รับอนุญาต และกำลังดำเนินการวิเคราะห์ร่วมกับ METR เพื่อความโปร่งใส

อ่านเพิ่มเติม

ดูตัวอย่างมาตรฐานฮาร์ดแวร์ของโมเดล

เปิดให้ดูรายละเอียด Model Hardware Standard (MHS) เพื่อการใช้งานเอเจนต์ AI ร่วมกับอุปกรณ์ทางกายภาพอย่างปลอดภัย

อ่านเพิ่มเติม

Source: Anthropic News
ดูแลงานแปลและเรียบเรียงโดย SirilukP

ความคิดเห็น (0)

เข้าสู่ระบบเพื่อร่วมแสดงความเห็น

สมัครสมาชิก

มาเป็นคนแรกที่แสดงความเห็นกันเลยโบร