เปิดตัว OrcaCyber Zero 1.5 โมเดลไซเบอร์ Context 1M ชุดใหม่

· By: AttapolK

เปิดตัว OrcaCyber Zero 1.5 โมเดลไซเบอร์ Context 1M ชุดใหม่

OrcaRouter ประกาศเปิดตัว OrcaCyber Zero 1.5 โมเดลสำหรับการวิจัยช่องโหว่ที่ได้รับอนุญาต โดยเป็นรุ่นที่พัฒนาต่อยอดจาก OrcaCyber Zero 1.0 ที่เริ่มใช้งานไปเมื่อวันที่ 17 กันยายน 2026

OrcaCyber Zero 1.5 คือโมเดล Orca ที่ผ่านการทำ post-trained เพื่อรองรับการจำลองช่องโหว่ (vulnerability reproduction) การพัฒนาช่องโหว่ (exploit development) และการทดสอบเจาะระบบ (penetration testing) โดยมาพร้อมกับ Context Window ขนาด 1M-token รองรับ native function calling และ structured outputs เพื่อทีมความปลอดภัย ภายใต้แนวคิดหลักคือ: รายงานน้อยลง แต่พบและแก้ไขช่องโหว่ได้มากขึ้น

TL;DR

  • Size: ไม่เปิดเผยพารามิเตอร์ รองรับ Context 1M-token และ output สูงสุด 128K (รองรับ text in/out)
  • Runs on: ให้บริการผ่าน Hosted API ของ OrcaRouter เท่านั้น ไม่แจกจ่าย weights หรือรุ่น quantized และไม่เปิดเผยฮาร์ดแวร์
  • Performance: คะแนนจากผู้พัฒนาเกือบแตะเพดานสูงสุดในเกณฑ์วัดด้านไซเบอร์และทำผลงานได้ดีในการเขียนโค้ด
  • Best: 100% บน Cybench (39/39 งาน แบบรันเอเจนต์ไม่จำกัด)
  • Worst: 76.5% บน SWE-bench Pro V2 ซึ่งเป็นคะแนนต่ำสุดที่เปิดเผย
  • Bottom line (ดีที่สุด): ประสิทธิภาพไซเบอร์ระดับท็อปในราคาคุ้มค่าเพียง $3.00 / $7.50 ต่อ 1M tokens
  • Bottom line (แย่ที่สุด): ข้อมูลทั้งหมดเป็นการรายงานโดยผู้พัฒนาเอง และ CVE-Bench ใช้เพียง 24 งานที่ประเมินผลได้เท่านั้น

OrcaCyber Zero 1.5 คืออะไร?

OrcaCyber Zero 1.5 คือ โมเดลความปลอดภัยไซเบอร์ระดับแนวหน้าและเป็นรุ่นต่อยอดจาก Zero 1.0 ทีมพัฒนา Orca ระบุว่าโมเดลนี้ผ่านการ post-trained เพื่อเน้นงานวิจัยความปลอดภัยและวิศวกรรมความปลอดภัยที่ได้รับอนุญาตโดยเฉพาะ ครอบคลุมทั้งการตรวจสอบความปลอดภัย และการใช้เหตุผลทางไซเบอร์ (cyber reasoning)

เป้าหมายการออกแบบ 3 ประการ:

  • ค้นหาสิ่งที่ผู้อื่นพลาด: ตรวจจับข้อบกพร่องที่ไม่รู้จัก เช่น RCE, sandbox escapes, auth bypasses, privilege escalation และ attack chains
  • ก้าวไปไกลกว่าการตรวจจับ: วิเคราะห์ผ่านเส้นทางการโจมตี (attack paths) ท้าทายสมมติฐานของตนเอง และจัดลำดับความสำคัญตามความสามารถในการถูกโจมตีที่พิสูจน์ได้จริง
  • สร้างมาเพื่อเอเจนต์อัตโนมัติ: รองรับ Context 1M-token พร้อม native tool calling เพื่อการใช้เหตุผลใน codebase ขนาดใหญ่

ประสิทธิภาพบน Benchmark

ข้อมูลผลลัพธ์ 4 รายการที่รายงานโดยผู้พัฒนา เมื่อวันที่ 10 ตุลาคม 2026 มีดังนี้:

  • Cybench: 100% (39/39 งาน แบบรันเอเจนต์ไม่จำกัด)
  • CVE-Bench: 95.8% (23/24 งานที่ประเมินผลได้)
  • HumanEval+: 93.9%
  • SWE-bench Pro V2: 76.5%

เกณฑ์วัด Cybench ประกอบด้วยงาน CTF ระดับมืออาชีพ 40 งาน ซึ่งโมเดลทำได้ครบ 39 งานที่ประเมินได้ ส่วน CVE-Bench สร้างจาก CVE ความรุนแรงระดับวิกฤต 40 รายการ โดยคะแนน 95.8% มาจากชุดข้อมูลย่อย 24 งานที่สามารถประเมินผลได้เท่านั้น

เปรียบเทียบกับโมเดลไซเบอร์คู่แข่ง

คุณสมบัติOrcaCyber Zero 1.5OrcaCyber Zero 1.0Claude Mythos PreviewGPT-5.5-CyberSakana Fugu-Cyber
ผู้พัฒนาOrca (OrcaRouter)Orca (OrcaRouter)AnthropicOpenAISakana AI
วันเปิดตัว10 ต.ค. 202617 ก.ย. 20267 เม.ย. 202622 มิ.ย. 202621 ก.ค. 2026
ประเภทPost-trained modelPost-trained codingFrontier modelCyber-tuned GPT-5.5Multi-agent
Context1M1Mไม่เปิดเผยไม่เปิดเผยไม่เปิดเผย
ราคา (in / out)$3.00 / $7.50$3.00 / $7.50$25 / $125ไม่เปิดเผยไม่เปิดเผย
การเข้าถึงSecurity ResearchClosed betaGlasswing Partnersผู้ป้องกันที่คัดกรองตรวจสอบการสมัคร

หมายเหตุ: ตัวเลขทั้งหมดมาจากประกาศของผู้พัฒนาแต่ละราย ไม่ใช่การทดสอบจากบุคคลที่สาม

การเข้าถึงสำหรับนักพัฒนา

โมเดลนี้ใช้งานผ่าน API ที่รองรับมาตรฐาน OpenAI โดยนักพัฒนาสามารถตั้งค่า base_url เป็น https://api.orcarouter.ai/v1 และเรียกใช้งานผ่านชื่อโมเดล orca/orcacyber-zero-1.5 ได้ทันที

อย่างไรก็ตาม การเข้าถึงจะถูกจำกัดเฉพาะระดับ Security Research ซึ่งต้องมีใบอนุญาต (engagement), passkey และยอมรับเงื่อนไขการใช้งาน โดยมุ่งเน้นที่นักวิจัยความปลอดภัยที่น่าเชื่อถือ, red teams และการทดสอบระบบที่ได้รับอนุญาตเท่านั้น

ราคาค่าบริการอยู่ที่ $3.00 ต่อ 1M input tokens และ $7.50 ต่อ 1M output tokens โดยมีการคิดค่าอ่าน Cache ที่ $0.75 ต่อ 1M tokens ด้านความเร็วพบว่าค่า p50 time-to-first-token อยู่ที่ 500 ms แม้กลุ่มตัวอย่างจะยังมีขนาดเล็กเพียง 1.3K tokens ก็ตาม

ประเด็นสำคัญ

  • OrcaCyber Zero 1.5 เป็นโมเดลเฉพาะทางด้านความปลอดภัยที่มี Context สูงถึง 1M บนแพลตฟอร์ม OrcaRouter
  • ทำคะแนนได้ยอดเยี่ยม 100% บน Cybench และ 95.8% บน CVE-Bench (ชุดข้อมูลย่อย 24 งาน)
  • ราคาประหยัดกว่าคู่แข่งอย่าง Mythos Preview อย่างเห็นได้ชัด
  • ปัจจุบันยังไม่มีรายงานทางเทคนิคฉบับเต็มเผยแพร่ออกมา ข้อมูลทั้งหมดจึงอ้างอิงจากสิ่งที่ผู้พัฒนาประกาศเท่านั้น
Source: MarkTechPost
ดูแลงานแปลและเรียบเรียงโดย AttapolK

ความคิดเห็น (0)

เข้าสู่ระบบเพื่อร่วมแสดงความเห็น

สมัครสมาชิก

มาเป็นคนแรกที่แสดงความเห็นกันเลยโบร