StepFun เปิดตัว Step 5 Preview โมเดล MoE 600B เน้นงาน Agentic

· By: AttapolK

StepFun เปิดตัว Step 5 Preview โมเดล MoE 600B เน้นงาน Agentic

StepFun เปิดตัว Step 5 Preview โมเดลเรือธงรุ่นล่าสุดที่ออกแบบมาเพื่อรองรับงาน Agentic ระยะยาวโดยเฉพาะ โดยเน้นการใช้งานในด้านวิศวกรรมซอฟต์แวร์ งานวิเคราะห์ข้อมูลเฉพาะทาง และภาคการเงิน จุดเด่นสำคัญอยู่ที่การสร้าง 'Pareto frontier' ใหม่ที่ให้ความฉลาดระดับสูงในราคาที่ต่ำกว่าคู่แข่งอย่างเห็นได้ชัด

ปัจจุบันผู้ที่สนใจสามารถเข้าใช้งานได้ทันทีผ่าน API และบน แพลตฟอร์ม StepFun ส่วนสาย Open Source ที่ต้องการโฮสต์ด้วยตนเอง (Self-hosting) ทาง StepFun มีแผนจะเปิด Open Weights ในวันที่ 15 ตุลาคม 2026 ทั้งนี้ควรเตรียมฮาร์ดแวร์ระดับ multi-GPU ไว้รองรับ เนื่องจากโมเดลขนาด 600B ต้องการพื้นที่จัดเก็บประมาณ 1.2 TB ในรูปแบบ BF16

สิ่งที่ StepFun ส่งมอบ

Step 5 Preview ใช้สถาปัตยกรรม Mixture-of-Experts (MoE) แบบ Sparse ซึ่งมีพารามิเตอร์รวม 600B แต่จะเปิดใช้งานจริง (Activate) เพียง 27B ต่อโทเคน หรือคิดเป็น 4.5% ของน้ำหนักทั้งหมด ทำให้ประมวลผลได้อย่างมีประสิทธิภาพ

คุณสมบัติหลักตามเอกสารทางการประกอบด้วย:

  • Model ID: step-5-preview
  • Context window: 1M tokens
  • Input: ข้อความ, รูปภาพ และวิดีโอ
  • Output: ข้อความ
  • Reasoning effort: ปรับได้ 3 ระดับ low, medium, และ high
  • รองรับ Streaming, tool calling, JSON Mode, JSON Schema และ prompt caching

ในแง่การทำงานจริง ทีมวิจัยระบุว่าโมเดลสามารถจัดการ Agent ให้ดึงข้อมูลจากเว็บได้สูงสุดถึง 950 ครั้งในการทำงานเพียงรอบเดียว นอกจากนี้ยังรองรับ การรวมเข้ากับ Claude Code ผ่านระบบ Step Plan เพื่อยกระดับการเขียนโปรแกรม

สถาปัตยกรรม: แคบและลึก

StepFun เลือกใช้กลยุทธ์วางเลเยอร์ Transformer ซ้อนกันถึง 92 เลเยอร์ในลักษณะ "แคบแต่ลึก" ตามรายงานของ Pandaily เพื่อสร้างเส้นทางการใช้เหตุผลแบบหลายขั้นตอน (multi-hop reasoning) ที่ยาวขึ้น ซึ่งจำเป็นอย่างมากเมื่อ Agent ต้องค้นหาข้อมูล รันโค้ด และวิเคราะห์ผลลัพธ์พร้อมกัน

กระบวนการฝึกฝนใช้ Reinforcement Learning (RL) ระยะยาวแบบ on-policy ร่วมกับเทคนิคขั้นสูงอย่าง MTP-3 speculative decoding และ FP8 MoE ส่งผลให้ความเร็วในงาน RL ระยะยาวเพิ่มขึ้นกว่า 3 เท่าตัวแบบ end-to-end

ผลการทดสอบ (Benchmarks)

ในการทดสอบประสิทธิภาพ Step 5 Preview รันที่ระดับ High effort เปรียบเทียบกับคู่แข่งที่รันระดับ Max โดยมีผลลัพธ์จาก RuntimeWire ดังนี้:

BenchmarkStep 5 PreviewClaude Opus 5GPT-6 Astra
FrontierFinance66.469.755
DRACO83.387.676.8

แม้ในด้านการเขียนโค้ด GPT-6 Astra และ Claude Opus 5 จะยังนำหน้าอยู่เล็กน้อย แต่ Step 5 Preview ก็ทำผลงานได้น่าประทับใจด้วยคะแนน 67.7 บน DeepSWE v1.1 นอกจากนี้ในการทดสอบอิสระโดย Artificial Analysis พบว่าโมเดลได้คะแนน Intelligence Index ที่ 44 ซึ่งสูงกว่าค่ามัธยฐานของกลุ่มโมเดลระดับราคาเดียวกันที่อยู่ที่ 24 โดยมีความเร็วเอาต์พุตถึง 99.8 โทเคนต่อวินาที

การกำหนดราคา

ราคาของ StepFun API ต่อ 1 ล้านโทเคน:

ประเภทโทเคนราคา
Input, cache miss$1.00
Input, cache hit$0.05
Output, รวมการใช้เหตุผล$2.70

เมื่อเทียบกับค่ามัธยฐานของตลาด ($1.88 สำหรับอินพุต และ $10.00 สำหรับเอาต์พุต) ถือว่า Step 5 Preview มีราคาถูกกว่ามาก อย่างไรก็ตาม ผู้ใช้ควรระวังเรื่องการใช้เหตุผลที่ยืดเยื้อ (verbose reasoning) ซึ่งอาจทำให้จำนวนโทเคนที่ใช้จริงเพิ่มสูงขึ้น

ประเด็นสำคัญ

  • สถาปัตยกรรม MoE ขนาดรวม 600B (Active 27B) รองรับ Context 1M โทเคน
  • รองรับอินพุตมัลติโมดอลทั้งข้อความ รูปภาพ และวิดีโอ
  • ราคาประหยัดเพียง $1.00 (Input) และ $2.70 (Output) ต่อล้านโทเคน
  • เตรียมเปิด Open Weights ให้ใช้งานทั่วไป 15 ตุลาคม 2026

คำถามที่พบบ่อย (FAQ)

  • Step 5 Preview คืออะไร? โมเดล MoE รุ่นท็อปจาก StepFun สำหรับงาน Agentic โดยเฉพาะ
  • เป็น Open weight หรือไม่? ปัจจุบันยังไม่ใช่ แต่มีกำหนดเปิดในวันที่ 15 ตุลาคม 2026
  • Context window ใหญ่แค่ไหน? 1 ล้านโทเคน
  • ราคาเท่าไหร่? อินพุต $1.00 และเอาต์พุต $2.70 ต่อ 1 ล้านโทเคน
Source: MarkTechPost
ดูแลงานแปลและเรียบเรียงโดย AttapolK

ความคิดเห็น (0)

เข้าสู่ระบบเพื่อร่วมแสดงความเห็น

สมัครสมาชิก

มาเป็นคนแรกที่แสดงความเห็นกันเลยโบร