StepFun เปิดตัว Step 5 Preview โมเดล MoE 600B เน้นงาน Agentic

StepFun เปิดตัว Step 5 Preview โมเดลเรือธงรุ่นล่าสุดที่ออกแบบมาเพื่อรองรับงาน Agentic ระยะยาวโดยเฉพาะ โดยเน้นการใช้งานในด้านวิศวกรรมซอฟต์แวร์ งานวิเคราะห์ข้อมูลเฉพาะทาง และภาคการเงิน จุดเด่นสำคัญอยู่ที่การสร้าง 'Pareto frontier' ใหม่ที่ให้ความฉลาดระดับสูงในราคาที่ต่ำกว่าคู่แข่งอย่างเห็นได้ชัด
ปัจจุบันผู้ที่สนใจสามารถเข้าใช้งานได้ทันทีผ่าน API และบน แพลตฟอร์ม StepFun ส่วนสาย Open Source ที่ต้องการโฮสต์ด้วยตนเอง (Self-hosting) ทาง StepFun มีแผนจะเปิด Open Weights ในวันที่ 15 ตุลาคม 2026 ทั้งนี้ควรเตรียมฮาร์ดแวร์ระดับ multi-GPU ไว้รองรับ เนื่องจากโมเดลขนาด 600B ต้องการพื้นที่จัดเก็บประมาณ 1.2 TB ในรูปแบบ BF16
สิ่งที่ StepFun ส่งมอบ
Step 5 Preview ใช้สถาปัตยกรรม Mixture-of-Experts (MoE) แบบ Sparse ซึ่งมีพารามิเตอร์รวม 600B แต่จะเปิดใช้งานจริง (Activate) เพียง 27B ต่อโทเคน หรือคิดเป็น 4.5% ของน้ำหนักทั้งหมด ทำให้ประมวลผลได้อย่างมีประสิทธิภาพ
คุณสมบัติหลักตามเอกสารทางการประกอบด้วย:
- Model ID:
step-5-preview - Context window: 1M tokens
- Input: ข้อความ, รูปภาพ และวิดีโอ
- Output: ข้อความ
- Reasoning effort: ปรับได้ 3 ระดับ
low,medium, และhigh - รองรับ Streaming, tool calling, JSON Mode, JSON Schema และ prompt caching
ในแง่การทำงานจริง ทีมวิจัยระบุว่าโมเดลสามารถจัดการ Agent ให้ดึงข้อมูลจากเว็บได้สูงสุดถึง 950 ครั้งในการทำงานเพียงรอบเดียว นอกจากนี้ยังรองรับ การรวมเข้ากับ Claude Code ผ่านระบบ Step Plan เพื่อยกระดับการเขียนโปรแกรม
สถาปัตยกรรม: แคบและลึก
StepFun เลือกใช้กลยุทธ์วางเลเยอร์ Transformer ซ้อนกันถึง 92 เลเยอร์ในลักษณะ "แคบแต่ลึก" ตามรายงานของ Pandaily เพื่อสร้างเส้นทางการใช้เหตุผลแบบหลายขั้นตอน (multi-hop reasoning) ที่ยาวขึ้น ซึ่งจำเป็นอย่างมากเมื่อ Agent ต้องค้นหาข้อมูล รันโค้ด และวิเคราะห์ผลลัพธ์พร้อมกัน
กระบวนการฝึกฝนใช้ Reinforcement Learning (RL) ระยะยาวแบบ on-policy ร่วมกับเทคนิคขั้นสูงอย่าง MTP-3 speculative decoding และ FP8 MoE ส่งผลให้ความเร็วในงาน RL ระยะยาวเพิ่มขึ้นกว่า 3 เท่าตัวแบบ end-to-end
ผลการทดสอบ (Benchmarks)
ในการทดสอบประสิทธิภาพ Step 5 Preview รันที่ระดับ High effort เปรียบเทียบกับคู่แข่งที่รันระดับ Max โดยมีผลลัพธ์จาก RuntimeWire ดังนี้:
| Benchmark | Step 5 Preview | Claude Opus 5 | GPT-6 Astra |
|---|---|---|---|
| FrontierFinance | 66.4 | 69.7 | 55 |
| DRACO | 83.3 | 87.6 | 76.8 |
แม้ในด้านการเขียนโค้ด GPT-6 Astra และ Claude Opus 5 จะยังนำหน้าอยู่เล็กน้อย แต่ Step 5 Preview ก็ทำผลงานได้น่าประทับใจด้วยคะแนน 67.7 บน DeepSWE v1.1 นอกจากนี้ในการทดสอบอิสระโดย Artificial Analysis พบว่าโมเดลได้คะแนน Intelligence Index ที่ 44 ซึ่งสูงกว่าค่ามัธยฐานของกลุ่มโมเดลระดับราคาเดียวกันที่อยู่ที่ 24 โดยมีความเร็วเอาต์พุตถึง 99.8 โทเคนต่อวินาที
การกำหนดราคา
ราคาของ StepFun API ต่อ 1 ล้านโทเคน:
| ประเภทโทเคน | ราคา |
|---|---|
| Input, cache miss | $1.00 |
| Input, cache hit | $0.05 |
| Output, รวมการใช้เหตุผล | $2.70 |
เมื่อเทียบกับค่ามัธยฐานของตลาด ($1.88 สำหรับอินพุต และ $10.00 สำหรับเอาต์พุต) ถือว่า Step 5 Preview มีราคาถูกกว่ามาก อย่างไรก็ตาม ผู้ใช้ควรระวังเรื่องการใช้เหตุผลที่ยืดเยื้อ (verbose reasoning) ซึ่งอาจทำให้จำนวนโทเคนที่ใช้จริงเพิ่มสูงขึ้น
ประเด็นสำคัญ
- สถาปัตยกรรม MoE ขนาดรวม 600B (Active 27B) รองรับ Context 1M โทเคน
- รองรับอินพุตมัลติโมดอลทั้งข้อความ รูปภาพ และวิดีโอ
- ราคาประหยัดเพียง $1.00 (Input) และ $2.70 (Output) ต่อล้านโทเคน
- เตรียมเปิด Open Weights ให้ใช้งานทั่วไป 15 ตุลาคม 2026
คำถามที่พบบ่อย (FAQ)
- Step 5 Preview คืออะไร? โมเดล MoE รุ่นท็อปจาก StepFun สำหรับงาน Agentic โดยเฉพาะ
- เป็น Open weight หรือไม่? ปัจจุบันยังไม่ใช่ แต่มีกำหนดเปิดในวันที่ 15 ตุลาคม 2026
- Context window ใหญ่แค่ไหน? 1 ล้านโทเคน
- ราคาเท่าไหร่? อินพุต $1.00 และเอาต์พุต $2.70 ต่อ 1 ล้านโทเคน
ความคิดเห็น (0)
เข้าสู่ระบบเพื่อร่วมแสดงความเห็น
สมัครสมาชิกมาเป็นคนแรกที่แสดงความเห็นกันเลยโบร
