IBM เปิดตัว Granite 4.2: โมเดล Open Reasoning ทรงพลังด้วยระบบ Agentic RL และการสั่งงาน Terminal

IBM ประกาศเปิดตัว Granite 4.2 กลุ่มโมเดลภาษาแบบ Open Reasoning ในขนาดพารามิเตอร์ 3B, 8B และ 30B ซึ่งแตกต่างจากตระกูล Granite รุ่นก่อนหน้าที่เป็นเพียงผู้ช่วยทำตามคำสั่ง โดยรุ่นใหม่นี้ถูกสร้างขึ้นบนพื้นฐานของการใช้เหตุผลอย่างชัดเจน (Explicit Reasoning) ช่วยให้โมเดลสามารถสร้างลำดับความคิด (Chain of Thought) ก่อนตอบคำถามได้
จุดเด่นสำคัญของ Granite 4.2 คือการมาพร้อมสวิตช์เลือกโหมดการทำงานระหว่าง thinking, non-thinking และโหมด low-effort สำหรับคำถามที่ไม่ซับซ้อน ตัวโมเดลเป็นประเภท Decoder-only Dense Transformers ที่ผ่านการ Pre-trained ใหม่ตั้งแต่ต้นด้วยข้อมูลกว่า 15 ล้านล้านโทเคน และปรับแต่งต่อด้วยกระบวนการ Reinforcement Learning (RL) หลายขั้นตอน
สำหรับรุ่น 8B และ 30B จะได้รับประสิทธิภาพที่เหนือกว่าด้วย Agentic RL block ซึ่งฝึกฝนให้โมเดลสามารถแก้ไขโค้ด ควบคุม Terminal และค้นหาข้อมูลบนเว็บภายในสภาพแวดล้อม Sandboxed จริง ทั้งสามรุ่นเปิดให้ใช้งานได้ฟรีภายใต้ลิขสิทธิ์ Apache 2.0 นอกจากนี้ IBM ยังได้เปิดตัวโมเดล Granite Speech 5.0 Turbo CTC ขนาด 470 ล้านพารามิเตอร์เพื่อการประมวลผลเสียงที่รวดเร็วควบคู่กันด้วย
สามารถนำไปใช้งานได้จริงหรือไม่?
โมเดล Granite 4.2 ทั้งสามรุ่นเปิดกว้างให้นักพัฒนาดาวน์โหลด ทำ Fine-tuning และใช้งานในเชิงพาณิชย์ได้โดยไม่มีข้อจำกัดด้านลิขสิทธิ์ผ่านสัญญาอนุญาตแบบ Apache 2.0
ในด้านการใช้งาน รุ่น 3B เหมาะสำหรับนักพัฒนาทั่วไปที่รันบนแล็ปท็อปผ่าน Ollama หรือ LM Studio ในขณะที่รุ่น 8B ออกแบบมาสำหรับธุรกิจขนาดกลางที่ใช้ GPU เพียงตัวเดียว ส่วนรุ่น 30B มุ่งเน้นการใช้งานในระดับองค์กรที่ต้องการพลังประมวลผลสูงอย่าง A100 หรือ H100 บนระบบ vLLM โดยเฉพาะในอุตสาหกรรมที่เข้มงวดด้านความปลอดภัย เช่น การเงิน สาธารณสุข และหน่วยงานรัฐ
สถาปัตยกรรม (Architecture)
Granite 4.2 ใช้โครงสร้างแบบ Decoder-only dense transformer โดยมีส่วนประกอบหลักอย่าง Grouped Query Attention พร้อม 8 KV heads, SwiGLU MLPs และรองรับความยาวบริบท (Sequence Length) พื้นฐานที่ 128K โทเคน แม้ว่าในขั้นตอน Pre-training จะมีการทดสอบขยายไปได้สูงสุดถึง 512K โทเคนก็ตาม
รายละเอียดเชิงลึกของแต่ละรุ่นประกอบด้วย รุ่น 3B มี 40 เลเยอร์ (Embedding size 2560), รุ่น 8B มี 40 เลเยอร์ (Embedding size 4096) และรุ่นใหญ่ที่สุด 30B ขยับขึ้นไปที่ 64 เลเยอร์ พร้อมขนาด MLP hidden size ที่ 32,768 โดยมีการใช้ชุดข้อมูลรหัสโค้ดสังเคราะห์กว่า 1 ล้านล้านโทเคนจากระบบ CodeAlchemy ของ IBM เข้ามาร่วมฝึกฝนด้วย
กระบวนการฝึกฝน (Training Pipeline) คือหัวใจสำคัญ
IBM ใช้ข้อมูลในขั้นตอน Supervised Fine-tuning ถึง 7.2 ล้านตัวอย่าง โดยมีสัดส่วนของข้อมูลด้าน Agentic สูงถึง 31.6% ซึ่งเน้นไปที่งานวิศวกรรมซอฟต์แวร์และการใช้เครื่องมือต่างๆ เช่น OpenHands และ SWE-agent เพื่อสร้างเส้นทางการเรียนรู้ที่ซับซ้อน
นอกจากนี้ ขั้นตอน Post-training ยังใช้เทคนิค GRPO แบบอะซิงโครนัสเพื่อปรับปรุงทักษะเฉพาะด้านตามลำดับ ตั้งแต่การแก้ปัญหาทั่วไปไปจนถึงการใช้งาน Terminal และการค้นหาข้อมูล การตัดสินใจแยก Agentic RL block ให้มีเฉพาะในรุ่น 8B และ 30B ทำให้โมเดลทั้งสองขนาดมีความสามารถในการปฏิบัติงานจริงที่โดดเด่นกว่ารุ่นเล็กอย่างเห็นได้ชัด
ผลการทดสอบที่รายงาน
ตัวเลขผลการทดสอบของ IBM แบ่งตามขนาดโมเดล (3B / 8B / 30B):
| Benchmark | 3B | 8B | 30B |
|---|---|---|---|
| SWE-Bench Verified | NA | 47.67 | 57.00 |
| Terminal-Bench 2.1 | NA | 20.56 | 29.24 |
| τ³-bench | 50.99 | 66.34 | 68.05 |
| BFCL (v4) | 52.41 | 50.29 | 61.39 |
| AIME25 | 78.33 | 86.67 | 89.17 |
| GPQA | 54.80 | 64.14 | 66.41 |
| MMLU-Pro | 67.84 | 74.04 | 77.60 |
| RULER 128K | 55.30 | 71.41 | 81.38 |
Speech: 470 ล้านพารามิเตอร์ โดยไม่มีโครงสร้างหลักจาก LLM
ในส่วนของโมเดลด้านเสียง IBM ได้นำเสนอ Turbo CTC ขนาด 470 ล้านพารามิเตอร์ ที่ไม่ได้ใช้โครงสร้างของ LLM แบบดั้งเดิม แต่ใช้เทคนิค Connectionist Temporal Classification เพื่อประสิทธิภาพสูงสุด โดยทำความเร็ว RTFx ได้เกือบ 12,600 บนจีพียู H200 ซึ่งเร็วกว่าผู้นำในตลาดปัจจุบันเกือบเท่าตัว ผู้ที่สนใจสามารถทดลองใช้งานผ่าน WebGPU demo ได้ทันที
ประเด็นสำคัญ
- Granite 4.2 เป็นโมเดล Reasoning แบบ Dense ที่เปิดกว้างภายใต้ Apache 2.0
- รองรับสวิตช์สลับโหมด Thinking ได้ในตัวเพื่อความยืดหยุ่นในการใช้งาน
- เฉพาะรุ่น 8B และ 30B เท่านั้นที่ได้รับการฝึกฝนด้าน Agentic RL (การแก้โค้ด, ใช้ Terminal, ค้นหาเว็บ)
- รุ่น 30B ทำคะแนน SWE-Bench Verified ได้สูงถึง 57.00 สะท้อนความสามารถในการแก้ปัญหาซอฟต์แวร์ระดับสูง
- Granite Speech 5.0 มอบความเร็วในการประมวลผลเสียงระดับแถวหน้าของวงการ
ความคิดเห็น (0)
เข้าสู่ระบบเพื่อร่วมแสดงความเห็น
สมัครสมาชิกมาเป็นคนแรกที่แสดงความเห็นกันเลยโบร
