Nvidia เปิดตัวสถาปัตยกรรม Groq 3 LPX พร้อมผลทดสอบประสิทธิภาพการประมวลผล AI สูงสุดในตลาด
ในงาน Hot Chips 2026 นาย Igor Arsovski รองประธานฝ่ายฮาร์ดแวร์ของ Nvidia ได้นำเสนอสถาปัตยกรรมตู้แร็คประมวลผล Groq 3 LPX ซึ่งเป็นผลผลิตจากการเข้าซื้อกิจการ Groq มูลค่า 2 หมื่นล้านดอลลาร์เมื่อปลายปี 2025 โดยฮาร์ดแวร์รุ่นนี้ถูกออกแบบมาเพื่อเน้นการทำ Inference โดยเฉพาะ และได้เข้ามาแทนที่ Rubin CPX ในแผนผังผลิตภัณฑ์ของบริษัท
ผลการทดสอบจากหน่วยงานภายนอกอย่าง Artificial Analysis พบว่าชิปตัวใหม่สามารถประมวลผลโมเดล Gemma 4 31B ได้เร็วถึง 3,431 output tokens ต่อวินาที ซึ่งสูงกว่าผู้ให้บริการสาธารณะที่เร็วที่สุดถึง 4 เท่า ในขณะที่การสาธิตของ Nvidia บนเวทีแสดงตัวเลขที่สูงถึง 10,996 tokens ต่อวินาที โดยอาศัยเทคโนโลยีชิป LP30 ที่ใช้หน่วยความจำ SRAM บนตัวชิปแทนการใช้ HBM เพื่อลดความหน่วงในการเข้าถึงข้อมูล
หัวใจสำคัญของสถาปัตยกรรมนี้คือการใช้ท่อส่งข้อมูลแบบ Deterministic ที่มีความแม่นยำสูง ทำให้คอมไพเลอร์สามารถคาดการณ์การใช้พลังงานได้ในระดับรอบสัญญาณนาฬิกา ส่งผลให้ลดความผันผวนของแรงดันไฟฟ้าได้มากกว่า 60% และช่วยบริหารจัดการความร้อนได้ดีขึ้น ซึ่งช่วยเพิ่มประสิทธิภาพการทำงานได้อีกประมาณ 10-11% ภายใต้ขีดจำกัดความร้อนเดิม
Nvidia วางตำแหน่งให้ LPX เป็นตัวประมวลผลร่วม (Co-processor) สำหรับถอดรหัสข้อมูลที่จะทำงานร่วมกับจีพียู Vera Rubin NVL72 โดยให้จีพียูหลักรับหน้าที่ประมวลผลส่วน Prefill ที่เน้นการคำนวณหนัก และให้ LPU จาก Groq รับหน้าที่สร้าง output tokens ซึ่งการทำงานร่วมกันนี้ช่วยเพิ่มประสิทธิภาพโดยรวมได้ 3 ถึง 5 เท่าเมื่อเทียบกับการใช้ Rubin เพียงอย่างเดียว
อย่างไรก็ตาม การเข้าซื้อกิจการครั้งนี้เริ่มถูกตรวจสอบจากวุฒิสมาชิกสหรัฐฯ ที่ตั้งคำถามถึงลักษณะการดีลเพื่อหลีกเลี่ยงกฎหมายผูกขาด ขณะที่คู่แข่งอย่าง Cerebras ก็ได้เปิดตัวระบบ CS4 ที่อ้างว่ามีแบนด์วิดท์หน่วยความจำสูงกว่าชิปยุคถัดไปของ Nvidia ถึง 2,000 เท่า เป็นสัญญาณของการแข่งขันที่ดุเดือดในตลาดฮาร์ดแวร์ AI






























































































ความคิดเห็น (0)
เข้าสู่ระบบเพื่อร่วมแสดงความเห็น
สมัครสมาชิกมาเป็นคนแรกที่แสดงความเห็นกันเลยโบร
