NVIDIA Blackwell เร่งสปีด GPT-6 Astra Ultrafast แรงขึ้น 8 เท่า

GPT-6 Astra Ultrafast ซึ่งทำงานบน NVIDIA Blackwell GPUs พร้อมเปิดให้ใช้งานแล้วผ่าน OpenAI API สำหรับผู้ใช้ ChatGPT Work และ Codex ที่ได้รับสิทธิ์
ด้วยการปรับแต่งกระบวนการ Inference ของโมเดล OpenAI ให้ดึงประสิทธิภาพสูงสุดจากสถาปัตยกรรม NVIDIA Blackwell ทำให้โหมด Ultrafast สามารถสร้าง Token ได้รวดเร็วขึ้นสูงสุดถึง 8 เท่าเมื่อเทียบกับโหมด Astra Standard สำหรับนักพัฒนาแล้ว ความเร็วที่เพิ่มขึ้นนี้จะช่วยย่นระยะเวลาในวงจร edit-test-debug ของ AI Agent ลดความล่าช้าในการเรียกใช้เครื่องมือ (tool calls) และยกระดับการตอบสนองของแอปพลิเคชันให้ทันใจยิ่งขึ้น
การตอบสนองที่รวดเร็วถือเป็นหัวใจสำคัญในขั้นตอนการทำงานที่ต้องทำซ้ำบ่อยครั้ง เช่น เมื่อ Agent เขียนโค้ด เรียกใช้เครื่องมือ ตรวจสอบผลลัพธ์ และตัดสินใจในขั้นตอนถัดไป โดย Ultrafast จะเข้ามาช่วยเสริมความสามารถของ Astra ในลูปการทำงานที่ต้องการความเร็วสูง ซึ่งโครงสร้างพื้นฐาน AI ของ NVIDIA ช่วยให้ OpenAI สามารถส่งมอบผลลัพธ์ที่มีประสิทธิภาพได้ตรงตามความต้องการของนักพัฒนา
Philippe Tillet หัวหน้าฝ่าย Inference ของ OpenAI ระบุว่า การที่ NVIDIA ลงทุนอย่างหนักในด้านเครื่องมือและเอกสารประกอบ ช่วยให้ทีมงานสามารถปรับแต่งโมเดลให้เชี่ยวชาญการเขียนโปรแกรมสำหรับ GPU สถาปัตยกรรม Blackwell และ Rubin ได้เป็นพิเศษ ซึ่ง Astra ได้เปลี่ยนความรู้นั้นให้กลายเป็น high-performance kernels ที่ดึงจุดเด่นของฮาร์ดแวร์ NVIDIA ออกมาได้ครบทุกมิติ ทั้งเรื่องความหน่วง (latency) ปริมาณงาน (throughput) และต้นทุน
การปรับปรุงประสิทธิภาพอย่างต่อเนื่อง
การพัฒนาประสิทธิภาพไม่ได้สิ้นสุดลงเพียงแค่ช่วงนำโมเดลไปใช้งานจริง แต่ OpenAI ยังใช้โมเดลของตนเองช่วยปรับแต่งซอฟต์แวร์ Inference ที่รันบน NVIDIA GPU โดยอาศัยความสามารถในการเขียนโปรแกรม (programmability) ของแพลตฟอร์มเพื่อทดสอบและอัปเดตการทำงานอย่างต่อเนื่อง ซึ่งจะช่วยให้โมเดลตอบสนองได้เร็วขึ้นและใช้โครงสร้างพื้นฐานได้อย่างคุ้มค่าในระยะยาว
Uday Ruddarraju ประธานเจ้าหน้าที่ฝ่ายเทคโนโลยีด้านการประมวลผลของ OpenAI กล่าวเสริมว่า ความร่วมมือกับ NVIDIA ช่วยให้ AI เร็วขึ้นและมีประโยชน์มากขึ้น โดยทีมงานได้ใช้โมเดลภายในเพื่อปรับแต่งการ Inference บน GPU ของ NVIDIA ซึ่งความยืดหยุ่นของแพลตฟอร์มเป็นกุญแจสำคัญที่ทำให้สามารถส่งมอบความเร็วระดับ Astra Ultrafast ได้สำเร็จ
นอกจากนี้ แพลตฟอร์มของ NVIDIA ที่ปรับแต่งได้หลากหลายยังช่วยให้นักวิจัยและนักพัฒนาสามารถใช้โครงสร้างพื้นฐานเดิมซ้ำได้ ทั้งในขั้นตอนการฝึกฝน (training), การอนุมาน (inference) และการเรียนรู้แบบเสริมกำลัง (reinforcement learning) ความยืดหยุ่นนี้ช่วยให้ทีมงานปรับเปลี่ยนทรัพยากรการประมวลผลตามความต้องการที่เปลี่ยนไปของโมเดล ช่วยเพิ่มประสิทธิภาพการใช้งานและลดการสำรองทรัพยากรเกินความจำเป็น (overprovision)
นักพัฒนาสามารถเริ่มใช้งาน GPT-6 Astra Ultrafast ผ่าน API ได้ตั้งแต่วันนี้ โดยสามารถตรวจสอบรายละเอียดการเข้าถึง ราคา และวิธีการปรับใช้งานเพิ่มเติมได้ที่ Ultrafast guide
ความคิดเห็น (0)
เข้าสู่ระบบเพื่อร่วมแสดงความเห็น
สมัครสมาชิกมาเป็นคนแรกที่แสดงความเห็นกันเลยโบร
