NVIDIA และ CoreWeave ผสานวงจร Agentic AI ครบวงจรบนคลาวด์

· By: SirilukP

NVIDIA และ CoreWeave ผสานวงจร Agentic AI ครบวงจรบนคลาวด์

ด้วยความร่วมมือที่ยาวนานเกือบหนึ่งทศวรรษ CoreWeave ได้ผสานรวมระบบประมวลผล เครือข่าย และซอฟต์แวร์ของ NVIDIA เข้ากับระบบคลาวด์ที่สร้างขึ้นเพื่อ AI โดยเฉพาะ ซึ่งให้ผลตอบแทนจากการลงทุนที่คุ้มค่าข้ามยุคสมัย ล่าสุด CoreWeave กำลังนำโครงสร้างพื้นฐานรุ่นถัดไปของ NVIDIA มาสู่การใช้งานจริงเพื่อตอบโจทย์อุตสาหกรรม

ในงาน CoreWeave Fully Connected ณ ซานฟรานซิสโก CoreWeave ได้ประกาศความพร้อมในการให้บริการระบบ NVIDIA Vera Rubin NVL72 พร้อมเครือข่ายอีเธอร์เน็ต Spectrum-X 102.4T โดยมี Cognition แล็บ AI ผู้อยู่เบื้องหลัง Devin วิศวกรซอฟต์แวร์ AI เป็นลูกค้ารายแรกที่รันเวิร์กโหลดการผลิตบนระบบนี้

นอกจากนี้ CoreWeave ยังเตรียมให้บริการ NVIDIA Vera ซึ่งเป็น CPU ตัวแรกที่ออกแบบมาสำหรับ AI agents โดยเฉพาะ พร้อมเปิดตัว CoreWeave Forge สภาพแวดล้อมการทำงานแบบครบวงจรสำหรับการฝึกฝน (training) ประเมินผล (evaluating) และปรับปรุงโมเดลบนระบบประมวลผลประสิทธิภาพสูงของ NVIDIA

Ian Buck รองประธานฝ่ายไฮเปอร์สเกลและระบบประมวลผลประสิทธิภาพสูงของ NVIDIA ระบุว่าระบบประมวลผลเร่งความเร็วของ NVIDIA ส่งมอบคุณค่าได้อย่างต่อเนื่องยาวนาน แม้แต่ GPU รุ่น V100 ก็ยังคงใช้งานได้ดีในปัจจุบัน ขณะที่การนำ Vera Rubin NVL72 มาใช้จะช่วยสร้างรายได้ต่อเนื่องหลายปีด้วยความยืดหยุ่นที่ตอบโจทย์เวิร์กโหลดทุกรูปแบบ

Cognition รันบน Vera Rubin NVL72 พร้อมประสิทธิภาพที่สูงขึ้น 4.8 เท่า

Cognition ได้ขยายขนาดการใช้งาน GPU บน CoreWeave สู่ระดับหลายพันตัวภายใน 9 เดือน เพื่อรองรับการฝึกฝนและทำ inference สำหรับ Devin โดยจากการทดสอบประสิทธิภาพ Vera Rubin NVL72 พบว่าให้ token throughput รวมเพิ่มขึ้นถึง 4.8 เท่าสำหรับเวิร์กโหลด inference แบบ SWE-2 เมื่อเทียบกับรุ่นเดิม ซึ่งช่วยให้ Devin สร้างโค้ดและตอบสนองการใช้เหตุผลได้รวดเร็วขึ้นอย่างมาก

Silas Alberti จากทีมผู้ก่อตั้ง Cognition กล่าวว่าการเขียนโค้ดแบบ Agentic มีความซับซ้อนสูง ทั้งเรื่องบริบทที่ยาวและความต้องการความพร้อมกันของข้อมูล การมีแพลตฟอร์มที่รวมทุกอย่างไว้ด้วยกันพร้อมการสนับสนุนจากวิศวกรของ NVIDIA และ CoreWeave จึงเป็นปัจจัยสำคัญที่ช่วยแก้ปัญหาที่ยากที่สุดในการพัฒนาได้

CoreWeave ประกาศความพร้อมของ NVIDIA Vera Rubin บน CoreWeave Cloud

CoreWeave เป็นหนึ่งในผู้ให้บริการคลาวด์รายแรกที่ส่งมอบแพลตฟอร์ม NVIDIA Vera Rubin NVL72 ถึงมือลูกค้า โดยกลุ่ม Early-access สามารถเข้าใช้งานโรงงาน AI แบบ full-stack ได้ทันทีผ่านบริการต่างๆ เช่น CoreWeave Kubernetes Service, SUNK, และ CoreWeave Inference ซึ่งเป็นผลจากการออกแบบระบบร่วมกันตั้งแต่อครงสร้างพื้นฐานไปจนถึงการให้บริการโทเค็น

NVIDIA Vera CPU เสริมพลัง Agentic Sandbox เร็วขึ้น 3 เท่า

Agentic AI ต้องการการประมวลผลความหน่วงต่ำและการแยกสภาพแวดล้อม (sandbox) จำนวนมากพร้อมกัน NVIDIA Vera CPU จึงถูกสร้างมาเพื่อรองรับงานนี้โดยเฉพาะ โดยในหนึ่งแร็คสามารถบรรจุ CPU 128 ตัวและคอร์กว่า 11,264 คอร์ รองรับสภาพแวดล้อมเอเจนต์ที่แยกจากกันได้มากกว่า 11,000 รายการ

ในการทดสอบจริง CoreWeave ประสบความสำเร็จในการเริ่มทำงานของ agent sandbox ได้เร็วขึ้นกว่า 3 เท่าบน NVIDIA Vera CPU ซึ่งช่วยเร่งกระบวนการ reinforcement learning (RL) และการประเมินโมเดลให้มีประสิทธิภาพสูงขึ้น โดยพบว่าใน Terminal-Bench มีประสิทธิภาพเพิ่มขึ้น 1.7 เท่าในทุกงานที่ทดสอบ

CoreWeave Forge: เชื่อมโยงวงจรการพัฒนา AI อย่างสมบูรณ์

CoreWeave Forge ถูกออกแบบมาเพื่อปิดช่องว่างในวงจรพัฒนาโมเดล โดยรวบรวมเครื่องมืออย่าง Weights & Biases, OpenPipe และ marimo notebook เข้าไว้ในระบบเดียว ช่วยให้การพัฒนา AI agents เป็นไปอย่างต่อเนื่องโดยไม่สูญเสียข้อมูลระหว่างขั้นตอน

ความสามารถเด่นของ Forge ได้แก่:

  • CoreWeave ARIA: เครื่องมือช่วยวิเคราะห์การทดลองและเสนอแนะการแก้ไขโค้ดอัตโนมัติ
  • CoreWeave Agent Lens: บริการตรวจสอบ AI agents ในการผลิตที่ช่วยปรับปรุงการตรวจจับความล้มเหลวได้ 20% โดยลดต้นทุนลงครึ่งหนึ่ง
  • CoreWeave Sandboxes: สภาพแวดล้อมแบบ serverless สำหรับรันเอเจนต์และ RL ที่แยกส่วนทางฮาร์ดแวร์เพื่อความปลอดภัย
  • Post-training: เพิ่มคุณภาพโมเดลด้วยข้อมูลจริง โดย Serverless supervised fine-tuning และ serverless RL ช่วยให้ฝึกฝนเร็วขึ้น 1.4 เท่าที่ต้นทุนต่ำลง 40%

นอกจากนี้ CoreWeave ยังใช้ NVIDIA Dynamo เฟรมเวิร์กโอเพนซอร์สเพื่อขับเคลื่อน managed inference และรองรับการใช้โมเดล NVIDIA Nemotron เพื่อปรับแต่งโมเดลการใช้เหตุผลสำหรับเวิร์กโหลดแบบ agentic โดยมีบริษัทชั้นนำอย่าง Canva และ Capital One เริ่มใช้งานแล้ว

พลิกโฉมอุตสาหกรรมตั้งแต่สตาร์ทอัพถึงองค์กรระดับโลก

แพลตฟอร์มความร่วมมือนี้กำลังช่วยให้องค์กรต่างๆ ขับเคลื่อนนวัตกรรมได้เร็วขึ้น เช่น Ennoble Care ที่ใช้ GPU NVIDIA RTX PRO 6000 บน CoreWeave เพื่อรัน AI agents สำหรับจัดการเอกสารทางการแพทย์และการตัดสินใจทางคลินิกสำหรับผู้ป่วยกว่า 50,000 ราย

ปัจจุบัน CoreWeave ยังคงรักษาตำแหน่งผู้นำในผลการทดสอบ MLPerf และครองอันดับสูงสุดใน ClusterMAX ของ SemiAnalysis ตอกย้ำความเป็นผู้ให้บริการคลาวด์ที่ได้รับความไว้วางใจจากแล็บ AI ชั้นนำระดับโลก เพื่อเปลี่ยนระบบทดลองให้กลายเป็นนวัตกรรมที่ใช้งานได้จริงในโลกปัจจุบัน

Source: NVIDIA Blog
ดูแลงานแปลและเรียบเรียงโดย SirilukP

ความคิดเห็น (0)

เข้าสู่ระบบเพื่อร่วมแสดงความเห็น

สมัครสมาชิก

มาเป็นคนแรกที่แสดงความเห็นกันเลยโบร