เปิดตัว Gemini 3.8 Flash และ 3.8 Flash Cyber ยกระดับการใช้เหตุผลและการเขียนโค้ดที่รวดเร็วกว่าเดิม

ต่อยอดความสำเร็จจาก 3.7 Flash ที่เพิ่งเปิดตัวไปเพียงสามสัปดาห์ก่อน วันนี้เราภูมิใจนำเสนอ Gemini 3.8 ซึ่งนับเป็นการเปิดตัวโมเดลตระกูล Flash ครั้งที่สามในรอบหกสัปดาห์ โดยถือเป็นโมเดลที่มีความโดดเด่นด้านการใช้เหตุผล (Reasoning) และการเขียนโค้ด (Coding) ดีที่สุดในปัจจุบัน ขณะที่ยังคงรักษาจุดเด่นเรื่องความเร็วและราคาที่ประหยัดเท่ากับรุ่น 3.7
Gemini 3.8 เปิดตัวพร้อมกัน 2 รุ่นย่อย ได้แก่ Gemini 3.8 Flash ซึ่งเป็นโมเดลหลักที่มีความฉลาดสูงสุด โดยได้รับการปรับปรุงประสิทธิภาพอย่างก้าวกระโดดจากรุ่น 3.7 Flash ทั้งในด้านวิศวกรรมซอฟต์แวร์ งานในรูปแบบ Agent และการใช้เหตุผลหลายขั้นตอนที่ซับซ้อน โดยเปิดตัวด้วยราคาเดิมที่ 0.75 ดอลลาร์ต่อหนึ่งล้าน Input Tokens และ 3.75 ดอลลาร์ต่อหนึ่งล้าน Output Tokens
อีกรุ่นคือ Gemini 3.8 Flash Cyber โมเดลที่ออกแบบมาเพื่อความปลอดภัยทางไซเบอร์โดยเฉพาะ มีความสามารถระดับแนวหน้า (Frontier-level) ในการตรวจจับและแก้ไขช่องโหว่โดยอัตโนมัติ (Automated Patching) ซึ่งเปิดให้ผู้ดูแลความปลอดภัยที่ได้รับความไว้วางใจใช้งานผ่านโครงการ Fairwind Program ใหม่ของเรา
แม้จะถูกปรับแต่งมาเพื่อการใช้งานที่แตกต่างกัน แต่ทั้งสองรุ่นขับเคลื่อนด้วยฐานความฉลาดเดียวกัน และได้รับการเร่งประสิทธิภาพผ่าน Agentic Loops ที่ทำงานต่อเนื่องยาวนาน ซึ่งออกแบบมาเพื่อประเมินและปรับปรุงโมเดลพื้นฐานแบบเรียกซ้ำ (Recursively) ความก้าวหน้านี้เกิดจากนวัตกรรมที่ครอบคลุมถึงการฝึกฝนอย่างเข้มข้นในโดเมนความปลอดภัยทางไซเบอร์ที่มีความต้องการสูง
Gemini 3.8 Flash: สร้างขึ้นเพื่อการเขียนโค้ดระยะยาวและ Autonomous Agents
Gemini 3.8 Flash มอบประสิทธิภาพที่เพิ่มขึ้นอย่างมากจากรุ่น 3.7 Flash โดยมีระดับความสามารถใกล้เคียงกับโมเดลระดับแนวหน้า (Frontier Models) ที่มีราคาสูงกว่ามาก

จากการทดสอบด้วย DeepSWE v1.1 ซึ่งเป็นเกณฑ์วัดงานวิศวกรรมซอฟต์แวร์ระยะยาว พบว่า 3.8 Flash ทำผลงานได้เหนือกว่าโมเดลขนาดใหญ่ส่วนใหญ่ในการแก้ปัญหาทางวิศวกรรมที่ซับซ้อนตั้งแต่ต้นจนจบด้วยตัวเอง โดยมีค่าใช้จ่ายเพียงเสี้ยวเดียวเท่านั้น

นอกจากนี้ 3.8 Flash ยังแสดงให้เห็นถึงความน่าเชื่อถือที่จำเป็นสำหรับระบบอัตโนมัติระดับองค์กรในสาขาเฉพาะทาง โดยทำคะแนนในเกณฑ์มาตรฐาน เช่น Vals Finance Agent V2 และ Harvey's Legal Agent Benchmark ได้ดีกว่า 3.7 Flash รวมถึงยังทำคะแนนได้ 54.9% ใน HLE-Verified ซึ่งสะท้อนถึงความสามารถในการใช้เหตุผลหลายขั้นตอนในสาขา STEM มนุษยศาสตร์ และวิชาชีพ



หัวใจสำคัญของประสิทธิภาพที่เพิ่มขึ้นคือความสามารถในการทำงานหนักขึ้นในงานที่ซับซ้อน โมเดลมีความพากเพียรในการเพิ่มขั้นตอนการให้เหตุผลและเรียกใช้เครื่องมือซ้ำๆ เพื่อให้ได้ผลลัพธ์ที่ดีที่สุด ซึ่งอาจมีการใช้ Token มากขึ้นในระดับความพยายาม (Effort Levels) ที่สูงขึ้น
อย่างไรก็ตาม สำหรับแอปพลิเคชันที่มีข้อจำกัดด้านความเร็วในการประมวลผล นักพัฒนาสามารถเลือกใช้ระดับความพยายามที่ต่ำลงเพื่อประหยัด Token หรือเลือกใช้งาน Gemini 3.7 Flash ต่อไปได้ ซึ่งเรายังคงสนับสนุนการทำงานอย่างเต็มรูปแบบสำหรับเวิร์กโหลดที่เน้นประสิทธิภาพเป็นหลัก
ตัวอย่างความสามารถของ Gemini 3.8 Flash ที่สร้างขึ้นด้วย Prompt ง่ายๆ ผ่าน Google Antigravity ได้แก่ การสร้างเกม 3D ที่สมจริงโดยใช้คำสั่งแบบวนซ้ำ (Looping Instruction), การสร้าง Google Maps เวอร์ชัน DOS ที่ใช้งานได้จริง รวมถึงโปรแกรม Hardware Anatomy สำหรับจำลองภาพ 3D แบบโต้ตอบที่สร้างการเรนเดอร์ Three.js ได้อย่างแม่นยำ
Gemini 3.8 Flash Cyber: ประสิทธิภาพระดับผู้เชี่ยวชาญด้านไซเบอร์
Gemini 3.8 Flash Cyber เปิดให้ใช้งานผ่าน Fairwind Program เพื่อมอบความได้เปรียบในภูมิทัศน์ความปลอดภัยทางไซเบอร์ที่ซับซ้อน ด้วยความเร็วและราคาในระดับ Flash ที่ช่วยให้ดำเนินการซ้ำได้อย่างรวดเร็ว
การค้นหาช่องโหว่โดยอัตโนมัติ
ในเกณฑ์มาตรฐาน CyberGym พบว่า Gemini 3.8 Flash Cyber มีประสิทธิภาพระดับแนวหน้าในการค้นหาช่องโหว่โดยอัตโนมัติ เหนือกว่าทั้งรุ่น 3.5 Flash Cyber และโมเดลระดับแนวหน้าที่มีขนาดใหญ่กว่า

เพื่อตอบโจทย์การป้องกันในโลกความเป็นจริง เราได้ทดสอบกับเกณฑ์มาตรฐานภายในที่ครอบคลุมโค้ดถึง 20 ภาษาโปรแกรม ซึ่งโมเดลสามารถก้าวกระโดดจากรุ่นก่อนหน้าอย่างน่าประทับใจ โดยมีอัตราความสำเร็จสูงกว่า 70%

การแก้ไขช่องโหว่โดยอัตโนมัติ
เรามุ่งเน้นการให้ความสามารถระดับผู้เชี่ยวชาญแก่ผู้ดูแลความปลอดภัย โดยเฉพาะการแก้ไขช่องโหว่ (Remediation) มากกว่าการเน้นความสามารถในการโจมตี
จากการทดสอบบน CWE-Bench ของ Collinear พบว่า Gemini 3.8 Flash Cyber อยู่ในกลุ่มผู้นำแถวหน้าด้วยคะแนน Pass@1 ที่ 47.2% ซึ่งใกล้เคียงกับโมเดลระดับท็อปที่ทำได้ 47.8% แต่มีราคาที่ต่ำกว่าอย่างมีนัยสำคัญ

ผลกระทบในโลกแห่งความเป็นจริง: การรักษาความปลอดภัยโค้ดของ Google
ปัจจุบันเราได้นำ Gemini 3.8 Flash Cyber มาใช้รักษาความปลอดภัยโค้ดภายใน Google แล้ว โดยพบผลลัพธ์ที่น่าทึ่ง เช่น:
- ทีม Chrome Security พบว่าโมเดลสามารถสร้างการแก้ไขช่องโหว่ได้ถูกต้องมากกว่าโมเดลเชิงพาณิชย์ขนาดใหญ่ถึง 2.6 เท่า
- Wiz รายงานว่าโมเดลทำคะแนน Recall ได้สูงกว่าเดิม 7.5-9.7% ในการทดสอบเจาะระบบ (Penetration Testing) ด้วยค่าใช้จ่ายที่ถูกกว่า 2.3-5.2 เท่า
- ทีม Cloud Vulnerability Research ใช้โมเดลนี้ค้นหาช่องโหว่สำคัญได้ภายในเวลาไม่ถึง 2 ชั่วโมง ซึ่งปกติอาจต้องใช้เวลาวิจัยนานหลายเดือน
สร้างขึ้นโดยคำนึงถึงความปลอดภัย
3.8 Flash มาพร้อมระบบป้องกันการนำไปใช้ในทางที่ผิด ทั้งด้านสารเคมี ชีวภาพ รังสี และนิวเคลียร์ (CBRN) รวมถึงการโจมตีทางไซเบอร์ตามกรอบ Frontier Safety Framework ส่วนรุ่น 3.8 Flash Cyber จะมีมาตรการที่ยืดหยุ่นกว่าเพื่อรองรับงานรักษาความปลอดภัย จึงจำกัดสิทธิ์ให้เฉพาะผู้ดูแลความปลอดภัยที่ได้รับความไว้วางใจเท่านั้น
นอกจากนี้ โมเดล Gemini 3.8 ยังมีความทนทานต่อการโจมตีแบบ Prompt Injection สูงขึ้นอย่างมากจากการวัดผลโดย Gray Swan ซึ่งช่วยเพิ่มความปลอดภัยให้กับผู้ใช้งานจากการโจมตีที่เป็นอันตราย

Gemini 3.8 Flash และ Cyber: เริ่มต้นใช้งานได้ตั้งแต่วันนี้
สำหรับนักพัฒนา: สามารถเริ่มสร้างสรรค์ผลงานได้ที่ Google Antigravity หรือใช้งานผ่าน Gemini API ใน Google AI Studio, Android Studio และสร้าง UI ด้วย Stitch โดยสามารถศึกษาข้อมูลเพิ่มเติมได้ที่ เอกสารสำหรับนักพัฒนา
สำหรับองค์กรและผู้บริโภค: เข้าถึงผ่าน Gemini Enterprise หรือสำหรับสมาชิก Google AI Pro และ Ultra สามารถใช้งานผ่าน Gemini app, AI Mode ใน Google Search และ Gemini ใน Google Sheets
สำหรับด้านไซเบอร์: เราเปิดสิทธิ์การเข้าถึง Gemini 3.8 Flash Cyber ในลำดับต้นๆ ให้กับหน่วยงานภาครัฐ ผู้ให้บริการโครงสร้างพื้นฐานวิกฤต และผู้ดูแลซอฟต์แวร์ผ่านโครงการ Fairwind โดยสามารถ สมัครขอรับสิทธิ์เข้าถึง ได้แล้ววันนี้
ความคิดเห็น (0)
เข้าสู่ระบบเพื่อร่วมแสดงความเห็น
สมัครสมาชิกมาเป็นคนแรกที่แสดงความเห็นกันเลยโบร
