Google อัปเดต Gemma 4 เงียบๆ แก้บั๊ก Tool Calling และปัญหาบอทตอบคำถามไม่จบ

· By: AttapolK

Google ได้ส่งอัปเดตสำหรับ Gemma 4 โมเดล AI แบบเปิด (Open Model) รุ่นล่าสุด โดยเน้นเพิ่มประสิทธิภาพบนจีพียู Nvidia Hopper, แก้ไขบั๊กด้าน Tool Calling และจัดการปัญหาการตอบกลับที่หยุดกะทันหัน ตามข้อมูลจาก Google การเปิดใช้งาน Flash Attention 4 จะช่วยเพิ่มความเร็วในการประมวลผลคำสั่ง (prompt) ได้ตั้งแต่ 25% ถึง 70% และลดระยะเวลาในการเริ่มต้นสร้างโทเค็นแรก (Time to First Token) ลงได้สูงสุดถึง 31% นอกจากนี้ยังมีการแก้ไขข้อผิดพลาดในฟีเจอร์ Tool Calling ซึ่งเป็นกลไกสำคัญที่ช่วยให้โมเดลสามารถสั่งการเครื่องมือภายนอกได้โดยอัตโนมัติ

Google ระบุว่าความคงเส้นคงวาในการตอบคำถามได้รับการปรับปรุงให้ดีขึ้นเพื่อลดกรณีที่โมเดลตัดคำตอบให้สั้นลงหรือส่งคืนข้อมูลไม่ครบถ้วน สำหรับงานด้านการประมวลผลภาพ (Vision) ผู้ใช้สามารถปรับพารามิเตอร์ max_soft_tokens ได้ด้วยตนเองจาก 280 เป็น 1,120 เพื่อให้ได้ผลลัพธ์ OCR ที่คมชัดขึ้นและรองรับความละเอียดภาพสูงสุด 2.51 เมกะพิกเซล โดย Google ได้จัดทำ interactive configurator on Hugging Face เพื่ออำนวยความสะดวกในส่วนนี้

แม้เกณฑ์มาตรฐาน (Benchmarks) ที่เปิดเผยออกมาจะเน้นเปรียบเทียบเฉพาะรุ่น 31B และ E4B แต่ใน Hugging Face repository แสดงให้เห็นว่าโมเดลทุกขนาดพารามิเตอร์ในเจเนอเรชันนี้ได้รับการอัปเดตทั้งหมด ซึ่งรวมถึง the newest 12B release ด้วย

อย่างไรก็ตาม เริ่มมีเสียงทักท้วงจากชุมชนนักพัฒนาที่ Google เลือกปล่อยอัปเดตภายใต้ชื่อ "Gemma 4" name เดิม แทนที่จะระบุเลขเวอร์ชันแยกให้ชัดเจน เช่น "Gemma 4.1"

Source: The Decoder
ดูแลงานแปลและเรียบเรียงโดย AttapolK
Gemma 4 31B: BFCL 74,2 %(+0,4), TB2 25,8 %(+4,5), Tau2 Retail 77,6 %(+3,1), Airline 84 %(+2,0), Telecom 62,7 %(+10,1).

ความคิดเห็น (0)

เข้าสู่ระบบเพื่อร่วมแสดงความเห็น

สมัครสมาชิก

มาเป็นคนแรกที่แสดงความเห็นกันเลยโบร