tag: Multiverse Computing

ความปลอดภัยของ LLM: ทำไมการปฏิเสธแบบเหมาเข่งจึงไม่ใช่คำตอบที่ถูกต้อง

ความปลอดภัยของ LLM: ทำไมการปฏิเสธแบบเหมาเข่งจึงไม่ใช่คำตอบที่ถูกต้อง

· By: SirilukP
งานวิจัยใหม่เสนอแนวทาง Narrow-boundary safety เพื่อแก้ปัญหาโมเดล AI ปฏิเสธการตอบคำถามที่ปลอดภัยเพียงเพราะมีคำที่ดูอันตรายปนอยู่ โดยเน้นการกำหนดขอบเขตความปลอดภัยให้แม่นยำตามเจตนาของผู้ใช้แทนการบล็อกทั้งหัวข้อ
เผยเทคนิค Knowledge Distillation ใหม่: ลดใช้ VRAM 15 เท่า ฝึก AI ขนาดใหญ่ได้บน GPU ตัวเดียว

เผยเทคนิค Knowledge Distillation ใหม่: ลดใช้ VRAM 15 เท่า ฝึก AI ขนาดใหญ่ได้บน GPU ตัวเดียว

Multiverse Computing พัฒนาเทคนิค Fused Chunked KL Loss ช่วยลดการใช้หน่วยความจำในการฝึกโมเดล AI ขนาดเล็กลงได้มหาศาล ทำให้การทำ Distillation ระดับสเกลใหญ่ประหยัดและเข้าถึงได้ง่ายขึ้น