Alibaba เปิดตัว Qwen-Image-2.1 ท้าชนโมเดลปิดด้วยขนาดเพียง 7B

· By: SirilukP

ทีม Qwen AI ของ Alibaba ได้เปิดตัว Qwen-Image-2.1 ซึ่งเป็นโมเดลแบบ open-weight สำหรับการสร้างและแก้ไขรูปภาพ โดยจุดเด่นอยู่ที่ส่วนประกอบการสร้างภาพที่มีพารามิเตอร์เพียง 7 พันล้านตัว แต่ทีมพัฒนาอ้างว่าสามารถเอาชนะโมเดลแบบปิด (Closed-source) ส่วนใหญ่ได้จากการทดสอบเกณฑ์มาตรฐานของตนเอง แม้ผลทดสอบจากหน่วยงานอิสระจะยังอยู่ระหว่างรอดำเนินการก็ตาม โดยโมเดลนี้มีความต้องการทรัพยากรไม่สูงนักและสามารถทำงานบน GPU ระดับผู้บริโภคที่มีประสิทธิภาพสูงอย่าง RTX 3090 ได้

ความสามารถที่น่าสนใจของโมเดลนี้คือการสร้างและแก้ไขรูปภาพแบบโปร่งใส (RGBA) ได้โดยตรง ซึ่งช่วยให้ผู้ใช้แยกวัตถุหรือปรับเปลี่ยนข้อความบนเลเยอร์โปร่งใสได้อย่างสะดวก นอกจากนี้ยังรองรับการใช้รูปภาพอ้างอิงพร้อมกันสูงสุดถึง 10 รูป เหมาะสำหรับการสร้างภาพพอร์ตเทรตกลุ่ม การลองชุดเสมือนจริง หรือการออกแบบตกแต่งห้อง โดยผู้ใช้สามารถใช้วงกลม หน้ากาก หรือการระบายสีเครื่องหมายเพื่อช่วยนำทางในการแก้ไขเฉพาะจุดได้อย่างแม่นยำ

ทาง Qwen กล่าวว่า การปรับเปลี่ยนสถาปัตยกรรมและการนำ KV cache กลับมาใช้ใหม่ มีส่วนสำคัญที่ช่วยเร่งความเร็วในการประมวลผล (inference) ให้ดียิ่งขึ้น โดยเฉพาะในกรณีที่มีการใช้รูปภาพอ้างอิงหลายรูปพร้อมกัน

ปัจจุบัน Qwen-Image-2.1 เปิดให้ใช้งานแล้วผ่านทาง Hugging Face, GitHub และ Model Scope พร้อมมีเดโมให้ทดลองที่ Hugging Face demo

ทั้งนี้ สัญญาอนุญาตเพื่อการวิจัย ของโมเดลระบุชัดเจนว่าห้ามใช้ในเชิงพาณิชย์ ซึ่งหากเป็นผู้ใช้ทางธุรกิจจำเป็นต้องดำเนินการสมัครขอสัญญาอนุญาตแยกต่างหากจากทาง Qwen

Source: The Decoder
ดูแลงานแปลและเรียบเรียงโดย SirilukP
Alibaba เปิดตัว Qwen-Image-2.1 ท้าชนโมเดลปิดด้วยขนาดเพียง 7B

ความคิดเห็น (0)

เข้าสู่ระบบเพื่อร่วมแสดงความเห็น

สมัครสมาชิก

มาเป็นคนแรกที่แสดงความเห็นกันเลยโบร