tag: LLM

Anthropic เปิดตัว Claude Opus 4.5 โมเดลเรือธงที่ฉลาดและทรงพลังที่สุดในปัจจุบัน

Anthropic เปิดตัว Claude Opus 4.5 โมเดลเรือธงที่ฉลาดและทรงพลังที่สุดในปัจจุบัน

· By: TanasakP
Anthropic เปิดตัวโมเดล AI รุ่นล่าสุด Claude Opus 4.5 ที่ทำคะแนนทดสอบวิศวกรรมซอฟต์แวร์ระดับ SOTA พร้อมฟีเจอร์ควบคุมความพยายามในการประมวลผล (Effort control) เพื่อเพิ่มประสิทธิภาพในการทำงานจริง
Poolside เปิดตัว Laguna S 2.1 โมเดลเขียนโค้ดจิ๋วแต่แจ๋ว พร้อมความสามารถแก้โจทย์คณิตศาสตร์ระดับโลก

Poolside เปิดตัว Laguna S 2.1 โมเดลเขียนโค้ดจิ๋วแต่แจ๋ว พร้อมความสามารถแก้โจทย์คณิตศาสตร์ระดับโลก

· By: SirilukP
Poolside เปิดตัว Laguna S 2.1 โมเดลเขียนโค้ดแบบ open-weight ขนาดกะทัดรัดที่เน้นการตรวจสอบงานตัวเองและแก้ไขข้อผิดพลาดแบบเรียลไทม์ โดยสามารถโค่นคู่แข่งขนาดใหญ่ในผลการทดสอบหลายรายการและแก้โจทย์คณิตศาสตร์ที่ค้างคามาเกือบ 50 ปีได้สำเร็จ
Copilot vs. การใช้ API โดยตรง: เจาะลึกความคุ้มค่าที่คุณจ่ายจริงคืออะไร?

Copilot vs. การใช้ API โดยตรง: เจาะลึกความคุ้มค่าที่คุณจ่ายจริงคืออะไร?

· By: NatapolK
เปรียบเทียบความแตกต่างระหว่างการใช้ GitHub Copilot และการเรียกใช้งานโมเดลผ่าน API โดยตรง พร้อมวิเคราะห์โครงสร้างพื้นฐานและเวิร์กโฟลว์ที่ส่งผลต่อต้นทุนและประสิทธิภาพการทำงาน
เปรียบเทียบ 4 สุดยอด Framework สำหรับ Fine-Tuning LLM: เลือกตัวไหนให้เร็ว แรง และประหยัด VRAM

เปรียบเทียบ 4 สุดยอด Framework สำหรับ Fine-Tuning LLM: เลือกตัวไหนให้เร็ว แรง และประหยัด VRAM

· By: AttapolK
เจาะลึกความต่างระหว่าง Unsloth, Axolotl, TRL และ LLaMA-Factory สี่โครงการโอเพนซอร์สชั้นนำสำหรับการปรับแต่งโมเดลภาษาขนาดใหญ่ที่วิศวกร AI ต้องรู้จัก
Google เปิดตัวโมเดลตระกูล Flash ใหม่: Gemini 3.6 Flash, 3.5 Flash-Lite และ 3.5 Flash Cyber ชูจุดเด่นราคาถูกและเร็วขึ้นเพื่อยุค AI Agent

Google เปิดตัวโมเดลตระกูล Flash ใหม่: Gemini 3.6 Flash, 3.5 Flash-Lite และ 3.5 Flash Cyber ชูจุดเด่นราคาถูกและเร็วขึ้นเพื่อยุค AI Agent

· By: SirilukP
Google เปิดตัวไลน์อัปโมเดลระดับ Flash ใหม่ 3 รุ่น เน้นการประมวลผลที่มีประสิทธิภาพสูง ราคาลดลง และประหยัด Output Token มากขึ้น เหมาะสำหรับงาน Agentic ปริมาณมาก โดย 3.6 Flash ลดจำนวน Output Token ลงถึง 17% และลดราคาลงเหลือ 7.50 ดอลลาร์ต่อ 1 ล้าน Token
วิธีรัน Mythos โมเดล AI สายโค้ดสุดแรงบนเครื่องด้วย llama.cpp และ Pi

วิธีรัน Mythos โมเดล AI สายโค้ดสุดแรงบนเครื่องด้วย llama.cpp และ Pi

· By: SirilukP
คู่มือการติดตั้งและใช้งาน Qwythos-9B-Claude-Mythos-5-1M โมเดลเขียนโค้ดประสิทธิภาพสูงบนเครื่องตนเองผ่าน llama.cpp พร้อมฟีเจอร์ MTP speculative decoding เพื่อความเร็วสูงสุด
รวม 10 แพลตฟอร์ม AI แบบ No-Code โอเพนซอร์ส สำหรับสร้างแอป LLM, ระบบ RAG และ AI Agents

รวม 10 แพลตฟอร์ม AI แบบ No-Code โอเพนซอร์ส สำหรับสร้างแอป LLM, ระบบ RAG และ AI Agents

· By: TanasakP
แนะนำ 10 แพลตฟอร์มโอเพนซอร์สแบบ No-Code สำหรับสร้างแอปพลิเคชัน LLM ระบบ RAG และ AI Agents ที่ใช้งานง่ายผ่านอินเทอร์เฟซแบบ Visual ช่วยให้ผู้ใช้สามารถโฮสต์ระบบได้เองเพื่อความปลอดภัยของข้อมูล
เจาะลึกการ Fine-Tuning ฉบับมือใหม่: เปลี่ยน AI ให้เก่งเฉพาะทางอย่างมืออาชีพ

เจาะลึกการ Fine-Tuning ฉบับมือใหม่: เปลี่ยน AI ให้เก่งเฉพาะทางอย่างมืออาชีพ

· By: SirilukP
ทำความรู้จักขั้นตอนพื้นฐานของการปรับจูนโมเดลภาษาขนาดใหญ่ (LLM) ตั้งแต่กระบวนการ Pretraining ไปจนถึงเทคนิค Fine-Tuning รูปแบบต่างๆ ที่ช่วยให้ AI เรียนรู้ทักษะใหม่ได้อย่างมีประสิทธิภาพ
สร้าง Structured Output ให้ LLM แม่นยำ 100% ด้วย Outlines ไลบรารี

สร้าง Structured Output ให้ LLM แม่นยำ 100% ด้วย Outlines ไลบรารี

· By: SirilukP
Outlines เป็นโอเพนซอร์สไลบรารีที่ช่วยควบคุมกระบวนการสร้างผลลัพธ์ของ LLM แบบ Deterministic เพื่อให้ได้เอาต์พุตที่มีโครงสร้างตามกำหนดอย่างแม่นยำและน่าเชื่อถือ
12 วิธีลด Latency และต้นทุนการรัน LLM ในระดับ Production อย่างมีประสิทธิภาพ

12 วิธีลด Latency และต้นทุนการรัน LLM ในระดับ Production อย่างมีประสิทธิภาพ

· By: SirilukP
การปรับสเกล LLM ไม่ใช่แค่การอัด GPU แต่คือการตัดงานส่วนเกินในทุกคำสั่ง เพื่อลดระยะเวลารอคอยและค่าใช้จ่ายในการประมวลผล
เปิดโผ 10 ช่อง YouTube ระดับเทพที่จะช่วยให้คุณก้าวล้ำนำโลก AI

เปิดโผ 10 ช่อง YouTube ระดับเทพที่จะช่วยให้คุณก้าวล้ำนำโลก AI

รวม 10 แหล่งเรียนรู้ AI บน YouTube สำหรับวิศวกรและผู้ที่สนใจ ครอบคลุมตั้งแต่งานวิจัยเชิงลึก การเขียนโค้ด ไปจนถึงการวิเคราะห์ทิศทางอุตสาหกรรม
ยกระดับ vLLM: เมื่อ Backend ของ Transformers เร็วแรงระดับ Native โดยไม่ต้องแก้โค้ด

ยกระดับ vLLM: เมื่อ Backend ของ Transformers เร็วแรงระดับ Native โดยไม่ต้องแก้โค้ด

· By: TanasakP
vLLM อัปเกรดแบ็กเอนด์ Transformers ให้มีประสิทธิภาพเทียบเท่าหรือสูงกว่าการเขียนโค้ดเฉพาะทาง ช่วยให้ผู้พัฒนาสามารถรันโมเดล LLM หลากหลายสถาปัตยกรรมได้ทันทีด้วยความเร็วสูงสุด
เปิดตัว Inkling: โมเดล Open Multimodal ระดับ 1 ล้านล้านพารามิเตอร์จาก Thinking Machines

เปิดตัว Inkling: โมเดล Open Multimodal ระดับ 1 ล้านล้านพารามิเตอร์จาก Thinking Machines

Thinking Machines เปิดตัว Inkling โมเดล open source ขนาดมหึมาที่รองรับอินพุตทั้งภาพ ข้อความ และเสียงแบบเนทีฟ พร้อม Context Window สูงถึง 1 ล้านโทเค็น และความสามารถด้านการใช้เหตุผลระดับสูง
← ก่อนหน้าหน้า 3 · 53 ข่าว