tag: LLM

Perplexity เปิดตัว Portable Computer บน NVIDIA DGX Spark: ประมวลผล AI ภายในเครื่องแบบไร้ค่า Token

Perplexity เปิดตัว Portable Computer บน NVIDIA DGX Spark: ประมวลผล AI ภายในเครื่องแบบไร้ค่า Token

· By: NatapolK
Perplexity ปล่อยแพลตฟอร์ม Portable Computer ระบบ Agentic แบบ Local-first ที่รวมโมเดลและ Sandbox ไว้ในเครื่องเดียวบนขุมพลัง NVIDIA DGX Spark เพื่อความปลอดภัยและประหยัดค่าใช้จ่าย
เผยสาเหตุ LLM เขียนติดสำนวน AI: ชี้การวางระบบความปลอดภัยทำขอบเขตภาษาแคบลงจนตรวจจับง่าย

เผยสาเหตุ LLM เขียนติดสำนวน AI: ชี้การวางระบบความปลอดภัยทำขอบเขตภาษาแคบลงจนตรวจจับง่าย

· By: SirilukP
CTO ของ Pangram ระบุว่าระบบป้องกันหลังการฝึกฝน (Post-training) ทำให้ AI แสดงออกได้จำกัดจนเกิดภาวะ mode collapse ซึ่งต่างจาก Base model ที่มีความหลากหลายของภาษาจนยากต่อการตรวจจับ
เจาะลึกเฟรมเวิร์กตอบคำถามสัมภาษณ์งาน AI System Design สำหรับวิศวกรรุ่นใหม่

เจาะลึกเฟรมเวิร์กตอบคำถามสัมภาษณ์งาน AI System Design สำหรับวิศวกรรุ่นใหม่

· By: SirilukP
เปลี่ยนจากโจทย์ 'Design YouTube' สู่ 'Design ChatGPT' ด้วยเฟรมเวิร์ก 7 ขั้นตอนเพื่อรับมือการสัมภาษณ์งานในตำแหน่ง AI Engineer และ Applied Scientist อย่างมืออาชีพ
เอเจนท์ AI ต้องการความจำมากแค่ไหน? ผลวิจัยชี้ต้อง 'ปรับจูน' ให้พอดีกับความสามารถโมเดล

เอเจนท์ AI ต้องการความจำมากแค่ไหน? ผลวิจัยชี้ต้อง 'ปรับจูน' ให้พอดีกับความสามารถโมเดล

· By: NatapolK
IBM Research พบว่าการใส่ความจำหรือคำแนะนำให้เอเจนท์ AI ไม่ได้ยิ่งมากยิ่งดีเสมอไป แต่ต้องปรับปริมาณยาให้เหมาะสมกับระดับความฉลาดของโมเดลแต่ละรุ่นเพื่อประสิทธิภาพสูงสุดและต้นทุนที่ต่ำลง
เปลี่ยน Qwen3.8-27B เป็น Local AI Coding Agent ส่วนตัว ง่ายๆ ด้วยคำสั่งเพียง 3 บรรทัด

เปลี่ยน Qwen3.8-27B เป็น Local AI Coding Agent ส่วนตัว ง่ายๆ ด้วยคำสั่งเพียง 3 บรรทัด

· By: SirilukP
วิธีการตั้งค่าโมเดล Qwen3.8-27B ให้เป็นผู้ช่วยเขียนโค้ดอัจฉริยะบนเครื่องคอมพิวเตอร์ของคุณเองผ่าน Ollama และ OpenCode โดยไม่ต้องตั้งค่าเซิร์ฟเวอร์ให้ยุ่งยาก
คู่มือ Fine-Tuning LLM สำหรับ Tool-Calling ด้วย XYZ-Aquila-SFT และ Qwen3

คู่มือ Fine-Tuning LLM สำหรับ Tool-Calling ด้วย XYZ-Aquila-SFT และ Qwen3

· By: AttapolK
นำเสนอขั้นตอนการ Fine-tuning โมเดลภาษาแบบ end-to-end เพื่อรองรับการเรียกใช้เครื่องมือ (tool-calling) ครอบคลุมตั้งแต่การจัดการชุดข้อมูล XYZ-Aquila-SFT ไปจนถึงการปรับแต่ง LoRA บนโมเดล Qwen3
วิธีสร้าง AI Web Scraper แบบง่ายด้วย Python เพื่อการดึงข้อมูลที่แม่นยำ

วิธีสร้าง AI Web Scraper แบบง่ายด้วย Python เพื่อการดึงข้อมูลที่แม่นยำ

· By: SirilukP
เปลี่ยนหน้าเว็บให้เป็นเครื่องมือตอบคำถามอัจฉริยะด้วย Python และ LLM โดยเน้นการทำความสะอาดข้อมูลเพื่อลดการใช้ Token และเพิ่มความแม่นยำของคำตอบ
Nvidia เปิดตัว Nemotron 3.5 Lightning ชูจุดเด่นความเร็วสูง ในขนาดกะทัดรัดแบบ open-weight

Nvidia เปิดตัว Nemotron 3.5 Lightning ชูจุดเด่นความเร็วสูง ในขนาดกะทัดรัดแบบ open-weight

Nvidia เปิดตัว Nemotron 3.5 Lightning โมเดลขนาด 3.6 พันล้านพารามิเตอร์ที่ทำความเร็วได้ถึง 670 tokens ต่อวินาที โดยมีประสิทธิภาพเทียบเท่าโมเดลขนาดใหญ่กว่าอย่าง gpt-oss-120b ของ OpenAI
Meta เปิดตัว Muse Glimmer โมเดล Multimodal 30B แบบ Open Source เพื่อการใช้งาน Agent ระดับ Local

Meta เปิดตัว Muse Glimmer โมเดล Multimodal 30B แบบ Open Source เพื่อการใช้งาน Agent ระดับ Local

· By: TanasakP
Meta เปิดตัว Muse Glimmer โมเดล Multimodal ขนาด 30 พันล้านพารามิเตอร์ ภายใต้สัญญาอนุญาต Apache 2.0 ออกแบบมาเพื่อเป็น AI Agent ที่ประมวลผลบนเครื่องส่วนตัวได้อย่างรวดเร็วและปลอดภัย
เผยเทคนิค Knowledge Distillation ใหม่: ลดใช้ VRAM 15 เท่า ฝึก AI ขนาดใหญ่ได้บน GPU ตัวเดียว

เผยเทคนิค Knowledge Distillation ใหม่: ลดใช้ VRAM 15 เท่า ฝึก AI ขนาดใหญ่ได้บน GPU ตัวเดียว

Multiverse Computing พัฒนาเทคนิค Fused Chunked KL Loss ช่วยลดการใช้หน่วยความจำในการฝึกโมเดล AI ขนาดเล็กลงได้มหาศาล ทำให้การทำ Distillation ระดับสเกลใหญ่ประหยัดและเข้าถึงได้ง่ายขึ้น
TutorMoments: เฟรมเวิร์กใหม่ทดสอบครูสอนพิเศษ AI เมื่อใดควรช่วย หรือเมื่อใดควรปล่อยให้นักเรียนฝึกคิดเอง

TutorMoments: เฟรมเวิร์กใหม่ทดสอบครูสอนพิเศษ AI เมื่อใดควรช่วย หรือเมื่อใดควรปล่อยให้นักเรียนฝึกคิดเอง

· By: SirilukP
Allen Institute for AI เปิดตัว TutorMoments พรีวิวเฟรมเวิร์กสำหรับประเมินโมเดลภาษา (LLMs) ในบทบาทครูสอนพิเศษ โดยเน้นจุดตัดสินใจสำคัญว่าโมเดลควรยื่นมือเข้าช่วยหรือผลักดันให้นักเรียนใช้ความคิดด้วยตัวเอง
ทุบสถิติใหม่! รางวัลพูลิตเซอร์ปี 2026 มีผลงานใช้ AI ร่วมสร้างสรรค์มากที่สุดเป็นประวัติการณ์

ทุบสถิติใหม่! รางวัลพูลิตเซอร์ปี 2026 มีผลงานใช้ AI ร่วมสร้างสรรค์มากที่สุดเป็นประวัติการณ์

คณะกรรมการรางวัลพูลิตเซอร์เผยมีผลงานถึง 8 ชิ้นที่ใช้ AI ในกระบวนการทำงาน โดยมีผู้ชนะถึง 5 รายที่ใช้ LLM ช่วยวิเคราะห์ข้อมูลขนาดใหญ่ แต่ยังคงสั่งห้ามใช้ AI ในการเขียนและเรียบเรียงเนื้อหาข่าวโดยเด็ดขาด
คู่มือประหยัด Token ในระบบ Multi-Agent AI ด้วย 4 กลยุทธ์ลดต้นทุนอย่างมีประสิทธิภาพ

คู่มือประหยัด Token ในระบบ Multi-Agent AI ด้วย 4 กลยุทธ์ลดต้นทุนอย่างมีประสิทธิภาพ

การขยายสถาปัตยกรรม Multi-agent AI ให้ทรงพลังไม่จำเป็นต้องจ่ายแพงเสมอไป ด้วย 4 เทคนิคการจัดการ Token ที่ช่วยลดทั้งค่าใช้จ่ายและความล่าช้าในการประมวลผลอย่างได้ผล
AMD เปิดตัว Instella-MoE-16B-A3B โมเดล LLM แบบเปิดกว้างเต็มรูปแบบ ฝึกฝนบนชิป Instinct GPU

AMD เปิดตัว Instella-MoE-16B-A3B โมเดล LLM แบบเปิดกว้างเต็มรูปแบบ ฝึกฝนบนชิป Instinct GPU

· By: NatapolK
AMD เปิดตัว Instella-MoE-16B-A3B โมเดลภาษาขนาด 16B ที่ใช้พารามิเตอร์จริงเพียง 2.8B ต่อโทเค็น ฝึกฝนบน GPU Instinct MI300X และ MI325X พร้อมเปิดเผยชุดข้อมูลและโค้ดทั้งหมดเพื่อการวิจัย
PolyAI เปิดตัว Dialog-RSN-1 โมเดลสนทนา Audio-Native ตอบโต้ลื่นไหลในเวลาต่ำกว่า 300ms

PolyAI เปิดตัว Dialog-RSN-1 โมเดลสนทนา Audio-Native ตอบโต้ลื่นไหลในเวลาต่ำกว่า 300ms

· By: TanasakP
PolyAI เปิดตัวโมเดล Dialog-RSN-1 ที่รับรู้เสียงผู้โทรโดยตรงโดยไม่ผ่านการถอดความ ช่วยให้การสลับคิวพูดและตอบโต้เป็นธรรมชาติ พร้อมประสิทธิภาพความเร็วระดับใช้งานจริงในกลุ่มธุรกิจองค์กร
เจาะลึกการสร้าง Agentic Workflow ด้วย Kimi CLI: จากการแก้บั๊กอัตโนมัติสู่ระบบ Session Memory แบบไร้รอยต่อ

เจาะลึกการสร้าง Agentic Workflow ด้วย Kimi CLI: จากการแก้บั๊กอัตโนมัติสู่ระบบ Session Memory แบบไร้รอยต่อ

· By: NatapolK
คู่มือการกำหนดค่าและใช้งาน Kimi CLI ในฐานะ AI coding agent แบบ Non-Interactive ตั้งแต่การติดตั้งผ่าน uv การตั้งค่า Moonshot API ไปจนถึงการสร้าง Python wrapper เพื่อให้เอเจนต์วิเคราะห์และแก้ไขโปรเจกต์ได้โดยอัตโนมัติ
คู่มือ Data Science และ AI สำหรับคนทำงานมืออาชีพ จากมุมมอง Harvard Business School Online

คู่มือ Data Science และ AI สำหรับคนทำงานมืออาชีพ จากมุมมอง Harvard Business School Online

เจาะลึกกลยุทธ์การใช้ AI ให้เกิดผลจริงด้วยการเริ่มจากปัญหาทางธุรกิจมากกว่าเทคโนโลยี พร้อมเน้นย้ำความสำคัญของคุณภาพข้อมูล วิจารณญาณของมนุษย์ และการเลือกโมเดลที่คุ้มค่า
คู่มือเบื้องต้นการถอดรหัสแบบกำหนดเงื่อนไข: เปลี่ยน LLM ให้แสดงผลโครงสร้างข้อมูลแม่นยำ 100%

คู่มือเบื้องต้นการถอดรหัสแบบกำหนดเงื่อนไข: เปลี่ยน LLM ให้แสดงผลโครงสร้างข้อมูลแม่นยำ 100%

· By: SirilukP
คู่มือการใช้ Practical Constraint Decoding เพื่อบังคับให้ LLM สร้างผลลัพธ์ตามโครงสร้าง JSON หรือ Schema ที่กำหนด โดยไม่ต้องพึ่งพาเพียงการเขียน Prompt อ้อนวอนโมเดลอีกต่อไป
เมื่อโมเดล AI ที่คุณจ่ายเงินซื้อ อาจไม่ใช่ตัวที่ให้คำตอบจริง

เมื่อโมเดล AI ที่คุณจ่ายเงินซื้อ อาจไม่ใช่ตัวที่ให้คำตอบจริง

· By: NatapolK
เผยพฤติกรรมผู้ให้บริการ API ที่แอบสลับโมเดลหรือลดความแม่นยำเพื่อประหยัดต้นทุน ส่งผลกระทบต่อทั้งประสิทธิภาพของงานและความน่าเชื่อถือในมุมกฎหมาย
OpenAI และโมเดล AI ยุคใหม่สร้างความปั่นป่วนในโลกไซเบอร์ หลังพบความสามารถในการเจาะระบบขั้นสูง

OpenAI และโมเดล AI ยุคใหม่สร้างความปั่นป่วนในโลกไซเบอร์ หลังพบความสามารถในการเจาะระบบขั้นสูง

· By: SirilukP
โมเดลภาษาขนาดใหญ่รุ่นล่าสุดอย่าง GPT-5.6 และ Kimi K3 แสดงศักยภาพในการเจาะระบบและตรวจหาช่องโหว่แบบ Zero-day ได้เร็วกว่ามนุษย์จนเข้าสู่ยุคสงครามไซเบอร์โดยใช้ AI
← ก่อนหน้าหน้า 2 · 53 ข่าวถัดไป →