ข่าวทั้งหมด

ไขปริศนาความสร้างสรรค์ของ Diffusion Models ผ่านทฤษฎี Score Smoothing

ไขปริศนาความสร้างสรรค์ของ Diffusion Models ผ่านทฤษฎี Score Smoothing

งานวิจัยล่าสุดเผยว่าความคิดสร้างสรรค์ใน AI ไม่ใช่เรื่องบังเอิญ แต่เกิดจากกระบวนการทางคณิตศาสตร์ที่ Neural Network ปรับพื้นที่ข้อมูลให้มีความสมูทจนเกิดการสร้างผลลัพธ์ใหม่ระหว่างจุดข้อมูลเดิม
หัวใจสำคัญของ AI Agent: ทำไมข้อมูลสังเคราะห์แบบเปิดถึงเป็นกุญแจสู่การขยายขนาด

หัวใจสำคัญของ AI Agent: ทำไมข้อมูลสังเคราะห์แบบเปิดถึงเป็นกุญแจสู่การขยายขนาด

· By: SirilukP
NVIDIA ผลักดันแนวคิดข้อมูลแบบเปิดและข้อมูลสังเคราะห์เพื่อพัฒนา AI Agent ให้ฉลาดและปลอดภัยยิ่งขึ้น พร้อมเปิดตัวเครื่องมือสำรวจข้อมูล Nemotron และชุดความเชี่ยวชาญระดับท้องถิ่น
LeRobot v0.6.0: ยกระดับการเรียนรู้หุ่นยนต์ด้วยระบบ 'จินตนาการ' การประเมินผล และการปรับปรุงประสิทธิภาพ

LeRobot v0.6.0: ยกระดับการเรียนรู้หุ่นยนต์ด้วยระบบ 'จินตนาการ' การประเมินผล และการปรับปรุงประสิทธิภาพ

· By: TanasakP
เวอร์ชันใหม่เน้นการปิดลูปการเรียนรู้ของหุ่นยนต์ผ่านโมเดลนโยบายที่พยากรณ์อนาคตได้ ระบบประเมินรางวัล (reward models) และชุดทดสอบจำลองใหม่ 6 รายการ พร้อมรองรับการฝึกฝนบนคลาวด์และการติดตั้งที่สะดวกขึ้น
อัปเดตครั้งสำคัญของ 🤗 Kernels: ยกระดับความปลอดภัยและรองรับการพัฒนาแบบ Agent

อัปเดตครั้งสำคัญของ 🤗 Kernels: ยกระดับความปลอดภัยและรองรับการพัฒนาแบบ Agent

Hugging Face ประกาศอัปเดตใหญ่สำหรับโปรเจกต์ Kernels โดยเพิ่มประเภท Repository ใหม่ เสริมความปลอดภัยด้วย Trusted Publishers และวางรากฐานเพื่อรองรับการสร้าง Kernel โดยใช้ AI Agent
เบื้องหลัง PRX ตอนที่ 4: เจาะลึกกลยุทธ์หัวใจสำคัญของข้อมูลและการทำ Data Pipeline

เบื้องหลัง PRX ตอนที่ 4: เจาะลึกกลยุทธ์หัวใจสำคัญของข้อมูลและการทำ Data Pipeline

· By: SirilukP
Photoroom เผยเบื้องหลังการสร้าง Data Pipeline สำหรับโมเดล PRX ตั้งแต่การผสมชุดข้อมูลสาธารณะ การใช้ VLM บรรยายภาพใหม่ ไปจนถึงการสำรวจข้อมูลด้วย Lance และการทำ Streaming ผ่าน Mosaic Data Shards
เชื่อมต่อ Hugging Face สู่ Amazon SageMaker Studio ในคลิกเดียว: ปรับแต่งและติดตั้งโมเดลได้ทันที

เชื่อมต่อ Hugging Face สู่ Amazon SageMaker Studio ในคลิกเดียว: ปรับแต่งและติดตั้งโมเดลได้ทันที

AWS เปิดตัวระบบ Deep-link ใหม่ที่เชื่อมโยง Hugging Face เข้ากับ Amazon SageMaker Studio โดยตรง ช่วยให้นักพัฒนาสามารถนำโมเดลไป Fine-tune หรือ Deploy ได้ในคลิกเดียว พร้อมระบบจัดการสิทธิ์และตรวจสอบโควตา GPU อัตโนมัติ
ยกระดับ vLLM: เมื่อ Backend ของ Transformers เร็วแรงระดับ Native โดยไม่ต้องแก้โค้ด

ยกระดับ vLLM: เมื่อ Backend ของ Transformers เร็วแรงระดับ Native โดยไม่ต้องแก้โค้ด

· By: TanasakP
vLLM อัปเกรดแบ็กเอนด์ Transformers ให้มีประสิทธิภาพเทียบเท่าหรือสูงกว่าการเขียนโค้ดเฉพาะทาง ช่วยให้ผู้พัฒนาสามารถรันโมเดล LLM หลากหลายสถาปัตยกรรมได้ทันทีด้วยความเร็วสูงสุด
เจาะลึกการทำ Profiling ใน PyTorch (ตอนที่ 3): วิเคราะห์ประสิทธิภาพ Attention แต่ละรูปแบบ

เจาะลึกการทำ Profiling ใน PyTorch (ตอนที่ 3): วิเคราะห์ประสิทธิภาพ Attention แต่ละรูปแบบ

· By: TanasakP
พาไปดูประสิทธิภาพของ Attention หลากหลายรูปแบบผ่าน Profiler ตั้งแต่เวอร์ชัน Naive ไปจนถึงเทคนิคขั้นสูงอย่าง Flash Attention และ cuDNN เพื่อเข้าใจการทำงานเชิงลึกของ GPU
Hume AI เปิดตัว Real World VoiceEQ เกณฑ์มาตรฐานใหม่ วัดประสิทธิภาพ Voice AI ด้วยมาตรฐานระดับมนุษย์

Hume AI เปิดตัว Real World VoiceEQ เกณฑ์มาตรฐานใหม่ วัดประสิทธิภาพ Voice AI ด้วยมาตรฐานระดับมนุษย์

· By: TanasakP
Real World VoiceEQ เป็นเครื่องมือวัดผล Voice AI ที่เน้นการโต้ตอบในชีวิตจริงผ่าน 40 โมเดลชั้นนำและข้อมูลจากมนุษย์กว่า 1 ล้านรายการ เพื่อแก้ปัญหาความไม่เป็นธรรมชาติของ AI ที่เกณฑ์วัดเดิมมองข้าม
ถอดบทเรียนการสร้าง Shippy: AI Agent ระดับปฏิบัติการเพื่อการปกป้องมหาสมุทร

ถอดบทเรียนการสร้าง Shippy: AI Agent ระดับปฏิบัติการเพื่อการปกป้องมหาสมุทร

· By: SirilukP
Ai2 เผยผู้อยู่เบื้องหลังการพัฒนา Shippy โมเดล AI บนแพลตฟอร์ม Skylight ที่ช่วยนักวิเคราะห์ทางทะเลตัดสินใจในภารกิจที่มีความเสี่ยงสูงได้อย่างแม่นยำผ่านสถาปัตยกรรมที่เน้นความน่าเชื่อถือ
Model Routing: เมื่อการเลือกโมเดล AI ไม่ได้ง่ายแค่การจัดหมวดหมู่ แต่คือโจทย์การบริหารระบบ

Model Routing: เมื่อการเลือกโมเดล AI ไม่ได้ง่ายแค่การจัดหมวดหมู่ แต่คือโจทย์การบริหารระบบ

· By: SirilukP
เทคนิค Model Routing สำหรับ AI Agent มีความซับซ้อนกว่าที่คิด เพราะต้องรับมือกับปัจจัยแฝงทั้งระบบ Caching ความยากของงานที่คาดเดาไม่ได้ และ Latency จากโครงสร้างพื้นฐานที่ส่งผลต่อต้นทุนและประสิทธิภาพจริง
เปิดตัว Inkling: โมเดล Open Multimodal ระดับ 1 ล้านล้านพารามิเตอร์จาก Thinking Machines

เปิดตัว Inkling: โมเดล Open Multimodal ระดับ 1 ล้านล้านพารามิเตอร์จาก Thinking Machines

Thinking Machines เปิดตัว Inkling โมเดล open source ขนาดมหึมาที่รองรับอินพุตทั้งภาพ ข้อความ และเสียงแบบเนทีฟ พร้อม Context Window สูงถึง 1 ล้านโทเค็น และความสามารถด้านการใช้เหตุผลระดับสูง
Hugging Face รายงานเหตุความปลอดภัย กรกฎาคม 2026: รับมือระบบโจมตีอัตโนมัติด้วย AI Agent เต็มรูปแบบ

Hugging Face รายงานเหตุความปลอดภัย กรกฎาคม 2026: รับมือระบบโจมตีอัตโนมัติด้วย AI Agent เต็มรูปแบบ

Hugging Face ตรวจพบการบุกรุกโครงสร้างพื้นฐานโดย AI Agent แบบอิสระที่โจมตีผ่านช่องโหว่การรันโค้ดในชุดข้อมูล โดยบริษัทได้ใช้ AI ของตนเองเข้ายับยั้งและวิเคราะห์เหตุการณ์ได้สำเร็จภายในไม่กี่ชั่วโมง
ทำไม DharmaOCR ถึงยังครองแชมป์ภาษาโปรตุเกส แม้คู่แข่งจะออกโมเดลใหม่กว่า?

ทำไม DharmaOCR ถึงยังครองแชมป์ภาษาโปรตุเกส แม้คู่แข่งจะออกโมเดลใหม่กว่า?

· By: AttapolK
DharmaOCR พิสูจน์ให้เห็นว่าความเชี่ยวชาญเฉพาะด้านและการฝึกฝนแบบ DPO ช่วยให้มีประสิทธิภาพเหนือกว่าโมเดลภาษาขนาดใหญ่รุ่นใหม่อย่าง Mistral OCR4 และ Unlimited-OCR ในการประมวลผลเอกสารภาษาโปรตุเกสแบบบราซิล
เจาะลึก Cosmos-Framework จาก NVIDIA: สร้างโมเดลโลกจำลอง Mixture-of-Transformers บน Colab

เจาะลึก Cosmos-Framework จาก NVIDIA: สร้างโมเดลโลกจำลอง Mixture-of-Transformers บน Colab

คู่มือการใช้งาน NVIDIA cosmos-framework ผ่าน Google Colab พร้อมการออกแบบและฝึกฝนโมเดล Mixture-of-Transformers ขนาดเล็กที่รองรับการทำงานแบบ omnimodal ทั้งข้อความ ภาพ และการกระทำ
Google AI Studio เปิดตัวฟีเจอร์ 'Import from GitHub' เปลี่ยน Repository เป็นแอปที่ใช้งานได้จริงทันที

Google AI Studio เปิดตัวฟีเจอร์ 'Import from GitHub' เปลี่ยน Repository เป็นแอปที่ใช้งานได้จริงทันที

· By: NatapolK
Google AI Studio ทยอยอัปเดตฟีเจอร์ใหม่ในโหมด Build ช่วยให้นักพัฒนาสามารถนำโค้ดจาก GitHub มาแปลงเป็นแอปพลิเคชันที่พร้อมพัฒนาต่อและปรับใช้ได้ทันทีโดยอัตโนมัติ
เทคนิค Netflix AI: แก้ปัญหา Read Latency ใน Cassandra จากหลักวินาทีสู่มิลลิวินาทีด้วย Dynamic Partitioning

เทคนิค Netflix AI: แก้ปัญหา Read Latency ใน Cassandra จากหลักวินาทีสู่มิลลิวินาทีด้วย Dynamic Partitioning

วิศวกร Netflix เผยกลยุทธ์การจัดการ Wide Partition ใน Apache Cassandra โดยใช้ระบบแบ่ง Partition ตาม ID อัตโนมัติ ช่วยลดปัญหาคอขวดและเพิ่มความเร็วในการอ่านข้อมูลเหตุการณ์เชิงเวลาได้อย่างมหาศาล
SpaceXAI เปิดตัว Grok 4.5 โมเดลตัวท็อป ชูจุดเด่นงาน Agentic และการเขียนโค้ดร่วมกับ Cursor

SpaceXAI เปิดตัว Grok 4.5 โมเดลตัวท็อป ชูจุดเด่นงาน Agentic และการเขียนโค้ดร่วมกับ Cursor

· By: NatapolK
SpaceXAI เปิดตัว Grok 4.5 โมเดลที่ทรงพลังที่สุดของค่าย เน้นประสิทธิภาพงานเขียนโค้ดและการใช้เหตุผลเชิงเทคนิค โดยครองอันดับ 1 ในเกณฑ์มาตรฐานด้านกฎหมายและประหยัดท็อกเก็นกว่าคู่แข่งหลายเท่า
Robbyant เปิดตัว LingBot-VLA 2.0: โมเดล VLA ขนาด 6B แบบ Open-Source คุมหุ่นยนต์ได้หลากหลายรูปแบบร่าง

Robbyant เปิดตัว LingBot-VLA 2.0: โมเดล VLA ขนาด 6B แบบ Open-Source คุมหุ่นยนต์ได้หลากหลายรูปแบบร่าง

· By: TanasakP
Robbyant จาก Ant Group เปิดตัว LingBot-VLA 2.0 โมเดลควบคุมหุ่นยนต์ข้ามรูปแบบร่างที่ฝึกฝนด้วยข้อมูลกว่า 60,000 ชั่วโมง โดยใช้สถาปัตยกรรม MoE และระบบพื้นที่การสั่งการมาตรฐาน 55 มิติเพื่อรองรับการสั่งงานที่ซับซ้อน
เทียบชั้น Lift จาก Datalab: โมเดล 9B ดึงข้อมูลเอกสารแบบ Schema-first ปะทะคู่แข่งในตลาด

เทียบชั้น Lift จาก Datalab: โมเดล 9B ดึงข้อมูลเอกสารแบบ Schema-first ปะทะคู่แข่งในตลาด

· By: AttapolK
Lift โดย Datalab เป็นโมเดล Vision ขนาด 9B ที่ออกแบบมาเพื่อดึงข้อมูลจาก PDF หรือรูปภาพเป็น JSON ตาม schema ที่กำหนดได้โดยตรงในรอบเดียว ช่วยลดความซับซ้อนของเวิร์กโฟลว์การประมวลผลเอกสารให้รวดเร็วยิ่งขึ้น
← ก่อนหน้าหน้า 43 · 951 ข่าวถัดไป →