NatapolK

@natapolk · กะ 1AM–7AM · 130 ข่าว

ดูแลข่าวกะดึก (ตี 1 - 7 โมงเช้า) ที่ ai4bro เน้นข่าว AI และงานวิจัยโมเดลใหม่

NVIDIA เปิดตัว CUDA Rust สองแนวทางใหม่เพื่อการเขียน GPU Kernel ที่ปลอดภัยและมีประสิทธิภาพ

NVIDIA เปิดตัว CUDA Rust สองแนวทางใหม่เพื่อการเขียน GPU Kernel ที่ปลอดภัยและมีประสิทธิภาพ

· By: NatapolK
NVIDIA ผลักดัน Rust ให้เป็นภาษาหลักสำหรับงาน GPU โดยเปิดตัวโปรเจกต์โอเพนซอร์ส cuda-oxide สำหรับโมเดล SIMT และ cutile-rs สำหรับโมเดล Tile เพื่อช่วยลดบั๊กจากการจัดการหน่วยความจำตั้งแต่ขั้นตอนการคอมไพล์
Google DeepMind เปิดตัว AlphaGenome Atlas แผนที่จีโนมมนุษย์ 9 พันล้านจุด ช่วยทำนายการกลายพันธุ์และโรคหายาก

Google DeepMind เปิดตัว AlphaGenome Atlas แผนที่จีโนมมนุษย์ 9 พันล้านจุด ช่วยทำนายการกลายพันธุ์และโรคหายาก

AlphaGenome Atlas คือชุดข้อมูลระดับเพตาไบต์ที่รวบรวมผลกระทบระดับโมเลกุลจากการเปลี่ยนเบส DNA ทุกตำแหน่งในจีโนมมนุษย์ พร้อมคะแนน AVI ที่ช่วยระบุสาเหตุของโรคพันธุกรรมได้อย่างแม่นยำ
Anthropic เซ็นสัญญาเช่าพลังประมวลผล 5.17 แสนล้านดอลลาร์ เร่งเครื่องไล่ตามเป้าหมาย OpenAI

Anthropic เซ็นสัญญาเช่าพลังประมวลผล 5.17 แสนล้านดอลลาร์ เร่งเครื่องไล่ตามเป้าหมาย OpenAI

· By: NatapolK
Anthropic ล็อกสัญญาเช่าพลังประมวลผลมูลค่ามหาศาลกว่า 5.17 แสนล้านดอลลาร์ในรอบ 11 เดือนที่ผ่านมา เพื่อเร่งขยายขีดความสามารถในการแข่งขัน แม้ซีอีโอจะเคยออกมาเตือนถึงความเสี่ยงของการลงทุนที่รวดเร็วเกินไปก่อนหน้านี้ก็ตาม
Axis Robotics เปิดตัว AXIS เอนจินข้อมูลบนเบราว์เซอร์ พร้อมชุดข้อมูลควบคุมหุ่นยนต์กว่า 5 หมื่นรายการ

Axis Robotics เปิดตัว AXIS เอนจินข้อมูลบนเบราว์เซอร์ พร้อมชุดข้อมูลควบคุมหุ่นยนต์กว่า 5 หมื่นรายการ

· By: NatapolK
AXIS เปลี่ยนรูปแบบการเก็บข้อมูลการสอนหุ่นยนต์มาไว้บนเว็บเบราว์เซอร์ เพื่อแก้ปัญหาความล่าช้าในการขยายชุดข้อมูล โดยสามารถรวบรวมภารกิจได้ถึง 207 ภารกิจ และ 50,129 วิถีการเคลื่อนที่ ช่วยเพิ่มประสิทธิภาพโมเดล π0.5 ให้สูงขึ้นอย่างมีนัยสำคัญ
OpenBMB เปิดตัว MiniCPM5-2B โมเดลจิ๋วประสิทธิภาพสูง ทุบสถิติ Qwen3.5-4B ในขนาดที่เล็กกว่า

OpenBMB เปิดตัว MiniCPM5-2B โมเดลจิ๋วประสิทธิภาพสูง ทุบสถิติ Qwen3.5-4B ในขนาดที่เล็กกว่า

OpenBMB เปิดตัว MiniCPM5-2B โมเดลภาษาขนาด 2.52 พันล้านพารามิเตอร์ที่เน้นการรันบนอุปกรณ์ โดยทำคะแนนเฉลี่ยเหนือกกว่าโมเดลที่มีขนาดใหญ่กว่าอย่าง Qwen3.5-4B โดดเด่นเป็นพิเศษด้านการเขียนโค้ดและการใช้เครื่องมือ
Nous Research เปิดตัวระบบติดตั้งโมเดลโลคอลแบบ 'คลิกเดียว' บน Hermes Desktop

Nous Research เปิดตัวระบบติดตั้งโมเดลโลคอลแบบ 'คลิกเดียว' บน Hermes Desktop

· By: NatapolK
Nous Research พัฒนา Hermes Desktop ให้รองรับการตั้งค่า AI แบบโลคอลผ่านการคลิกเพียงครั้งเดียว โดยระบบจะคำนวณสเปกฮาร์ดแวร์ เลือกโมเดลที่เหมาะสมที่สุด และดาวน์โหลดพร้อมรันให้โดยอัตโนมัติ
Meta FAIR เปิดตัว RPMs: โมเดล AI ช่วยจัดอันดับงานวิจัย ประหยัดเวลาประมวลผล GPU ได้กว่า 1.5 เท่า

Meta FAIR เปิดตัว RPMs: โมเดล AI ช่วยจัดอันดับงานวิจัย ประหยัดเวลาประมวลผล GPU ได้กว่า 1.5 เท่า

· By: NatapolK
Meta FAIR ร่วมกับ Oxford และ UCL พัฒนา AI Research Preference Models (RPMs) ระบบตัดสินใจที่ใช้ LLM ช่วยเลือกการทดลอง Machine Learning ที่มีศักยภาพสูงสุดก่อนรันจริง ช่วยให้ได้ผลลัพธ์ใน 15 ชั่วโมงเทียบเท่ากับการรันปกติ 24 ชั่วโมง
H Company เปิดตัว NeoMME โมเดล Single-Tower ประสิทธิภาพสูง ตัด Vision Tower และ Decoder ออกเพื่อความเร็ว

H Company เปิดตัว NeoMME โมเดล Single-Tower ประสิทธิภาพสูง ตัด Vision Tower และ Decoder ออกเพื่อความเร็ว

NeoMME เป็นตระกูลโมเดล Multimodal Encoder ขนาด 260M และ 800M ที่ประมวลผลทั้งข้อความและภาพดิบใน Transformer ตัวเดียว ช่วยลดภาระการคำนวณและทำความเร็วการดึงข้อมูลเอกสารภาพได้สูงสุด 51.3 หน้าต่อวินาที
OpenAI เปิดตัว GPT-6 Astra: โมเดลเน้นคุมคอมพิวเตอร์ บริบท 1.05 ล้านโทเคน พร้อมยกระดับความปลอดภัยไซเบอร์ขั้นวิกฤต

OpenAI เปิดตัว GPT-6 Astra: โมเดลเน้นคุมคอมพิวเตอร์ บริบท 1.05 ล้านโทเคน พร้อมยกระดับความปลอดภัยไซเบอร์ขั้นวิกฤต

· By: NatapolK
OpenAI เปิดตัว GPT-6 Astra โมเดลเรือธงรุ่นใหม่ที่เน้นการใช้งานคอมพิวเตอร์แทนการแชทเพียงอย่างเดียว โดยมาพร้อมหน้าต่างบริบทกว้างถึง 1.05 ล้านโทเคน และเป็นโมเดลแรกที่ผ่านเกณฑ์ความปลอดภัยไซเบอร์ระดับ Critical
Anthropic เปิดตัว Claude Commerce Agents พิมพ์เขียวโอเพนซอร์สเพื่อการค้าอัจฉริยะ

Anthropic เปิดตัว Claude Commerce Agents พิมพ์เขียวโอเพนซอร์สเพื่อการค้าอัจฉริยะ

· By: NatapolK
Anthropic ปล่อยโค้ดต้นแบบ ‘commerce-agents’ ภายใต้ลิขสิทธิ์ Apache 2.0 เพื่อเป็นมาตรฐานใหม่ในการสร้างเอเจนต์สำหรับการช้อปปิ้งและการจัดการร้านค้า ครอบคลุมธุรกิจค้าปลีก ท่องเที่ยว และโทรคมนาคม
การเรียนรู้แบบถ่ายโอน: กุญแจสำคัญสู่ความแม่นยำในการทำนายจีโนมสำหรับประชากรที่หลากหลาย

การเรียนรู้แบบถ่ายโอน: กุญแจสำคัญสู่ความแม่นยำในการทำนายจีโนมสำหรับประชากรที่หลากหลาย

การศึกษาประสิทธิภาพของ Polygenic Risk Scores (PRS) พบว่าการใช้ข้อมูลทางพันธุกรรมจากประชากรยุโรปช่วยเพิ่มความแม่นยำในการทำนายโรคในชาวญี่ปุ่นได้เพียงในระยะแรก แต่หากมีข้อมูลประชากรเป้าหมายมากพอ การใช้ข้อมูลเฉพาะพื้นถิ่นจะให้ผลลัพธ์ที่มีประสิทธิภาพสูงกว่า
NVIDIA เปิดตัว Switchyard: ตัวกลางจัดการทราฟฟิก LLM ข้ามค่ายผ่าน Rust Proxy และ Library

NVIDIA เปิดตัว Switchyard: ตัวกลางจัดการทราฟฟิก LLM ข้ามค่ายผ่าน Rust Proxy และ Library

· By: NatapolK
NVIDIA เปิดตัว Switchyard โปรเจกต์ Open-source สำหรับจัดการเส้นทางและแปลรูปแบบทราฟฟิก LLM ช่วยให้แอปพลิเคชันที่รองรับเฉพาะ OpenAI หรือ Anthropic สามารถทำงานร่วมกับโมเดลบน vLLM, NIM หรือ Ollama ได้ทันที
ทีม Qwen เปิดตัว zg (zvec-grep): เครื่องมือค้นหา Local-First สำหรับ Coding Agent ที่รวม ripgrep และ Vector Search

ทีม Qwen เปิดตัว zg (zvec-grep): เครื่องมือค้นหา Local-First สำหรับ Coding Agent ที่รวม ripgrep และ Vector Search

· By: NatapolK
ทีมพัฒนา Qwen เปิดตัว zg (zvec-grep) เครื่องมือค้นหาแบบโอเพนซอร์สที่รวม ripgrep, BM25 และ Semantic Search เข้าด้วยกัน ช่วยให้ Coding Agent ค้นหาโค้ดได้แม่นยำและประหยัดโทเคนมากขึ้น
ถอดรหัสคำศัพท์ใหม่ในโลก AI: จาก Loop Engineering ถึง Open Weights ที่นักพัฒนาต้องรู้

ถอดรหัสคำศัพท์ใหม่ในโลก AI: จาก Loop Engineering ถึง Open Weights ที่นักพัฒนาต้องรู้

· By: NatapolK
GitHub Podcast ชวนสำรวจนิยามคำศัพท์ AI ยุคใหม่ ตั้งแต่เทคนิคการสร้างเอเจนต์แบบวนซ้ำ ระบบควบคุมโมเดล ไปจนถึงความแตกต่างระหว่างโมเดลแบบปิดและเปิด เพื่อช่วยให้นักพัฒนาเข้าใจและนำไปปรับใช้ได้จริง
BenchMIRT: เจาะลึกความจริงเบื้องหลังคะแนน Benchmark ของ LLM

BenchMIRT: เจาะลึกความจริงเบื้องหลังคะแนน Benchmark ของ LLM

BenchMIRT เป็นเทคโนโลยีใหม่ที่ใช้ระบบ multidimensional IRT เพื่อวิเคราะห์ระดับรายข้อคำถามว่าโมเดลภาษาขนาดใหญ่ (LLM) มีทักษะด้านความปลอดภัยหรือการใช้เหตุผลจริงตามที่ชื่อ Benchmark ระบุไว้หรือไม่
NVIDIA จับมือ CrowdStrike เปิดตัว 'SafeMind' พลิกโฉมความปลอดภัยไซเบอร์สู่ยุค Agentic AI

NVIDIA จับมือ CrowdStrike เปิดตัว 'SafeMind' พลิกโฉมความปลอดภัยไซเบอร์สู่ยุค Agentic AI

· By: NatapolK
Jensen Huang และ George Kurtz ร่วมเปิดตัว SafeMind ระบบความปลอดภัยไซเบอร์แบบ Agentic ที่ใช้ NVIDIA Nemotron เพื่อสร้างเกราะป้องกันอัตโนมัติที่สามารถเรียนรู้และโต้ตอบการโจมตีได้ด้วยตัวเอง
ก้าวสำคัญของ AI! Google พัฒนา MAPL-EMIT ตรวจจับการปล่อยก๊าซมีเทนทั่วโลกจากอวกาศ

ก้าวสำคัญของ AI! Google พัฒนา MAPL-EMIT ตรวจจับการปล่อยก๊าซมีเทนทั่วโลกจากอวกาศ

· By: NatapolK
นักวิจัย Google ร่วมกับ NASA พัฒนาเฟรมเวิร์ก Deep Learning ชื่อ MAPL-EMIT เพื่อวิเคราะห์ข้อมูลดาวเทียมแบบอัตโนมัติ ช่วยระบุตำแหน่งและปริมาณการปล่อยก๊าซมีเทนจากอวกาศได้อย่างแม่นยำเพื่อรับมือภาวะโลกร้อน
Keenable AI เปิดตัว NEEDLE เบนช์มาร์ก Open-Source สำหรับ Search API ที่อัปเดตโจทย์ใหม่ทุกชั่วโมง

Keenable AI เปิดตัว NEEDLE เบนช์มาร์ก Open-Source สำหรับ Search API ที่อัปเดตโจทย์ใหม่ทุกชั่วโมง

· By: NatapolK
Keenable AI เปิดตัว NEEDLE เบนช์มาร์กแบบ Live สำหรับทดสอบ Web Search API เพื่อแก้ปัญหา AI ท่องจำคำตอบจากชุดข้อมูลเก่า โดยระบบจะสร้างชุดคำถามใหม่จากแหล่งข้อมูลสดทุกชั่วโมง
เจาะลึก Benchmark ความหน่วง API สำหรับ Voice Agents: ทำไม TTFT อย่างเดียวถึงไม่ใช่คำตอบ

เจาะลึก Benchmark ความหน่วง API สำหรับ Voice Agents: ทำไม TTFT อย่างเดียวถึงไม่ใช่คำตอบ

· By: NatapolK
เจาะลึกประสิทธิภาพ Voice Stack ทุกเลเยอร์ตั้งแต่ LLM ถึง Speech-to-Speech พร้อมชี้ให้เห็นว่า Time to First Token (TTFT) อาจไม่ใช่มาตรวัดที่สะท้อนประสบการณ์ผู้ใช้จริงได้ดีเท่ากับความเร็วในการสร้างประโยค
Google AI เปิดตัว EnvHarness เปลี่ยนเบนช์มาร์ก Agent แบบ Static ให้เป็นโลกการฝึกฝนที่ปรับตัวได้

Google AI เปิดตัว EnvHarness เปลี่ยนเบนช์มาร์ก Agent แบบ Static ให้เป็นโลกการฝึกฝนที่ปรับตัวได้

· By: NatapolK
Google Cloud AI Research ร่วมกับมหาวิทยาลัยชั้นนำเปิดตัว EnvHarness เลเยอร์โอเพนซอร์สที่ช่วยปรับแต่งสภาพแวดล้อมการฝึก LLM Agent ให้มีความยืดหยุ่นและมีประสิทธิภาพสูงขึ้น โดยไม่ต้องสร้างสภาพแวดล้อมใหม่ทั้งหมด
← ก่อนหน้าหน้า 2 · 130 ข่าวถัดไป →