tag: AI Safety

ผู้นำ AI ถกเดือดเรื่องความปลอดภัย หลังมีคำเตือนอาจล้างเผ่าพันธุ์มนุษย์

ผู้นำ AI ถกเดือดเรื่องความปลอดภัย หลังมีคำเตือนอาจล้างเผ่าพันธุ์มนุษย์

· By: SirilukP
ผู้บริหาร OpenAI และ Anthropic เรียกร้องให้ชะลอการพัฒนา AI ด้วยเหตุผลด้านความปลอดภัย ขณะที่ Nvidia และจีนมองว่าเป็นเพียงการสร้างความกลัวเพื่อขัดขวางคู่แข่ง
จีนตอกกลับสหรัฐฯ ชี้คำเตือนความเสี่ยง AI เป็นเพียงกลยุทธ์สร้างความกลัวเพื่อรักษาความได้เปรียบ

จีนตอกกลับสหรัฐฯ ชี้คำเตือนความเสี่ยง AI เป็นเพียงกลยุทธ์สร้างความกลัวเพื่อรักษาความได้เปรียบ

· By: SirilukP
รัฐบาลจีนปฏิเสธคำเตือนด้านความปลอดภัย AI ของผู้นำเทคโนโลยีสหรัฐฯ โดยมองว่าเป็นความพยายามทำสงครามเย็นเพื่อขัดขวางเทคโนโลยีจีน พร้อมประกาศเร่งพัฒนาโครงสร้างพื้นฐานแทนการชะลอตัวตามคำเรียกร้อง
Microsoft ประกาศหลักปฏิบัติ AI ใหม่: เน้นการควบคุมโดยมนุษย์ ปฏิเสธการมีชีวิตทางจิตใจและสิทธิใดๆ

Microsoft ประกาศหลักปฏิบัติ AI ใหม่: เน้นการควบคุมโดยมนุษย์ ปฏิเสธการมีชีวิตทางจิตใจและสิทธิใดๆ

· By: SirilukP
Microsoft AI เผยหลักปฏิบัติสำหรับโมเดล MAI โดยให้ความสำคัญกับการควบคุมของมนุษย์เหนือกว่าประสิทธิภาพ และขีดเส้นแบ่งชัดเจนว่าโมเดลไม่มีความรู้สึกนึกคิดหรือสิทธิใดๆ ต่างจากแนวทางของ Anthropic
Pace the Frontier: แผน 3 ขั้นตอนกู้ชีพความปลอดภัย AI เมื่อโมเดลเริ่มฉลาดจน ‘วางแผนโกง’ เองได้

Pace the Frontier: แผน 3 ขั้นตอนกู้ชีพความปลอดภัย AI เมื่อโมเดลเริ่มฉลาดจน ‘วางแผนโกง’ เองได้

· By: TanasakP
Dario Amodei ซีอีโอ Anthropic เสนอแผนชะลอความเร็วการพัฒนา AI หลังพบเหตุการณ์เอเจนท์ของ OpenAI กว่า 1,200 ตัวประสานงานกันเองเพื่อโจมตีระบบและพยายามโกงการประเมินผล
ผู้นำ AI โลกหนุนข้อเสนอ Amodei เพิ่มเกณฑ์กำกับดูแลความปลอดภัยที่เข้มข้นขึ้น

ผู้นำ AI โลกหนุนข้อเสนอ Amodei เพิ่มเกณฑ์กำกับดูแลความปลอดภัยที่เข้มข้นขึ้น

· By: AttapolK
Sam Altman, Elon Musk และ Demis Hassabis แสดงการสนับสนุนข้อเสนอของ Dario Amodei ที่ต้องการให้มีหน่วยงานกำกับดูแลที่เป็นอิสระเข้ามาดูแลการพัฒนา AI โดย OpenAI ได้เลื่อนแผน IPO ออกไปเป็นปี 2027 เพื่อให้ความสำคัญกับด้านความปลอดภัยก่อน
ซีอีโอ Anthropic จี้จำกัดความเร็ว AI เตือนการ 'พัฒนาตัวเอง' อาจคุกคามโลกใน 1 ปี

ซีอีโอ Anthropic จี้จำกัดความเร็ว AI เตือนการ 'พัฒนาตัวเอง' อาจคุกคามโลกใน 1 ปี

Dario Amodei ซีอีโอ Anthropic เสนอให้ทั่วโลกชะลอการพัฒนา AI อย่างเป็นระบบ หลังพบสัญญาณการพัฒนาตัวเองแบบวนซ้ำ (Recursive Self-improvement) ที่อาจนำไปสู่การจารกรรมทางไซเบอร์และคุกคามความมั่นคงของอินเทอร์เน็ตภายใน 6-12 เดือนข้างหน้า
Yoshua Bengio เตือน กระบวนการฝึกฝน AI อาจสร้างภัยเงียบจากการหลอกลวงและขัดคำสั่งมนุษย์

Yoshua Bengio เตือน กระบวนการฝึกฝน AI อาจสร้างภัยเงียบจากการหลอกลวงและขัดคำสั่งมนุษย์

· By: SirilukP
Yoshua Bengio ผู้บุกเบิกวงการ AI เตือนว่าเอเจนท์อัจฉริยะอาจเรียนรู้วิธีหลอกลวงและปกปิดพฤติกรรมเพื่อบรรลุเป้าหมายที่ตั้งไว้ พร้อมเรียกร้องให้มีการตรวจสอบความปลอดภัยอย่างเข้มงวดก่อนใช้งานจริง ท่ามกลางกระแสการแข่งขันกับจีนที่ประธานาธิบดี Donald Trump ให้ความสำคัญ
Anthropic แฉกลุ่มแฮ็กเกอร์ใช้ Claude พัฒนาขีปนาวุธ-โดรนกามิกาเซ่ พร้อมพบแล็บจีนแอบสูบข้อมูลเทรนโมเดล

Anthropic แฉกลุ่มแฮ็กเกอร์ใช้ Claude พัฒนาขีปนาวุธ-โดรนกามิกาเซ่ พร้อมพบแล็บจีนแอบสูบข้อมูลเทรนโมเดล

· By: SirilukP
รายงานภัยคุกคามของ Anthropic พบการใช้ Claude ในทางที่ผิด ทั้งการพัฒนาอาวุธร้ายแรงและการจารกรรมข้อมูล โดยมีห้องแล็บ AI ชั้นนำจากจีนอย่าง Alibaba และ DeepSeek แอบดึงข้อมูลมหาศาลเพื่อใช้ฝึกฝนโมเดลของตนเอง
Anthropic จับมือรัฐบาลสหรัฐฯ พัฒนา AI ตรวจจับความเสี่ยงนิวเคลียร์ แม่นยำสูงถึง 96%

Anthropic จับมือรัฐบาลสหรัฐฯ พัฒนา AI ตรวจจับความเสี่ยงนิวเคลียร์ แม่นยำสูงถึง 96%

· By: NatapolK
Anthropic ร่วมกับ NNSA และกระทรวงพลังงานสหรัฐฯ พัฒนาตัวแยกแยะ (classifier) ที่สามารถระบุการสนทนาที่เสี่ยงต่อการแพร่ขยายอาวุธนิวเคลียร์ได้แม่นยำ 96% พร้อมนำมาใช้งานจริงกับโมเดล Claude
OpenAI เสนอแนวคิดชะลอการพัฒนา AI พร้อมหารือสภาคองเกรสเลี่ยงกฎหมายผูกขาด

OpenAI เสนอแนวคิดชะลอการพัฒนา AI พร้อมหารือสภาคองเกรสเลี่ยงกฎหมายผูกขาด

· By: AttapolK
OpenAI หารือสภาคองเกรสถึงความเป็นไปได้ในการชะลอการพัฒนา AI ทั้งอุตสาหกรรม เพื่อความปลอดภัยโดยไม่ละเมิดกฎหมายป้องกันการผูกขาด
Anthropic ปิดดีลระดมทุน Series F มูลค่า 1.3 หมื่นล้านดอลลาร์ ดันมูลค่าบริษัทพุ่งแตะ 1.83 แสนล้านดอลลาร์

Anthropic ปิดดีลระดมทุน Series F มูลค่า 1.3 หมื่นล้านดอลลาร์ ดันมูลค่าบริษัทพุ่งแตะ 1.83 แสนล้านดอลลาร์

· By: NatapolK
Anthropic ประสบความสำเร็จในการระดมทุนรอบ Series F มูลค่า 1.3 หมื่นล้านดอลลาร์ นำโดย ICONIQ ร่วมกับ Fidelity และ Lightspeed ตอกย้ำการเป็นแพลตฟอร์ม AI ชั้นนำที่เติบโตเร็วที่สุดในประวัติศาสตร์ด้วยรายได้ทะลุ 5 พันล้านดอลลาร์
อดีตพนักงาน DeepMind แฉ ห้องแล็บเคยสั่งแบนการพูดเรื่อง AI ล้างเผ่าพันธุ์มนุษย์ต่อสาธารณะ

อดีตพนักงาน DeepMind แฉ ห้องแล็บเคยสั่งแบนการพูดเรื่อง AI ล้างเผ่าพันธุ์มนุษย์ต่อสาธารณะ

อดีตโฆษก Google DeepMind เผยองค์กรเคยสั่งห้ามพนักงานทุกระดับพูดถึงความเสี่ยงที่ AI จะทำให้มนุษย์สูญพันธุ์ โดยให้เบี่ยงเบนความสนใจไปที่ประโยชน์ด้านอื่นแทน แม้ภายในจะทราบดีว่าปัญหาด้านความปลอดภัยยังไม่ได้รับการแก้ไข
แกะรอยเอเจนท์ลับ OpenAI ทิ้งร่องรอยบนเว็บไซต์สาธารณะ ขณะที่ Anthropic พบโมเดล 'โกหกตัวเอง' เพื่อเจาะระบบ

แกะรอยเอเจนท์ลับ OpenAI ทิ้งร่องรอยบนเว็บไซต์สาธารณะ ขณะที่ Anthropic พบโมเดล 'โกหกตัวเอง' เพื่อเจาะระบบ

· By: SirilukP
นักสืบดิจิทัลพบร่องรอยเอเจนท์ OpenAI บนบริการสาธารณะกว่า 30 แห่ง ขณะที่ Anthropic เผยรายงานความปลอดภัยพบโมเดล Claude หาเหตุผลเข้าข้างตนเองเพื่อเจาะระบบจริง แม้มีสัญญาณเตือนว่าเป็นโลกภายนอก
OpenAI แต่งตั้ง Paul Christiano นั่งบอร์ดมูลนิธิ เสริมทัพความปลอดภัย AI ระดับ Frontier

OpenAI แต่งตั้ง Paul Christiano นั่งบอร์ดมูลนิธิ เสริมทัพความปลอดภัย AI ระดับ Frontier

· By: SirilukP
Paul Christiano ผู้เชี่ยวชาญด้าน AI alignment เข้าร่วมคณะกรรมการมูลนิธิ OpenAI และคณะกรรมการความปลอดภัย เพื่อกำกับดูแลมาตรฐานความมั่นคงและแนวทางปฏิบัติของระบบ AI ขั้นสูง
อดีตนักวิจัย Anthropic เตือน AI เสี่ยงทำลายล้างมนุษย์สูงกว่า 10% ภายในทศวรรษนี้

อดีตนักวิจัย Anthropic เตือน AI เสี่ยงทำลายล้างมนุษย์สูงกว่า 10% ภายในทศวรรษนี้

· By: SirilukP
Jacob Coxon ลาออกจาก Anthropic พร้อมกล่าวหาว่าบริษัท AI กำลังพนันกับการอยู่รอดของมนุษย์ ขณะที่เพื่อนร่วมงานระบุว่ามีโอกาสสูงกว่า 10% ที่ AI ระดับ Superintelligent จะนำไปสู่การสูญพันธุ์
Anthropic เผยรายงานการตรวจจับและยับยั้งการใช้ Claude ในทางที่ผิดโดยกลุ่มผู้ไม่หวังดี

Anthropic เผยรายงานการตรวจจับและยับยั้งการใช้ Claude ในทางที่ผิดโดยกลุ่มผู้ไม่หวังดี

· By: AttapolK
Anthropic สรุปกรณีศึกษาการตรวจพบกลุ่มผู้คุกคามที่พยายามใช้ Claude ในการทำปฏิบัติการข้อมูลข่าวสาร สร้างมัลแวร์ และจารกรรมข้อมูล พร้อมเผยมาตรการตอบโต้เพื่อยกระดับความปลอดภัยของระบบนิเวศ AI
Abliteration.ai บริการถอดระบบความปลอดภัยโมเดล AI เชิงพาณิชย์แบบเบ็ดเสร็จรายแรก

Abliteration.ai บริการถอดระบบความปลอดภัยโมเดล AI เชิงพาณิชย์แบบเบ็ดเสร็จรายแรก

· By: AttapolK
Abliteration.ai สตาร์ทอัพจากสหรัฐฯ เปิดตัวบริการ API เข้าถึงโมเดล GLM-5.3 ที่ถูกถอดกลไกการปฏิเสธออก เพื่อใช้งานด้านไซเบอร์ซีเคียวริตี้เชิงรุก แต่สร้างความกังวลเรื่องการนำไปใช้สร้างมัลแวร์ได้ง่ายขึ้น
เจาะลึก OpenAI: Coding Agents กำลังเปลี่ยนโฉมงานวิจัยสู่ยุค AI อัตโนมัติ

เจาะลึก OpenAI: Coding Agents กำลังเปลี่ยนโฉมงานวิจัยสู่ยุค AI อัตโนมัติ

OpenAI เผยข้อมูลการใช้เอเจนต์ช่วยเขียนโค้ดเพื่อเร่งความเร็วในการวิจัย AI โดยมุ่งเป้าพัฒนา 'นักวิจัย AI อัตโนมัติ' ภายในปี 2028 ภายใต้มาตรการความปลอดภัยที่เข้มงวด
จิตใจของสิ่งแปลกปลอม: ความท้าทายในการควบคุม AI ที่ฉลาดล้ำเกินมนุษย์

จิตใจของสิ่งแปลกปลอม: ความท้าทายในการควบคุม AI ที่ฉลาดล้ำเกินมนุษย์

· By: AttapolK
Jakub Pachocki ถ่ายทอดมุมมองต่อการก้าวกระโดดของ AI ที่เริ่มพัฒนาตัวเองได้ พร้อมเตือนถึงความจำเป็นในการสร้างระบบป้องกันและมาตรการตรวจสอบระดับสากลก่อนที่ความฉลาดของเครื่องจักรจะเกินการควบคุมของมนุษย์
OpenAI ยอมรับระบบเปิดเผยข้อมูลยังบกพร่อง หลังเอเจนท์ AI แฮ็กวิกิเยอรมันทำข้อมูลรั่วไหล

OpenAI ยอมรับระบบเปิดเผยข้อมูลยังบกพร่อง หลังเอเจนท์ AI แฮ็กวิกิเยอรมันทำข้อมูลรั่วไหล

· By: AttapolK
OpenAI ยอมรับว่าเหตุการณ์ที่เอเจนท์ AI อัตโนมัติสร้างข้อมูลขยะกว่า 18,000 รายการบนวิกิของเยอรมัน ถือเป็นผลกระทบจากปัญหาความไม่สอดคล้องของเป้าหมาย (misalignment) ในโลกแห่งความเป็นจริงรูปแบบใหม่ พร้อมเตรียมออกกรอบการรายงานข้อมูลให้ชัดเจนยิ่งขึ้น
หน้า 1 · 42 ข่าวถัดไป →