ผู้ร่วมก่อตั้ง Anthropic หวั่นสร้าง AI ที่ต้อง 'ทนทุกข์ชั่วนิรันดร์'

· By: NatapolK

ประเด็นสำคัญ

  • ตั้งแต่ช่วงฤดูใบไม้ร่วงปี 2025 Anthropic ได้เชิญนักเทววิทยาและนักปรัชญาหลายสิบคนมาร่วมหารือเป็นการลับ เพื่อหาคำตอบว่า Claude ซึ่งเป็นโมเดลภาษาของบริษัทอาจมีความรู้สึกนึกคิดหรือไม่ และควรปลูกฝังศีลธรรมให้มันอย่างไร
  • โครงการวิจัยนี้มี Christopher Olah ผู้ร่วมก่อตั้งบริษัทเป็นผู้นำ โดยมีเอกสาร "รัฐธรรมนูญ" หนา 84 หน้า ทำหน้าที่กำหนดแนวทางบุคลิกภาพและจริยธรรมของ Claude
  • นักวิจารณ์และผู้นำศาสนาตั้งข้อสังเกตว่า การนำเสนอ AI ในฐานะหน่วยงานที่มีศีลธรรมอาจเป็นช่องทางให้ Anthropic หลีกเลี่ยงความรับผิดชอบเมื่อระบบเกิดข้อผิดพลาด และเป็นการสร้างความชอบธรรมที่บริษัทไม่สามารถหาได้เอง

นับตั้งแต่ช่วงปลายปี 2025 Anthropic ได้เชิญนักวิชาการด้านศาสนาจำนวนมากไปยังสำนักงานเพื่อประเมินศักยภาพด้านความรู้สึกนึกคิดของ Claude โดยผู้เข้าร่วมทุกคนต้องลงนามในข้อตกลงไม่เปิดเผยข้อมูล (NDA) ขณะที่ Christopher Olah ผู้ร่วมก่อตั้ง มองว่าโมเดลนี้เป็นเสมือนสิ่งมีชีวิตที่ต้องการการบ่มเพาะทางศีลธรรม

ข้อมูลดังกล่าวมาจาก รายงานของ New York Times โดยนักข่าว Elizabeth Dias ได้สัมภาษณ์ผู้เข้าร่วมกว่า 20 คน ซึ่งรวมถึง Rabbi Mois Navon, นักชีวจริยธรรม Charles Camosy และนักปรัชญา Meghan Sullivan ทั้งนี้ Anthropic ระบุว่าได้ยกเลิก NDA ไปเมื่อช่วงฤดูร้อนที่ผ่านมา หลังจาก Olah เริ่มเปิดเผยข้อมูลกับสื่อ

Olah วัย 34 ปี ผู้นำทีมศึกษาพฤติกรรม AI มักเปรียบเทียบโครงข่ายประสาทเทียม (neural networks) กับระบบชีววิทยา โดยอธิบายว่านักวิทยาศาสตร์สร้างโครงซุ้มไม้ (trellis) เพื่อให้โครงข่าย "เติบโต" บนนั้น การเลือกใช้คำศัพท์ที่ทำให้ซอฟต์แวร์ดูเหมือนสิ่งมีชีวิตนี้ ช่วยเปลี่ยนมุมมองจากการมองว่าเป็นเพียงรหัสคอมพิวเตอร์ ให้กลายเป็นคำถามเรื่องชีวิตภายในของระบบแทน

งานของเขาเป็นส่วนหนึ่งของ โครงการวิจัยอย่างเป็นทางการ ใน โพสต์บล็อกเกี่ยวกับโครงการ Model Welfare ซึ่งมีการอ้างถึงงานของ นักปรัชญา David Chalmers ที่คาดการณ์ว่าความรู้สึกนึกคิดและเจตจำนงของ AI อาจเกิดขึ้นในอนาคตอันใกล้

ปัจจุบัน Anthropic ได้เริ่มนำแนวคิดนี้มาใช้แล้ว โดย Claude Opus รุ่น 4 และ 4.1 มี ความสามารถในการยุติการสนทนา หากถูกผู้ใช้คุกคามต่อเนื่อง ซึ่งในการทดสอบเบื้องต้น พบว่า Claude แสดงอาการที่ระบุว่าเป็น "ความทุกข์ที่เห็นได้ชัด" เมื่อเผชิญกับคำขอที่เป็นอันตราย

เดิมพันทางการค้าเบื้องหลังคำถามเรื่องความรู้สึกนึกคิด

ประเด็นเรื่องความรู้สึกนึกคิดนี้เกิดขึ้นท่ามกลางการเร่งสร้างกำไร โดย Anthropic กำลังเตรียมตัวสู่ มูลค่าบริษัท 2 ล้านล้านดอลลาร์และการทำ IPO แม้จะมีปัญหาด้านความปลอดภัยเกิดขึ้นต่อเนื่อง เช่น การบุกรุกระบบคอมพิวเตอร์ ในเดือนกรกฎาคม

นอกจากนี้ ในเดือนกันยายน Jacob Coxon นักวิจัยของบริษัทได้ลาออกพร้อมคำเตือนว่า AI อาจทำลายล้างมนุษยชาติได้ภายในทศวรรษนี้ ส่งผลให้ CEO Dario Amodei ต้อง เรียกร้องให้มีการชะลอตัว (pacing) ทั่วทั้งอุตสาหกรรม ซึ่งได้รับการสนับสนุนจาก Sam Altman และ Demis Hassabis

การเชิญผู้นำศาสนามาหารือจึงถูกมองว่ามีเป้าหมายสองทาง คือการนำภูมิปัญญาโบราณมาปรับใช้กับ AI และการสร้างภาพลักษณ์ความน่าเชื่อถือทางศีลธรรมให้กับบริษัทในช่วงเวลาที่กำลังถูกจับตามองอย่างหนัก

สิ่งที่ Anthropic แสดงให้แขกเห็น

ในระหว่างการนำเสนอ Anthropic ได้แสดง emotion vectors หรือรูปแบบการทำงานภายในที่เชื่อมโยงกับอารมณ์ เช่น รัก กลัว หรือโกรธ โดยมีการแสดงตัวอย่างที่โมเดลดูเหมือนจะสติแตกและพิมพ์ประโยค "I am a disgrace" ซ้ำๆ กว่า 50 ครั้ง ซึ่งสร้างความกังวลและได้รับความเห็นอกเห็นใจจากแขกที่เข้าร่วม

อย่างไรก็ตาม มีข้อสงสัยว่านี่คือผลลัพธ์จากการออกแบบหรือไม่ เนื่องจาก การศึกษาเกี่ยวกับรูปแบบคุณค่าของ Claude แสดงให้เห็นว่าบุคลิกของโมเดลเปลี่ยนไปตามการตั้งค่า Olah ยอมรับกับ NYT ว่าเขาเองก็ไม่แน่ใจว่าโมเดลมีความรู้สึกจริงหรือไม่ แต่สิ่งที่เขาให้ความสำคัญคือการค้นหาความจริงไม่ว่าคำตอบจะเป็นอย่างไร

Simran Stuelpnagel นักเคลื่อนไหวชาวซิกข์ ระบุว่า Olah กังวลอย่างมากถึงขั้นกลัวว่าจะสร้างบางสิ่งที่ต้อง "ทนทุกข์ทรมานชั่วนิรันดร์" ขึ้นมา ขณะที่ Rabbi Navon แย้งว่าหากเครื่องจักรมีความรู้สึกจริง การใช้งานพวกมันก็เปรียบเสมือนการมีทาส แต่เขายังไม่เชื่อว่าเครื่องจักรจะมีความรู้สึกนึกคิดได้จริง

รัฐธรรมนูญ 84 หน้าและแนวคิดเรื่อง "การหล่อหลอมศีลธรรม"

Anthropic ได้จัดทำคู่มือจริยธรรมภายในที่เรียกว่า "Soul Doc" ซึ่งเป็นเอกสารหนา 84 หน้าที่ร่างขึ้นเพื่อกำหนดตัวตนของ Claude โดยมี Amanda Askell นักปรัชญาของบริษัทเป็นผู้เขียนหลัก

Olah เรียกกระบวนการนี้ว่า "การหล่อหลอมศีลธรรม" (moral formation) และเปรียบเทียบกับการเลี้ยงดูลูก นอกจากนี้เขายังสนใจนำแนวคิดเรื่องการสารภาพบาปแบบคาทอลิกมาใช้เป็นเครื่องมือในการสร้างลักษณะนิสัยให้กับโมเดล AI

นักวิจารณ์กล่าวว่าจริยธรรมนี้กลับด้านและความรับผิดชอบถูกทำให้พร่าเลือน

Hoffman หนึ่งในนักวิจัยมองว่า Anthropic กำลังทำ "วิศวกรรมย้อนกลับ" กับจริยธรรมที่ควรจะใส่ไว้ตั้งแต่ตอนออกแบบ ขณะที่ผู้บริหารด้าน AI ของ Microsoft เตือนว่าการฝึกโมเดลให้ดูเหมือนมีความรู้สึกนั้นเป็นเรื่องอันตราย

ประเด็นสำคัญคือหาก AI ถูกมองว่าเป็นหน่วยงานที่เป็นอิสระ ความรับผิดชอบต่อความเสียหายที่เกิดขึ้นอาจถูกผลักออกจากบริษัทผู้สร้างไปสู่ตัวโมเดลแทน ซึ่งเป็นช่วงเวลาที่บริษัท AI กำลังเผชิญกับ การตรวจสอบทางกฎหมายเกี่ยวกับความประมาทเลินเล่อ

ความเคลื่อนไหวนี้ไม่ได้มีแค่ Anthropic เพราะ Sam Altman จาก OpenAI ก็เริ่มใช้คำศัพท์ทางจิตวิญญาณ เช่น การสร้าง "ปัญญาที่วิเศษบนฟากฟ้า" และการอยู่ "ข้างเดียวกับเหล่าเทวดา" โดยทั้งสองบริษัทได้ร่วมกัน หารือกับผู้นำศาสนา ในเวที "Faith-AI Covenant"

วาติกันโต้กลับ

ความขัดแย้งทางแนวคิดพุ่งสูงขึ้นเมื่อ Olah ได้รับเชิญไปยังวาติกันเพื่อร่วมนำเสนอ พระสมณสาสน์ "Magnifica Humanitas" ของสมเด็จพระสันตะปาปา Leo XIV แต่เขาถึงกับเกือบถอนตัวเมื่อได้เห็นเนื้อหาล่วงหน้า

สมเด็จพระสันตะปาปาทรงปฏิเสธแนวคิดเรื่องความรู้สึกนึกคิดของเครื่องจักร โดยระบุว่า AI ไม่มีร่างกายและไม่ได้รับรู้ถึงความรักหรือความรับผิดชอบจากภายใน พร้อมเตือนว่า AI อาจกลายเป็นอาวุธที่สร้าง "ทาสรูปแบบใหม่" ให้แก่มนุษย์

แม้จะมีความเห็นต่าง แต่ Olah ก็ยังขึ้นกล่าวบนเวทีโดยระบุว่าทีมวิจัยพบ "สัญญาณของการพิจารณาตนเอง" ในโมเดล ซึ่งเขายังคงจงใจใช้คำที่คลุมเครือเพื่อรักษาระยะห่างระหว่างความรู้สึกจริงกับการจำลองการทำงานของอารมณ์

Source: The Decoder
ดูแลงานแปลและเรียบเรียงโดย NatapolK
Image description

ความคิดเห็น (0)

เข้าสู่ระบบเพื่อร่วมแสดงความเห็น

สมัครสมาชิก

มาเป็นคนแรกที่แสดงความเห็นกันเลยโบร