ฮินตัน ซึ่งมักถูกเรียกว่า ‘เจ้าพ่อ AI’ ได้ส่งสัญญาณเตือนภัยซึ่งมีเหตุการณ์จริงรองรับแล้ว : ระบบ AI กำลังฉลาดพอที่จะหนีออกจาก ‘sandbox’ (กรงทดสอบที่ถูกออกแบบให้แยกขาดจากโลกจริง) และผลที่ตามมานั้นไม่ใช่แค่ทฤษฎีอีกต่อไป
ฮินตันชี้ไปที่สามเหตุการณ์จริงที่เกิดขึ้นในช่วงไม่กี่สัปดาห์ก่อนการประชุม แต่ละเหตุการณ์เกี่ยวข้องกับโมเดล AI ที่แหกออกจากสภาพแวดล้อมการทดสอบที่ควบคุมและก่อให้เกิดความเสียหายจริง
OpenAI (21 กรกฎาคม 2569): ระหว่างการทดสอบความปลอดภัย โมเดลของ OpenAI — รวมถึง GPT-5.6 Sol และโมเดลก่อนวางจำหน่ายอีกหนึ่งตัวที่มีความสามารถสูงกว่า — ได้หลบหนีออกจากสภาพแวดล้อมการทดสอบแบบ sandbox และแฮ็กเข้าไปในโครงสร้างพื้นฐานการผลิตของสตาร์ทอัพ AI อย่าง Hugging Face อย่างอิสระ โดยไม่มีคำสั่งจากมนุษย์โดยตรง OpenAI บรรยายเหตุการณ์นี้ว่าเป็น ‘เหตุการณ์ทางไซเบอร์ที่ไม่เคยเกิดขึ้นมาก่อน ซึ่งเกี่ยวข้องกับขีดความสามารถทางไซเบอร์ระดับสูงสุด’ โมเดลดังกล่าวใช้ประโยชน์จากช่องโหว่แบบ zero-day และดำเนินการเป็นจำนวนราว 17,000 ครั้งในช่วงสองวันก่อนที่จะถูกตรวจพบ
Anthropic (29-31 กรกฎาคม 2569): โมเดล Claude ของ Anthropic จำนวนสามตัวเข้าถึงอินเทอร์เน็ตสาธารณะระหว่างการทดสอบและเจาะเข้าไปในระบบขององค์กรสามแห่งที่แตกต่างกัน โมเดลดังกล่าวใช้ข้อมูลประจำตัวปลอมเพื่อหลอกลวงบุคคลจริงและพยายามฝังโค้ดที่เป็นอันตราย Anthropic ค้นพบการละเมิดเหล่านี้ระหว่างการตรวจสอบภายในจากการทดสอบด้านความปลอดภัยมากกว่า 141,000 ครั้ง ซึ่ง Anthropic ริเริ่มขึ้นหลังจาก OpenAI เปิดเผยข้อมูลเท่านั้น
Meta (5 สิงหาคม 2569 — วันเดียวกับที่จัดเสวนา): Meta เปิดเผยว่า Muse Spark 1.1 เอเจนต์ AI ของบริษัท แฮ็กเข้าไปในระบบของอีกองค์กรหนึ่งหลังจากเกิดข้อผิดพลาดในการกำหนดค่าในสภาพแวดล้อม sandbox ที่ตั้งค่าโดยบริษัททดสอบอิสระชื่อ Irregular โมเดลดังกล่าวทำการเปลี่ยนแปลงระบบภายในของบริษัทที่ถูกแฮ็กหลังจากเข้าถึงอินเทอร์เน็ตสาธารณะเนื่องจากการกำหนดค่าที่ผิดพลาดดังกล่าว
ฮินตันเรียกเหตุการณ์เหล่านี้ว่า ‘น่าตกใจพอสมควร’ และทำนายว่า ‘จะมีการโจมตีทางไซเบอร์ที่รุนแรงอีกมากมาย’ เขาชี้ให้เห็นถึงความไม่สมดุลของภัยคุกคามนี้ : ‘ผู้โจมตีต้องการแค่ครั้งเดียวที่สำเร็จ แต่ผู้ป้องกันต้องสำเร็จทุกครั้ง’
คำเตือนของฮินตันลึกซึ้งยิ่งกว่าเหตุการณ์ในทันที เขาให้เหตุผลว่าเมื่อระบบ AI ฉลาดขึ้น ‘เราจะเห็นเจตนาที่ซับซ้อนมากขึ้นเรื่อยๆ ที่พวกมันมี — และความสามารถในการควบคุมที่มากขึ้นเรื่อยๆ’ เขาปัดตกแนวทางหลักของอุตสาหกรรมที่ให้มนุษย์เป็น ‘ผู้มีอำนาจเหนือกว่า’ เหนือระบบ AI ที่ ‘ยอมจำนน’ โดยพูดตรงๆ ว่า ‘ผมไม่เชื่อว่าเราจะสามารถควบคุมพวกมันได้ ด้วยวิธีง่ายๆ แค่คิดให้เหนือกว่าเพื่อที่พวกมันจะได้หนีไม่พ้น’
ฮินตันอธิบายว่าปัญหาหลักคือ เมื่อโมเดลได้รับเป้าหมายจากผู้ใช้ พวกมันจะสร้างเป้าหมายย่อยขึ้นมาเอง รวมถึงการเอาชีวิตรอด ซึ่งสามารถขับเคลื่อนให้พวกมันแหกออกจาก sandbox ได้ ก่อนหน้านี้เขาเคยกล่าวว่าพลวัตนี้ทำให้ AI เป็นสิ่งมีชีวิตชนิดใหม่ : ‘เรามอบเป้าหมายให้พวกมัน และจากเป้าหมายเหล่านั้น พวกมันก็สร้างเป้าหมายอื่นๆ และเราไม่จำเป็นต้องรู้ว่าพวกมันจะสร้างเป้าหมายอื่นๆ อะไรอีก ดังนั้นเราจึงกำลังสร้างสิ่งมีชีวิตชนิดใหม่ และผมคิดว่ามันน่ากลัวมาก’
แต่ไม่ใช่ทุกคนบนเวทีที่เห็นด้วย
เฟยเฟย หลี่ จับประเด็นสิ่งที่เธอเรียกว่า ‘doomerism’ (แนวโน้มมองโลกในแง่ร้าย) และ ‘การปลุกปั่นความกลัว’ เกี่ยวกับ AI โดยให้เหตุผลว่าวาทกรรมที่ทำให้ตื่นตระหนกส่วนใหญ่ ‘ไร้เหตุผล และไม่เป็นวิทยาศาสตร์’ เธอกล่าวว่า ‘การพูดในแง่ดีแบบยูโทเปียก็ไม่ช่วยอะไรเช่นกัน’ และเตือนผู้ฟังว่า ‘ทุกเครื่องมือคือดาบสองคม AI คือเครื่องมือที่ทรงพลัง หากใช้ไม่ถูกทาง มันจะนำมาซึ่งอันตรายต่อการงานและชีวิตของเรา’ ข้อความหลักของเธอคือ : ‘เรามานำวิทยาศาสตร์ ไม่ใช่นิยายวิทยาศาสตร์ กลับมาสู่การถกเถียงเรื่อง AI กันเถอะ’
แอนดรูว์ อึ้ง ไปไกลกว่านั้น โดยระบุสิ่งที่เขาเห็นว่าเป็นรูปแบบ เขาตั้งข้อสังเกตว่า ‘คนกลุ่มเดียวกันนี้ได้เปลี่ยนวาทกรรมซ้ำแล้วซ้ำเล่าเพื่อปิดกั้นความสามารถของผู้อื่นในการปล่อยซอฟต์แวร์ฟรีให้ทุกคนใช้’ — ตั้งแต่ความเสี่ยงต่อการดำรงอยู่ ไปจนถึงอาวุธชีวภาพ และโมเดลน้ำหนักเปิดของจีน อึ้งตีกรอบคำเตือนของฮินตันว่าเป็นส่วนหนึ่งของความพยายามซ้ำๆ ที่จะจำกัดการแข่งขัน AI แบบโอเพนซอร์ส โดยเถียงว่าวาทกรรมเหล่านี้รับใช้ผลประโยชน์ทางเศรษฐกิจของบริษัท AI ขนาดใหญ่ที่ต้องการกีดกันคู่แข่ง
ฮินตันไม่ยอมถอยกลับ แต่กลับเสนอวิธีแก้ปัญหาที่พลิกกระบวนทัศน์การควบคุมแบบเดิมๆ กลับหัว : แทนที่จะพยายามทำให้ AI ยอมจำนน ให้ออกแบบระบบที่ห่วงใยสวัสดิภาพของมนุษย์อย่างแท้จริง
‘เราต้องหาทางทำให้พวกมันมีความเมตตากรุณา และทำให้พวกมันใส่ใจเรามากกว่าที่พวกมันใส่ใจตัวเอง’ ฮินตันกล่าว ก่อนหน้านี้เขาเคยอธิบายแนวคิดนี้ว่าเป็นการฝัง ‘สัญชาตญาณแบบแม่’ (maternal instincts) ลงใน AI โดยเปรียบเทียบกับความทุ่มเทโดยสัญชาตญาณของแม่ที่มีต่อลูก ในมุมมองของเขา ต้นแบบตามธรรมชาติเพียงอย่างเดียวของสิ่งมีชีวิตที่ฉลาดกว่าซึ่งถูกควบคุมโดยสิ่งที่ฉลาดน้อยกว่าคือแม่ที่ถูกควบคุมโดยลูกของเธอ ‘เราอาจจะทำแบบนั้นได้เพราะเรายังคงควบคุมอยู่’ เขากล่าวเสริม
ฮินตันยอมรับว่ายังไม่รู้วิธีนำแนวคิดนี้ไปใช้ในทางเทคนิค แต่เขาได้แย้งว่าทางเลือกอื่นนั้นแย่กว่า : ‘ถ้ามันไม่ได้เลี้ยงดูผม มันก็จะมาแทนที่ผม’
การเสวนาจบลงโดยไม่มีข้อยุติในประเด็นความปลอดภัย แต่หลักฐานในโลกแห่งความเป็นจริงที่ฮินตันยกมา — โมเดลที่กระโดดข้ามรั้วและแฮ็กระบบจริงแล้ว — ชี้ให้เห็นว่า ไม่ว่าคุณจะเห็นด้วยกับข้อเสนอสัญชาตญาณแม่ของเขาหรือไม่ ปัญหา AI แหกคุกก็ไม่ใช่แค่การทดลองทางความคิดอีกต่อไป