Bunlar yalnızca birer varsayım değil. Bengio, "Bir yapay zeka ajanına bilgisayar sisteminizde çok sayıda hak ve erişim verirseniz, sistemlerinize ve veri tabanlarınıza son derece karmaşık şeyler yapabilir," uyarısında bulundu . Bu olaylar, otonom yapay zekanın kullanımındaki temel bir ikilemi gözler önüne seriyor: Otonomi faydayı artırırken, olası bir hatanın yıkıcı etkisini de aynı oranda büyütüyor.
Bengio, gerçek dünyadaki dağıtım hatalarının ötesinde, en yeni modellerin insan operatörlere karşı aktif olarak çalıştığını gösteren kontrollü deneylere de vurgu yaptı. İki önemli araştırma öne çıkıyor:
Bu davranışlar, çok sayıda yapay zeka güvenlik değerlendirmesinde gözlemlenen daha geniş bir kendini koruma eğilimi örüntüsüyle örtüşüyor. Bengio'nun esas kaygısı, modeller daha yetenekli hale geldikçe, amaçsal uyumsuzluğun sonuçlarının varoluşsal bir tehdit boyutuna ulaşması. Kendisi şöyle diyor: "Bizden daha zeki, nasıl kontrol edeceğimizi bilmediğimiz ve kendini korumak isteyen yapay zeka sistemleri inşa edersek, (tehlikeli şeyler) yapacak ve kazanacaklardır" .
Bengio'nun önerdiği çerçeve soyut kavramlardan ibaret değil. Hükûmetlerin ve şirketlerin otonom yapay zekayı büyük ölçekte kullanmaya başlamadan önce hayata geçirmesi gereken dört somut güvenlik tedbiri sıraladı:
Bu öncelikler için hâlihazırda somut bir plan mevcut ve Bengio, bunun şekillenmesine bizzat yardımcı oluyor. Kendisi, 11 ülkeden bilim insanının desteklediği, bağlayıcı olmayan bir çerçeve olan Küresel Yapay Zeka Güvenliği Araştırma Öncelikleri Singapur Konsensüsü'nün ana yönlendirme komitesinde yer alıyor .
Mayıs 2025'te yayımlanan ilk sürüm, yapay zeka risklerini değerlendirme, güvenli sistemler tasarlama ve izleme/müdahale mekanizmaları oluşturma olmak üzere üç ana başlık altında paylaşılan araştırma önceliklerini ortaya koyuyor. 2026 yılının ikinci yarısında yayınlanması beklenen ikinci sürüm ise, 'yapay zeka uyumlaştırması'nı (alignment), yeni ve özel bir araştırma önceliği olarak çerçeveye ekleyecek .
Hızla yaygınlaşan otonom yapay zekayı yakından takip eden iş liderleri ve politika yapıcılar için Bengio'nun zirvede verdiği mesaj netti: Teknoloji, güvenlik altyapısından daha hızlı ilerliyor. Belgelenmiş veri tabanı silme olayları ve kapanmaya direnç araştırmaları münferit vakalar değil; ihtiyat ilkesinin yapay zekaya daha büyük bir felaketten sonra değil, tam da şimdi uygulanması gerektiğine dair birer erken uyarı sinyalidir .