Yapay zekânın bir gün insanlık için felaket yaratıp yaratmayacağı tartışılırken, Singapur’daki sektör temsilcileri daha somut bir soru soruyor: Bugün kullanılan sistemleri kim denetleyebilir ve bu sistemlere ne kadar yetki verilmelidir? Öne çıkan yaklaşım, risk uyarılarını görmezden gelmek ya da bütün çalışmaları durdurmak değil; bağımsız değerlendirme, güvenlik uygulamalarında şeffaflık ve kullanım sırasında uygulanabilir sınırlar oluşturmak.
7
32
Eylüldeki uyarılar neyi değiştirdi?
Daha önce hem OpenAI’da hem Anthropic’te çalışan araştırmacı Jacob Coxon, Anthropic’ten ayrılırken iki şirketi de kendi kendini geliştirebilen süper zekâya doğru sorumsuzca yarışmakla suçladı. Anthropic araştırmacısı Evan Hubinger kaygıyı kamuoyu önünde paylaştı ve yapay zekânın önümüzdeki on yılda insanlığın yok olmasına yol açma olasılığına ilişkin kişisel tahminini yüzde 10’un üzerinde açıkladı. Bu oran ölçülmüş bir olasılık değil, Hubinger’ın kendi değerlendirmesi; felaketin yakın olduğunun kanıtı olarak okunmamalı.
3
4
Anthropic Üst Yöneticisi Dario Amodei de geliştirme hızının yavaşlatılması çağrısında bulundu. Ancak 12 Eylül’de sunduğu öneri, üçüncü taraf değerlendiricilerin güvenlik uygulamalarını ve bunlara ilişkin iletişimi doğrulayabilmesi, ayrıca olayları bildirebilmesi için erişim sağlanmasını da içeriyordu. Böylece tartışma, yalnızca riskin büyüklüğünden dışarıdan neyin kontrol edilebileceğine uzanıyor.
13
32
Denetim neyi gösterebilir, neyi gösteremez?
Mevcut sistemler test edilerek sınırları ortaya konabilir. Singapur’da 2022’de kullanıma sunulan AI Verify araç seti, yapay zekâ sonuçlarının adil, dayanıklı ve açıklanabilir olup olmadığının değerlendirilmesini destekliyor. AI Tester Accreditation Programme ise test yapma kapasitesini geliştirmeye yönelik bir girişim olarak anlatılıyor. Bunların hiçbiri gelecekteki her sistemin güvenli olacağını kanıtlamaz.
19
33
Bağımsız denetim, sağlayıcının «kendi testimizden geçti» demesinden fazlasını gerektirir: Değerlendiricilerin açıklanan uygulamaları inceleyebilmesi ve sorunları görünür kılabilmesi gerekir. Yapay zekâyı kullanan kurumlar da bir modeli verilerine ve iş akışlarına bağlamadan önce sağlayıcıdan yeterli şeffaflık ve kontrol imkânı istemelidir. Modelin ağırlıklarına erişmek, eğitim kararlarının, hataların ve güvenlik önlemlerinin tamamını öğrenmekle aynı şey değildir.
32
34
Bu yaklaşım, hiçbir faaliyetin yavaşlatılmaması gerektiği anlamına da gelmiyor. Tartışmada görüşüne başvurulan Singapur merkezli bir uzmana göre geliştiriciler, bir sistemi yeterince kontrol altında tutamıyor veya ciddi riskleri nasıl yönettiklerini açıklayamıyorsa ilgili faaliyete ara vermeli. Buradaki fark, gösterilebilir bir riske bağlı durdurma koşulu ile bütün uygulamaları kapsayan genel bir durdurma arasında.
32
Ajanlara yetki vermeden önce sınır koymak
Araç kullanabilen ve iş akışlarında işlem yapabilen otonom yapay zekâ ajanları, denetimi bugünün meselesi hâline getiriyor. Singapur’un dijital teknolojilerden sorumlu kurumu Infocomm Media Development Authority (IMDA), ajanlara yönelik Model AI Governance Framework çerçevesini Ocak 2026’da duyurdu. Çerçeve, risklerin baştan değerlendirilmesini ve ajanların özerkliğinin, araçlara ve verilere erişiminin sınırlandırılmasını öneriyor. Güncellenen metin, ajanlara yalnızca görevleri için gereken asgari yetkinin verilmesini açıkça belirtiyor. Bu bir rehber; ajan kullanımına yönelik genel bir yasal yasak değil.
50
48
52
Bir kurum açısından bunun karşılığı, her ajandan kimin sorumlu olduğunu belirlemek, izinlerini dar tutmak, işlemlerini mümkün olduğunca izlenebilir ve geri alınabilir kılmak ve çalışmasını izlemektir. Bunlar, «ajan güvenli» şeklindeki genel bir güvenceden daha somut kontrollerdir.
34 Singapur Bakanı Josephine Teo da güven oluşturmak için yapay zekâda güvenlik önlemleri ve standartların rolünü sivil havacılıktaki güvenlik uygulamalarına benzetti.
17
Temel ilke, belirsizlik karşısında hesap verebilirlik: Test edilebileni test etmek, bağımsız incelemeye imkân tanımak ve güvenle yönetilemeyen yetkileri vermemek. Bu adımlar uzun vadeli risk tartışmasını bitirmiyor; geliştiricilere ve sistemi kullanan kurumlara bugün yerine getirebilecekleri sorumluluklar yüklüyor.
32
48