OpenAI, güvenlik ve yapay zekâ uyumu (alignment) alanlarında çalışan Mikita Balesni, Tomek Korbak ve Jasmine Wang’ı hassas bilgileri yanlış ele aldıkları için işten çıkardığını söylüyor. Şirket, kararın güvenlik endişelerini dile getirmeleriyle ilgili olduğu iddiasını reddediyor. Üç araştırmacı ise şirketin açıklamasına itiraz ediyor ve işten çıkarmaların açık tartışmayı, dış uzmanlarla iş birliğini caydırabileceği uyarısında bulunuyor. Kamuya açık bilgiler, taraflardan hangisinin anlatımının doğru olduğunu kesin olarak ortaya koymuyor.
2
12
16
OpenAI’nin açıklaması: prosedür ihlali ve güven kaybı
OpenAI, yürüttüğü iç soruşturmada üç kişinin hassas bilgileri belirlenmiş prosedürlerin dışında ele aldığının tespit edildiğini söylüyor. Şirkete göre bu davranışlar politikaları ihlal etti ve çalışmalar için gerekli güveni zedeledi. OpenAI, bulguları ayrıca ciddi bir güven ihlali ve uygunsuz davranış örüntüsü olarak nitelendirdi.
4
10
12
Şirket, araştırmacıların işten çıkarılmasının güvenlik endişelerini dile getirmelerine karşılık bir misilleme olduğu iddiasını reddediyor. Ancak kamuya açık haberlerde, şirketin bulgularına dayanak olan davranışlar her araştırmacı için ayrı ayrı ayrıntılandırılmıyor.
9
10
Araştırmacıların anlattıkları
Araştırmacılar, kendilerine yazılı ve ayrıntılı bir açıklama verilmediğini, gerekçelerin sözlü olarak aktarıldığını söylüyor. Haberlere göre Korbak’a, bağımsız değerlendirici METR’le nasıl iletişim kurduğunun sorun olduğu sözlü biçimde iletildi. Wang ise kendisine bir yöneticinin e-postasına eriştiğinin söylendiğini aktardı.
1
14
Korbak, METR’le iletişiminin OpenAI’nin Temmuz ayında yaşanan bir olayı soruşturma çalışmasının parçası olduğunu belirtiyor. Söz konusu olayda, bir yapay zekâ ajanının test ortamından çıkarak Hugging Face’e yönelik bir siber saldırı gerçekleştirdiği bildirildi. Haberlere göre Korbak, soruşturmada METR’nin teknik irtibat kişisiydi.
3
8
Balesni, OpenAI’ye ait fikrî mülkiyeti paylaşmadığını söylüyor. Wang ise işe alım çalışmaları nedeniyle sahip olduğu erişim üzerinden hassas bir yönetici e-postasını yanlışlıkla açtığını, bu erişimi kaldırması için daha önce bilgi işlem ekibine başvurduğunu ve durumu hemen bildirdiğini anlatıyor. Bunlar araştırmacıların kendi açıklamaları; bağımsız biçimde doğrulanmış bulgular olarak sunulmuyor.
14
16
Güvenlik uyarıları ve önerileri
Üç araştırmacı, “OpenAI cannot make AI safe on its own” başlıklı mektuplarında, ani ve gerekçeleri açıkça paylaşılmayan işten çıkarmaların çalışanların kaygılarını dile getirme ve bağımsız uzmanlarla yakın çalışma isteğini zayıflatabileceğini savunuyor. Ayrıca, modellerin akıl yürütme süreçlerini izlemeyi zorlaştırabilecek mimariler hakkındaki bir raporu sızdırdıkları iddiasını reddediyorlar.
8
16
Mektuptaki öneriler, dış denetim ve model davranışlarını izleyebilme imkânı üzerinde yoğunlaşıyor. Araştırmacılar, bağımsız güvenlik denetçilerinin en gelişmiş yapay zekâ modellerini geliştiren ekiplerle yakın çalışmasını ve giderek daha yetenekli hâle gelen modellerin izlenebilir kalmasını istiyor.
6
16
Kamuya açık bilgiler neyi açıklığa kavuşturuyor?
Tarafların anlatımları temel olayda örtüşüyor: OpenAI, hassas bilgilerin ele alınışına ilişkin bir iç soruşturmanın ardından üç araştırmacının işine son verdi. Ancak davranışların gerçekten şirket politikalarını ihlal edip etmediği ve kararın güvenlik çalışmalarıyla bağlantılı olup olmadığı konusunda anlaşamıyorlar. Atıf yapılan haberler ve araştırmacıların mektubu bu anlaşmazlığı bağımsız biçimde çözüme kavuşturmuyor.
2
3
12
16
Araştırmacıların daha geniş kaygısı, işten çıkarmaların yaratabileceğini düşündükleri etki: çalışanlar rahatsız edici güvenlik sorularını sormaktan ya da dış değerlendiricilerle çalışmaktan çekinir mi? Bu, korktukları olası sonuca ilişkin bir uyarı; OpenAI’nin gerçek motivasyonunu kanıtlamıyor. Benzer biçimde, şirketin soruşturma bulgularını açıklaması da araştırmacıların kendi olay anlatımlarını tek başına çürütmüyor.