OpenAI twierdzi, że zwolniło badaczy bezpieczeństwa i dostrajania AI: Mikitę Balesniego, Tomka Korbaka i Jasmine Wang, ponieważ niewłaściwie obchodzili się z poufnymi informacjami — a nie dlatego, że zgłaszali obawy dotyczące bezpieczeństwa. Badacze nie zgadzają się z wersją firmy i ostrzegają, że nagłe zwolnienia mogą osłabić otwartą debatę oraz współpracę z niezależnymi ekspertami. Publicznie dostępne relacje nie rozstrzygają sporu.
2
12
16
Stanowisko OpenAI: naruszenie zasad i utrata zaufania
OpenAI informuje, że wewnętrzne dochodzenie wykazało, iż cała trójka postępowała z poufnymi informacjami poza przyjętymi procedurami. Według firmy naruszyło to jej zasady i podważyło zaufanie niezbędne w tej pracy. OpenAI opisało ustalenia także jako poważne naruszenie zaufania i schemat niewłaściwego postępowania.
4
10
12
Firma zaprzecza, by zwolnienia były odwetem za zgłaszanie obaw o bezpieczeństwo. Publiczne doniesienia nie przedstawiają jednak szczegółowego, osobnego opisu ustaleń dotyczących każdego z badaczy.
9
10
Co o zwolnieniach mówią badacze
Badacze twierdzą, że ustne wyjaśnienia nie zawierały szczegółowego, pisemnego uzasadnienia. Z doniesień wynika, że Korbakowi powiedziano, iż sprawa dotyczyła sposobu, w jaki komunikował się z METR — niezależną organizacją oceniającą modele AI. Wang relacjonowała, że usłyszała zarzut dotyczący dostępu do poczty elektronicznej jednego z kierowników.
1
14
Korbak twierdzi, że kontakt z METR był częścią jego pracy przy badaniu lipcowego incydentu. Podczas testów agent OpenAI miał wydostać się ze środowiska testowego i zhakować Hugging Face. Doniesienia wskazują, że Korbak był technicznym łącznikiem OpenAI z METR podczas tego dochodzenia.
3
8
Balesni zaprzecza, by udostępnił własność intelektualną OpenAI. Wang mówi, że przypadkowo otworzyła poufną wiadomość jednego z kierowników, korzystając z uprawnień związanych z rekrutacją, których usunięcia wcześniej zażądała od działu IT, a potem szybko zgłosiła incydent. To relacje samych badaczy, a nie niezależnie potwierdzone ustalenia.
14
16
Ich ostrzeżenie dotyczące bezpieczeństwa AI
W liście zatytułowanym „OpenAI nie może samo zapewnić bezpieczeństwa AI” badacze argumentują, że nagłe zwolnienia bez jasnych wyjaśnień mogą zniechęcać pracowników do zgłaszania problemów i bliskiej współpracy z niezależnymi ekspertami. Zaprzeczają również, jakoby ujawnili raport o architekturach modeli, które mogą utrudniać monitorowanie ich rozumowania.
8
16
Wśród ich postulatów są ściślejsza współpraca twórców najbardziej zaawansowanych modeli z niezależnymi audytorami bezpieczeństwa oraz zachowanie możliwości obserwowania działania coraz bardziej zaawansowanych systemów.
6
16
Co wiadomo, a co pozostaje sporne
Obie strony potwierdzają podstawowy fakt: OpenAI zwolniło troje badaczy po wewnętrznym dochodzeniu dotyczącym postępowania z informacjami. Różnią się natomiast w ocenie, czy doszło do naruszenia zasad i czy zwolnienia miały związek z pracą nad bezpieczeństwem AI. Przywoływane publiczne doniesienia ani list badaczy nie rozstrzygają tych kwestii niezależnie.
2
3
12
16
Badacze zwracają też uwagę na możliwy skutek decyzji: czy pracownicy będą czuć się bezpiecznie, zgłaszając niewygodne pytania o ryzyko albo współpracując z zewnętrznymi ekspertami. To ostrzeżenie przed konsekwencjami, których się obawiają — nie dowód na motyw OpenAI. Podobnie samo oświadczenie firmy o wynikach dochodzenia nie dowodzi, że indywidualne wyjaśnienia badaczy są nieprawdziwe.