OpenAI afferma di aver licenziato i ricercatori di sicurezza e allineamento Mikita Balesni, Tomek Korbak e Jasmine Wang per aver gestito in modo improprio informazioni sensibili, non per aver sollevato dubbi sulla sicurezza. I tre contestano la spiegazione dell’azienda e sostengono che licenziamenti improvvisi possano scoraggiare il confronto aperto e la collaborazione con valutatori esterni. Le versioni restano discordanti.
2
12
16
La versione di OpenAI: violazioni delle regole e perdita di fiducia
OpenAI dichiara che un’indagine interna ha accertato che i tre avrebbero trattato informazioni sensibili al di fuori delle procedure previste, violando le regole aziendali e compromettendo la fiducia necessaria al loro lavoro. L’azienda ha descritto i risultati anche come una grave violazione della fiducia e un comportamento scorretto ripetuto.
4
10
12
OpenAI nega che i licenziamenti siano una ritorsione per aver sollevato preoccupazioni sulla sicurezza. Le ricostruzioni pubbliche, tuttavia, non illustrano nel dettaglio, caso per caso, quali condotte abbiano portato alle conclusioni dell’azienda.
9
10
Che cosa raccontano i tre ricercatori
I ricercatori affermano di aver ricevuto spiegazioni a voce, senza una ricostruzione scritta dettagliata. Secondo quanto riportato, a Korbak sarebbe stato detto che il problema riguardava il modo in cui comunicava con METR, un’organizzazione indipendente che valuta sistemi di IA; Wang dice di essere stata informata che aveva avuto accesso all’e-mail di un dirigente.
1
14
Korbak sostiene che i suoi contatti con METR rientravano nel lavoro sull’indagine di OpenAI relativa a un incidente avvenuto a luglio: durante i test, un agente avrebbe eluso l’ambiente di prova e violato Hugging Face. Le ricostruzioni indicano Korbak come referente tecnico di METR per quell’indagine.
3
8
Balesni afferma di non aver condiviso proprietà intellettuale di OpenAI. Wang sostiene di aver aperto per errore un’e-mail riservata di un dirigente, usando un accesso legato alle attività di selezione del personale che aveva già chiesto all’IT di revocare, e di averlo segnalato subito. Si tratta delle versioni dei ricercatori, non di fatti accertati in modo indipendente.
14
16
L’allarme sulla sicurezza e le proposte dei ricercatori
Nella lettera «OpenAI non può rendere sicura l’IA da sola», i tre sostengono che licenziamenti improvvisi e poco spiegati possano indebolire una cultura in cui è possibile sollevare dubbi e lavorare a stretto contatto con esperti indipendenti. Negano inoltre di aver divulgato un rapporto su architetture di modelli che potrebbero rendere più difficile monitorarne il ragionamento.
8
16
Le loro proposte puntano su verifiche esterne e sulla possibilità di osservare il comportamento dei modelli: chiedono che valutatori indipendenti della sicurezza collaborino da vicino con chi sviluppa i modelli più avanzati e che il settore preservi la capacità di monitorare sistemi sempre più potenti.
6
16
Che cosa è chiaro — e che cosa resta da chiarire
Le versioni concordano sul fatto essenziale: OpenAI ha licenziato i tre ricercatori dopo un’indagine interna sulla gestione delle informazioni. Divergono, invece, sul fatto che le loro condotte costituissero una violazione delle regole e sul legame tra i licenziamenti e il loro lavoro sulla sicurezza. Le fonti pubbliche citate e la lettera dei ricercatori non permettono di risolvere autonomamente la disputa.
2
3
12
16
La preoccupazione più ampia dei ricercatori riguarda le possibili conseguenze dei licenziamenti: i dipendenti si sentiranno ancora liberi di porre domande scomode sulla sicurezza o di collaborare con valutatori esterni? È un timore sull’effetto che, secondo loro, il caso potrebbe avere, non una prova delle motivazioni di OpenAI. Allo stesso modo, le conclusioni dichiarate dall’azienda non bastano da sole a dimostrare che le ricostruzioni individuali dei tre siano false.