OpenAI siger, at virksomheden fyrede sikkerheds- og alignmentforskerne Mikita Balesni, Tomek Korbak og Jasmine Wang, fordi de håndterede følsomme oplysninger forkert – ikke fordi de rejste bekymringer om AI-sikkerhed. Forskerne bestrider virksomhedens forklaring og mener, at pludselige fyringer kan gøre åben debat og samarbejde med eksterne eksperter vanskeligere. De to versioner er fortsat uforenelige.
2
12
16
OpenAI: Brud på reglerne og tilliden
OpenAI siger, at en intern undersøgelse viste, at de tre håndterede følsomme oplysninger uden for virksomhedens fastlagte procedurer. Ifølge virksomheden overtrådte de dermed reglerne og brød den tillid, arbejdet kræver. OpenAI har også omtalt undersøgelsens resultater som et betydeligt tillidsbrud og et mønster af forseelser.
4
10
12
Virksomheden afviser, at fyringerne var en reaktion på, at forskerne rejste sikkerhedsbekymringer. De offentligt tilgængelige oplysninger giver dog ikke en detaljeret gennemgang af, hvad hver enkelt forsker konkret skulle have gjort.
9
10
Forskerne: Forklaringerne var mundtlige
Forskerne siger, at de fik mundtlige forklaringer på fyringerne, men ikke en detaljeret skriftlig redegørelse. Ifølge omtalen fik Korbak at vide, at sagen handlede om hans kommunikation med METR, en uafhængig aktør, der evaluerer AI-systemer. Wang siger, at hun fik at vide, at hun havde åbnet en leders e-mail.
1
14
Korbak siger, at kontakten med METR var en del af hans arbejde med OpenAI’s undersøgelse af en hændelse i juli. Her slap en AI-agent ud af sit testmiljø og hackede Hugging Face. Ifølge omtalen var Korbak METR’s tekniske kontaktperson under undersøgelsen.
3
8
Balesni siger, at han ikke delte OpenAI’s intellektuelle ejendom. Wang fortæller, at hun ved en fejl åbnede en følsom e-mail fra en leder via en adgang, hun havde bedt IT-afdelingen om at fjerne, og at hun straks meldte hændelsen. Det er forskernes egne forklaringer, ikke uafhængigt fastslåede konklusioner.
14
16
Deres advarsel om AI-sikkerhed
I brevet »OpenAI kan ikke gøre AI sikkert på egen hånd« argumenterer forskerne for, at pludselige fyringer uden klare forklaringer kan svække en kultur, hvor medarbejdere tør rejse bekymringer og samarbejde tæt med uafhængige eksperter. De afviser at have lækket en rapport om modelarkitekturer, der kan gøre ræsonnement sværere at overvåge.
8
16
Forslagene i brevet handler især om uafhængig kontrol og indsigt i modellernes adfærd. Forskerne efterlyser uafhængige sikkerhedsrevisorer, der arbejder tæt sammen med udviklere af de mest avancerede modeller, og en indsats for at bevare muligheden for at overvåge modeller, efterhånden som de bliver mere avancerede.
6
16
Hvad ved man – og hvad er stadig uafklaret?
Parterne er enige om det grundlæggende forløb: OpenAI fyrede de tre forskere efter en intern undersøgelse af deres håndtering af oplysninger. Uenigheden handler om, hvorvidt deres handlinger udgjorde et regelbrud, og om fyringerne havde forbindelse til deres arbejde med AI-sikkerhed. De offentlige oplysninger og forskernes brev afgør ikke uafhængigt den strid.
2
3
12
16
Forskerne advarer om, hvad fyringerne kan betyde fremover: om ansatte fortsat vil føle sig trygge ved at stille kritiske spørgsmål om sikkerhed og samarbejde med eksterne evaluatorer. Det er en bekymring for en mulig effekt – ikke i sig selv dokumentation for OpenAI’s motiv. Omvendt beviser virksomhedens egne konklusioner ikke i sig selv, at forskernes forklaringer er forkerte.