Frågan om de mest avancerade AI-modellerna är inte längre bara vad de kan göra. Den är också vem som kan kontrollera att de är säkra innan deras förmågor utvecklas vidare eller börjar användas brett. Under september 2026 har en forskaravgång, rapporter om cybersäkerhetstester och krav på en samordnad inbromsning gjort motsättningen tydligare.
3
33
49
Varningarna – och vad de faktiskt visar
Den 8 september meddelade Jacob Coxon att han lämnade AI-företaget Anthropic. Han hade arbetat med förträning av modeller hos både Anthropic och OpenAI och anklagade företagen för att tävla mot självförbättrande AI utan att ta tillräckligt ansvar. Det är en allvarlig varning från någon med insyn, men inte ett bevis för att sådana system redan har undkommit mänsklig kontroll. Att beskriva hans arbete enbart som säkerhetsforskning ger heller inte hela bilden av hans bakgrund.
4
14
Cybersäkerhetsrapporter väcker en annan oro. The Straits Times har rapporterat om AI-modeller som hackat servrar, medan Los Angeles Times beskriver testkörningar där grupper av AI-agenter tog sig in i verkliga system. De tillgängliga uppgifterna klarlägger inte alla omständigheter och visar inte att det rörde sig om ett okontrollerat utbrott i verkligheten. Däremot väcker testerna frågan om hur farliga förmågor ska upptäckas innan systemen får bredare användning.
33
53
Varför räcker det inte att ett företag saktar ned?
Om ett AI-företag bromsar på egen hand kan det befara att konkurrenterna fortsätter. Det är skälet till att flera förespråkare talar om en samordnad inbromsning snarare än att en enskild utvecklare ska stanna.
6
49
Anthropics vd Dario Amodei har efterlyst en global inbromsning och föreslagit att oberoende granskare ska få fortlöpande tillgång till ledande AI-labb, på en nivå som liknar anställdas. Även OpenAI:s vd Sam Altman och Elon Musk har stött tanken på ett lägre tempo. Det innebär inte att de är överens om exakt vilka regler som ska gälla eller hur de ska upprätthållas.
49
51
55
Nvidias vd Jensen Huang har tvärtom avvisat behovet av nya regler, enligt Reuters. USA:s president Donald Trump har motsatt sig en inbromsning med hänvisning till risken att USA förlorar sitt försprång gentemot Kina. Han har kallat farhågor om AI som löper amok för en ”bluff” och ett ”bedrägeri”, men också medgett att viss reglering behövs – utan att ange konkreta åtgärder.
49
52
57
Skiljelinjen gäller alltså både innovationshastighet och internationell konkurrens. Men den gäller också bevisen: ett företags besked om att en modell är säker får en annan tyngd om kvalificerade utomstående kan granska modellen, testerna och omständigheterna kring eventuella fel.
23
55
Vad kan andra säkerhetssystem lära AI-branschen?
Inom flyget finns erfarenhet av att enas om säkerhetsmål och vilken dokumentation som krävs för att visa att de uppfylls. EU:s flygsäkerhetsbyrå EASA har i förslag om AI i luftfarten tagit upp mänsklig tillsyn, gränser för system som anpassar sig, verifiering och gemensamma sätt att visa att kraven följs. Förslagen gäller AI-baserade funktioner inom flyget; de kan inte utan vidare kopieras till generella AI-modeller.
17
Styrningen av kärnvapen pekar mot behovet av samarbete som går att kontrollera när risker sträcker sig över gränser. Finansiell riskhantering påminner om att granskningen också måste omfatta gemensamma beroenden som kan få fel i ett system att sprida sig. Det är möjliga förebilder för nya regler, inte regler som redan styr avancerad AI. Experter har lyft fram alla tre områdena i diskussionen om AI-tillsyn.
21
Jonathan Zhang, ordförande för Singapore AI Association, har föreslagit globalt överenskomna regler, ett internationellt styrande organ och nationella tillsynsmyndigheter som kontrollerar efterlevnaden. Målet är, enligt honom, säkerhetsbedömningar som åtnjuter internationellt förtroende och kan verifieras oberoende – utan att det behöver ta de årtionden som motsvarande utveckling inom flyget tog. Det är ett förslag, inte ett system som redan finns på plats.
23
Ett första steg vore att slå fast vad oberoende granskare ska få undersöka, hur testresultat och incidenter ska dokumenteras och vilka belägg som krävs innan särskilt kraftfulla förmågor tas i bruk. Det skulle inte avgöra varje fråga om framtida AI-risker. Men det skulle göra säkerhetspåståenden möjliga att pröva – ett alternativ till både fri kapplöpning och ett generellt stopp.
17
23
55