En global ordning for AI-sikkerhed skal kunne bestå en enkel prøve: Kan andre end udvikleren kontrollere, om kravene er opfyldt – og kan en myndighed gribe ind, hvis de ikke er? Et mærke på et produkt eller en offentlig testscore er ikke nok.
Singapores minister for digital udvikling og information, Josephine Teo, har sammenlignet AI med luftfart. Hendes pointe er, at tillid til en teknologi, som bruges bredt, bygger på flere lag af sikkerhed – ikke på ét enkelt løfte. Hun har opfordret til at udvikle sikkerhedsforanstaltninger, samtidig med at AI tages i brug.
3
6
Byg reglerne trin for trin
Luftfartens internationale regler kom ikke på én gang. Nationale love og bilaterale aftaler blev fulgt af Pariskonventionen i 1919. Chicagokonventionen fra 1944 lagde grunden til det internationale luftfartsorgan ICAO, som formelt trådte i funktion i 1947.
31
39
35 Det er ikke en færdig opskrift på AI, men et argument for at begynde med aftaler, der kan fungere i praksis, og udbygge dem efterhånden.
Et internationalt organ kunne fastlægge minimumskrav, godkende uvildige testmiljøer og sammenholde oplysninger om alvorlige hændelser. Nationale myndigheder skulle fortsat kunne føre tilsyn, kræve ændringer, begrænse brugen af et system og give sanktioner. Et internationalt certifikat må ikke erstatte håndhævelse i det enkelte land.
Sikkerhed skal desuden vurderes gennem hele systemets levetid: før det tages i brug, under driften og efter væsentlige ændringer. En godkendelse bør gælde en bestemt version og en bestemt anvendelse – ikke automatisk alle senere udgaver eller formål.
Gør sikkerhedspåstande efterprøvelige
For de mest risikofyldte systemer kunne udvikleren pålægges at fremlægge en dokumenteret sikkerhedsvurdering: Hvad må systemet bruges til? Hvordan er det testet? Hvilke sikkerhedsforanstaltninger virker, hvilke risici består, og hvad sker der ved en alvorlig fejl?
En uvildig tester skal have sikker adgang til den relevante model, dens opsætning, dokumentation og oplysninger om væsentlige fejl. Metoder og resultater skal beskrives så præcist, at andre kvalificerede testere kan udfordre dem. Adgangen må samtidig indrettes, så personoplysninger, forretningshemmeligheder og sikkerhedsfølsomt materiale beskyttes.
Store udviklere kunne betale til en fælles eller myndighedsadministreret testordning frem for selv at udvælge og styre dem, der skal bedømme deres systemer. Alvorlige fejl og næsten-hændelser bør undersøges uafhængigt med forebyggelse som mål. Beskyttet indberetning kan gøre det lettere at lære af fejl, men må ikke fritage nogen for ansvar ved fortielse eller bevidst forsømmelse.
Singapore kan bidrage – men tillid kan ikke udråbes
Singapores AI Verify-værktøj og landets AI Safety Institute bliver fremhævet som grundlag for arbejdet med test og sikkerhedsvurdering.
1
3 Landet kunne derfor være vært for fælles evalueringer eller fortrolige tekniske udvekslinger i et bredere netværk af godkendte testmiljøer.
Det ville dog ikke i sig selv gøre et testcenter troværdigt for både USA og Kina. Det kræver gennemskuelig ledelse, klare regler for adgang, mulighed for uafhængig klagebehandling og faktisk deltagelse fra begge sider. Et netværk fordelt på flere lande ville også mindske afhængigheden af ét center.
Begynd med fælles risici, ikke enighed om en pause
Uenigheden om AI’s udviklingstempo er betydelig. Ifølge Reuters har Dario Amodei, Sam Altman og Elon Musk opfordret til en koordineret opbremsning. Mark Zuckerberg har foretrukket markedsbaserede sikkerhedsforanstaltninger, mens Jensen Huang har afvist behovet for ny regulering.
47
48 Kina har afvist opfordringerne til at sætte tempoet ned. Donald Trump sagde, at han ikke forventede fremskridt om AI-sikkerhedsregler på sit topmøde med Xi Jinping den 24. september; dækningen af mødet pegede også på lave forventninger til et større gennembrud.
58
50
49
Landene behøver ikke være enige om en generel opbremsning for at forebygge konkrete farer. Amerikanske og kinesiske sikkerhedseksperter har foreslået røde linjer omkring nukleare systemer, menneskelig kontrol med cyberangreb med alvorlige konsekvenser og en direkte kontaktlinje ved hændelser med autonom AI.
20 Det kunne danne grundlag for snævre aftaler om nødkommunikation og hurtig varsling.
Erfaringer fra våbenkontrol peger på gensidige forpligtelser, som er afgrænsede nok til at kunne kontrolleres. Fra finansielt tilsyn kan AI-regulering hente princippet om at stille de skrappeste krav dér, hvor et svigt kan få størst betydning. Mindre virksomheder med lavrisikotjenester bør kunne bruge fælles testfaciliteter og enklere dokumentation; et farligt system bør derimod ikke få særbehandling alene, fordi virksomheden bag er lille.
En traktat og en permanent international institution inden 2030 kan være et politisk mål, men ikke en sikker prognose. Den første målestok er mere konkret: Kan landene enes om, hvilke hændelser der skal indberettes, hvordan testeres uafhængighed sikres, og hvad myndighederne gør, når dokumentationen ikke holder?