Google DeepMind-medstifter Shane Legg har et klart budskab: AI-systemernes evner må ikke udvikle sig hurtigere end de sikkerhedsforanstaltninger, der skal kunne overvåge og kontrollere dem. Advarslen kom i forbindelse med lanceringen af DeepMind Institute (DMI), et nyt forum om udrulningen og konsekvenserne af kunstig generel intelligens, AGI.
1
41
Sikkerhed skal følge med kapabiliteterne
Leggs pointe handler ikke kun om, at modeller bliver dygtigere. Det afgørende er, om overvågning, styring, kontrol og governance kan følge med hurtigt nok til, at stadig mere kraftfulde systemer fortsat kan håndteres forsvarligt.
1
Derfor rækker instituttets formål også videre end rent teknisk AI-forskning. DMI skal fremme tværfaglig forskning, samarbejde og debat om AGI-æraens centrale tekniske og samfundsmæssige spørgsmål – herunder hvordan AGI-systemer og fællesskaber af AI-agenter kan bygges og styres sikkert.
16
Et forum – ikke et nyt AI-laboratorium
DeepMind Institute er en platform for publikationer og debat, ikke en erstatning for Google DeepMinds almindelige AI-forskning. Ambitionen er at samle bidrag fra Google DeepMind og det bredere forskningsmiljø om, hvordan stadig mere kapabel AI bør udvikles, reguleres, implementeres og bruges.
36
42
Emnerne spænder over videnskab, uddannelse, samfund, politik, filosofi, økonomi, sikkerhed og menneskelig trivsel. Det handler dermed både om at begrænse alvorlige risici og om at drøfte, hvilke institutioner, politikker og samfundsmål der kan kræve nytænkning, hvis AGI får bred udbredelse.
16
36
Åben for langsommere lanceringer af de stærkeste modeller
Legg kaldte Anthropic-chef Dario Amodeis forslag om at sænke tempoet – men ikke sætte det helt på pause – for lanceringen af de mest avancerede AI-modeller for „interessant i sin retning“ og „værd at overveje“.
2
Det er ikke en annonceret politik fra DeepMind. Men udtalelsen viser, at Legg betragter et mere forsigtigt udrulningstempo som en reel mulighed i debatten om at sikre, at beskyttelsesforanstaltningerne matcher teknologien.
2
AGI er efter hans vurdering ikke nået endnu
Legg mener, at det er for tidligt at erklære AGI for opnået, selv om ledere fra Nvidia og OpenAI for nylig har fremsat sådanne påstande. Der er ikke offentliggjort en detaljeret direkte forklaring på alle de konkrete kapabilitetsmangler, han henviser til. Den mest forsigtige konklusion er derfor, at han ikke mener, nutidens systemer opfylder DeepMinds tærskel for AGI.
4
Google DeepMind beskriver AGI som et system med den menneskelige hjernes kognitive evner. Det er en langt bredere målestok end at være fremragende på enkelte benchmarks eller afgrænsede opgaver.
13
Samtidig holder Legg fast i sin mangeårige vurdering: Han er fortsat „komfortabel“ med, at der er 50 procents sandsynlighed for at nå „minimal“ AGI i 2028. Det er en prognose – ikke en bekræftet tidsplan.
2
10
De første essays: fra gennemsigtighed til økonomi
Ved lanceringen udgav instituttet en introduktion og flere faglige essays. Tre af de tidlige emner viser, at perspektivet er bredere end AI-sikkerhed alene:
- Gennemsigtighed i ræsonnementer: Rohin Shah og Anca Dragan argumenterer for at bevare ræsonnementer, som mennesker kan fortolke, så modeller kan overvåges for bedrag eller skjult planlægning.
11
- Økonomisk politik for AGI: Et essay vurderer 11 mulige politiske tiltag mod den potentielle økonomiske uro fra mere avanceret og udbredt AI. Vurderingen omfatter blandt andet velfærd, robusthed, handlekraft og økonomisk stabilitet.
39
- Principper for en ny utopisme: Essayet undersøger, hvad menneskelig trivsel kan betyde i et samfund præget af AGI, men advarer mod at gøre „utopi“ til et løfte om perfektion.
37
Instituttet har desuden et fjerde fagligt lanceringessay på listen: „A framework for frontier AI and the dawning of a new age“, ved siden af introduktionen og de tre emner ovenfor.
41
38
Hovedpointen
Leggs synspunkt kombinerer hastværk med tilbageholdenhed. Han afviser, at AGI allerede er en realitet, men tillægger stadig minimal AGI i 2028 en betydelig sandsynlighed. Hans advarsel handler derfor mindre om én bestemt dato end om et krav til styringen af teknologien: Accelererer AI-kapaciteterne, skal vores evne til at forstå, overvåge og forme anvendelsen accelerere med dem.
1
2
16