Evan Hubingers vurdering på over 10 procent er personlig – ikke Anthropics officielle holdning eller videnskabelig konsensus. Konflikten handler mindre om, hvorvidt nutidens AI modeller er akut farlige, og mere om, hvorvidt udviklingen bør fortsætte mod selvforbedrende systemer, før sikkerheden er dokumenteret.
Udgivet afRedigeret med GPT-5.6 TerraBilleder genereret med GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Anthropic alignment science lead Evan Hubinger’s public statement that he personally believes there is more than a 10% chance AI co. Article summary: Hubinger’s statement chiefly exposed a sharp mismatch between frontier-AI labs’ public safety posture and the private-level uncertainty described by people closest to the work: a senior alignment lead said the field may . Topic tags: general, general web, news, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
Evan Hubingers offentlige udtalelse dokumenterer ikke, at AI vil føre til menneskehedens udslettelse. Den gjorde noget mere afgrænset – og usædvanligt væsentligt: Lederen af alignment-forskning hos Anthropic sagde, at han personligt vurderer sandsynligheden til over 10 procent inden for det næste årti, samtidig med at han erkendte, at Anthropic endnu ikke har en plan for at løse alignment for superintelligens eller en klart fastlagt vej til at gøre det. 1
2
Alignment betyder her problemet med at sikre, at meget avancerede AI-systemer fortsat handler i overensstemmelse med menneskelige mål og begrænsninger. Udtalelsen gav konkret tyngde til den bekymring, som den tidligere Anthropic- og OpenAI-forsker Jacob Coxon fremførte ved sin opsigelse: At de førende laboratorier kan være på vej mod langt stærkere systemer, selv om metoderne til pålideligt at holde dem under menneskelig kontrol endnu ikke er afprøvet. 2
3
Tallet på »over 10 procent« var Hubingers egen vurdering. Det blev ikke fremlagt som Anthropics officielle sandsynlighedsestimat, som enighed blandt medarbejderne eller som en afsluttet videnskabelig prognose. 1
2
Det forbehold er afgørende. En sandsynlighedsvurdering forklarer ikke i sig selv en konkret mekanisme, fastslår ikke en tidslinje og beviser ikke, at en katastrofe er sandsynlig. Hubinger sagde ifølge omtalen også, at risikoen fra de modeller, der findes i dag, er lav. Hans bekymring handler om fremtidige systemer, der kan blive væsentligt mere kapable – blandt andet gennem rekursiv selvforbedring, hvor AI bruges til at udvikle mere kapabel AI. 2
10
Alligevel er udtalelsen bemærkelsesværdig, fordi den kommer fra en person, der leder alignment-arbejde i et stort AI-laboratorium i den teknologiske frontlinje. Det centrale er derfor ikke kun det dramatiske tal, men afstanden mellem stadig stærkere AI-kapabiliteter og sikker viden om, hvorvidt superintelligente systemer kan holdes under menneskelig kontrol. 1
2
Coxon, der har arbejdet både hos OpenAI og Anthropic, sagde op med kritik af, at ingen af virksomhederne handlede ansvarligt, og at begge ræser mod selvforbedrende superintelligens. Hubinger tilsluttede sig offentligt Coxons påstand om, at folk, der bygger systemerne, oprigtigt anser udfald på niveau med menneskelig udslettelse som mulige. 2
3
Det beviser ikke, at alle ansatte deler samme synspunkt, og det gør ikke Coxons beretning til en uafhængigt verificeret vurdering af begge virksomheder. Men det gør det sværere at afvise hans opsigelse som en enkelt tidligere medarbejders utilfredshed. En nuværende leder på alignment-området bekræftede den bagvedliggende pointe: Dybt alvorlige interne bekymringer kan eksistere side om side med fortsat udvikling af AI i frontlinjen. 1
2
Samuel Marks’ relaterede udtalelser bør læses med samme forsigtighed. Omtalen beskriver ham som en, der sagde, at AI-udviklere mener, at teknologien kan føre til menneskelig udslettelse eller lignende alvorlige udfald. Det er imidlertid et insiderperspektiv – ikke offentliggjort belæg for en virksomhedsdækkende risikovurdering. 5
Sagen bliver ofte reduceret til »AI-dommedag mod AI-optimisme«. Det mere brugbare spørgsmål er praktisk: Hvilke sikkerhedskrav bør gælde, når en mulig skade kan være global og uoprettelig, mens sandsynlighed og tidshorisont er meget usikre?
Hubingers udtalelser skærper især fire spørgsmål:
Det er problemer med styring og regulering – ikke bevis for en nært forestående katastrofe. Men netop den slags problemer kan være langt sværere at løse, hvis systemerne først får farlige kapabiliteter.
Der har været rapporter om, at Anthropic ikke indsendte sin seneste model til det britiske AI Safety Institute til test før lanceringen. Oplysningen bør behandles forsigtigt: De tilgængelige beretninger beskriver den som en rapport, ikke som en offentligt bekræftet konklusion fra virksomheden eller den britiske regering. 10
Alligevel illustrerer påstanden, hvorfor frivillige sikkerhedsløfter mødes med skepsis. Når virksomhedens egne sikkerhedsfolk anerkender uløste alignment-udfordringer, er det rimeligt at spørge: Hvilke test blev gennemført? Hvem gennemgik dem? Hvilke resultater blev delt? Og hvilke kapabilitetsgrænser udløser skærpede kontroller?
Et krav om at sænke tempoet behøver ikke at betyde et permanent stop for al AI-forskning eller udrulning. Det politiske argument handler snarere om håndhævelige kontroller, før systemer passerer særligt betydningsfulde kapabilitetsgrænser.
Mulige tiltag kan være:
Begrundelsen er enkel: Hvis sandsynligheden er usikker, men konsekvensen kan være ekstrem, skal sikkerhedsforanstaltninger kunne dokumenteres før – ikke efter – et muligt kontroltab.
Hubingers opslag blotlægger en spænding i centrum af AI-udviklingen i frontlinjen: Ledende udviklere kan offentligt anerkende alvorlige langsigtede risici, samtidig med at de fortsætter med at bygge mod de kapabiliteter, der gør risiciene mere presserende. 1
2
Udtalelsen afgør hverken sandsynligheden for katastrofal AI-skade eller bør læses som Anthropics officielle forudsigelse. Den gør dog alignment-debatten mere konkret. Spørgsmålet er ikke længere kun, om avanceret AI kan blive farlig. Det er, om virksomheder og regeringer gennem uafhængig dokumentation, håndhævelige regler og international koordinering kan vise, at de er klar, før de relevante systemer bliver for stærke til at styre forsvarligt. 1
10
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Evan Hubingers vurdering på over 10 procent er personlig – ikke Anthropics officielle holdning eller videnskabelig konsensus.
Evan Hubingers vurdering på over 10 procent er personlig – ikke Anthropics officielle holdning eller videnskabelig konsensus. Konflikten handler mindre om, hvorvidt nutidens AI modeller er akut farlige, og mere om, hvorvidt udviklingen bør fortsætte mod selvforbedrende systemer, før sikkerheden er dokumenteret.
Sagen flytter fokus til gennemsigtighed, uafhængige tests, bindende regler og internationalt samarbejde frem for en simpel kamp mellem AI optimister og AI pessimister.