Evan Hubingers schatting van meer dan 10% is persoonlijk, geen officieel Anthropic standpunt of wetenschappelijke consensus. De kern van het conflict gaat niet over acuut gevaar van de huidige modellen — Hubinger noemt dat risico laag — maar over de vraag of labs sneller richting zelfverbeterende AI gaan dan de veil...
Gepubliceerd doorBewerkt met GPT-5.6 TerraAfbeeldingen gegenereerd met GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Anthropic alignment science lead Evan Hubinger’s public statement that he personally believes there is more than a 10% chance AI co. Article summary: Hubinger’s statement chiefly exposed a sharp mismatch between frontier-AI labs’ public safety posture and the private-level uncertainty described by people closest to the work: a senior alignment lead said the field may . Topic tags: general, general web, news, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
Evan Hubingers publieke uitspraak bewijst niet dat AI de mensheid zal uitroeien. Wel deed hij iets opvallends: de leider van het alignment-onderzoek bij Anthropic zei dat hij persoonlijk de kans daarop binnen tien jaar op meer dan 10% schat. Tegelijk erkende hij dat Anthropic nog geen plan heeft om alignment voor superintelligentie op te lossen, en ook niet duidelijk op weg is naar zo’n oplossing. 1
2
Met alignment wordt bedoeld dat een AI-systeem betrouwbaar handelt in lijn met menselijke doelen en grenzen — ook wanneer het veel capabeler wordt dan huidige systemen. Juist de combinatie van Hubingers inschatting en die onopgeloste technische vraag geeft gewicht aan de zorg van voormalig Anthropic- en OpenAI-onderzoeker Jacob Coxon. Volgens Coxon werken toonaangevende labs toe naar veel krachtigere, mogelijk zelfverbeterende systemen, terwijl nog niet is aangetoond hoe die veilig onder menselijke controle blijven. 2
3
De grens van „meer dan 10%” was Hubingers eigen inschatting. Hij presenteerde die niet als officiële kansberekening van Anthropic, als een gedeeld oordeel van het personeel of als een vaststaande wetenschappelijke prognose. 1
2
Dat onderscheid is essentieel. Een kansinschatting verklaart op zichzelf niet via welk mechanisme een ramp zou ontstaan, bewijst geen tijdlijn en betekent niet dat een ramp waarschijnlijk is. Hubinger zei volgens berichten ook dat het risico van de modellen die nu beschikbaar zijn laag is. Zijn zorg betreft toekomstige systemen die aanzienlijk capabeler worden, mogelijk door recursieve zelfverbetering: AI die helpt om nog krachtigere AI te ontwikkelen. 2
10
Toch is de uitspraak opmerkelijk, juist omdat ze komt van iemand die bij een belangrijk frontier-AI-lab alignmentwerk leidt. Het nieuws zit dus niet alleen in het getal, maar in de kloof die hij beschrijft: de capaciteiten nemen toe, terwijl er geen bewezen manier is om superintelligente systemen onder controle te houden. 1
2
Coxon, die zowel bij OpenAI als Anthropic werkte, nam ontslag met de stelling dat geen van beide bedrijven verantwoord handelt en dat ze een wedloop voeren naar zelfverbeterende superintelligentie. Hubinger onderschreef publiekelijk Coxons bredere punt dat de mensen die deze systemen bouwen de mogelijkheid van uitstervingsscenario’s oprecht serieus nemen. 2
3
Daarmee is niet aangetoond dat alle medewerkers dezelfde mening hebben. Ook verandert Coxons relaas niet in een onafhankelijk bevestigde beoordeling van beide bedrijven. Maar zijn ontslag is hierdoor moeilijker weg te zetten als alleen de klacht van één voormalige werknemer: een zittende alignmentleider bevestigde dat grote interne zorgen kunnen samengaan met het verder ontwikkelen van frontiermodellen. 1
2
De gerapporteerde opmerkingen van Samuel Marks vragen om dezelfde nuance. Hij zou hebben gezegd dat AI-ontwikkelaars denken dat hun technologie menselijke uitsterving of vergelijkbaar ernstige gevolgen kan veroorzaken. Dat is een insiderperspectief, geen gepubliceerde bedrijfsbrede risicoanalyse. 5
Het debat wordt vaak teruggebracht tot „AI-doemdenken versus AI-optimisme”. De praktischere vraag is welke waarborgen nodig zijn wanneer mogelijke schade mondiaal en onomkeerbaar kan zijn, maar kans en tijdpad sterk onzeker blijven.
Hubingers opmerkingen verscherpen vier punten:
Dit zijn problemen van bestuur en toezicht, geen bewijs dat een ramp ophanden is. Maar juist zulke problemen zijn lastiger te herstellen zodra systemen gevaarlijke capaciteiten hebben bereikt.
Volgens berichtgeving zou Anthropic zijn nieuwste model vóór de release niet hebben aangeboden aan het Britse AI Safety Institute voor tests. Die melding moet voorzichtig worden gelezen: de beschikbare berichtgeving beschrijft dit als een rapport, niet als een publiek bevestigde vaststelling van Anthropic of de Britse overheid. 10
De kwestie illustreert wel waarom vrijwillige veiligheidsbeloften op scepsis stuiten. Als veiligheidsleiders van een bedrijf zelf erkennen dat alignmentvraagstukken onopgelost zijn, ligt de vraag voor de hand: welke tests zijn gedaan, wie heeft ze beoordeeld, welke resultaten zijn gedeeld en bij welke capaciteitsdrempels gelden zwaardere maatregelen?
Oproepen om te vertragen betekenen niet automatisch dat alle AI-onderzoek en toepassingen permanent moeten stoppen. De beleidsvraag is eerder of er afdwingbare controles moeten zijn vóór systemen bijzonder ingrijpende capaciteitsdrempels overschrijden.
Denkbare maatregelen zijn:
De gedachte daarachter is eenvoudig: als de kans onzeker is maar de mogelijke schade extreem, moeten waarborgen aantoonbaar zijn vóór — niet pas na — een verlies van controle.
Hubingers bericht toont de spanning in de kern van frontier-AI: toonaangevende ontwikkelaars kunnen zware langetermijnrisico’s publiek erkennen en tegelijk blijven werken aan de capaciteiten die die risico’s urgenter maken. 1
2
Zijn uitspraak beslecht niet hoe groot de kans op catastrofale AI-schade werkelijk is, en moet niet worden gelezen als een officiële voorspelling van Anthropic. Ze maakt het alignmentdebat wel tastbaarder. Niet alleen de vraag of geavanceerde AI gevaarlijk kán worden telt, maar vooral of bedrijven en overheden met onafhankelijke onderbouwing, afdwingbare regels en internationale samenwerking kunnen laten zien dat ze voorbereid zijn vóór zulke systemen te machtig worden om veilig te besturen. 1
10
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Evan Hubingers schatting van meer dan 10% is persoonlijk, geen officieel Anthropic standpunt of wetenschappelijke consensus.
Evan Hubingers schatting van meer dan 10% is persoonlijk, geen officieel Anthropic standpunt of wetenschappelijke consensus. De kern van het conflict gaat niet over acuut gevaar van de huidige modellen — Hubinger noemt dat risico laag — maar over de vraag of labs sneller richting zelfverbeterende AI gaan dan de veiligheidsmethoden kunnen bi...
De kwestie legt de nadruk op toetsbaar extern toezicht, transparantie over tests en internationale afspraken, in plaats van op een simpel kampdenken tussen AI optimisten en doemdenkers.