Volgens voormalig Anthropic en OpenAI onderzoeker Jacob Coxon kan een noodstop nu voor veel AI systemen werken, maar zou die in de praktijk uit veel afzonderlijke uitschakelhandelingen bestaan. De inzet verschuift van een beloofde uitknop naar controleerbare waarborgen: onafhankelijke beoordelaars moeten kunnen naga...
Gepubliceerd doorBewerkt met GPT-5.6 TerraAfbeeldingen gegenereerd met GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did former Anthropic and OpenAI researcher Jacob Coxon, following his September 9 resignation and warning that AI could potentially cau. Article summary: The central dispute is not whether current AI systems have any shutdown controls, but whether those controls will remain usable as systems become more autonomous, distributed, and strategically capable. The evidence supp. Topic tags: general, news, general web, user generated, government. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermar
Een AI-«kill switch» of noodstop gaat niet alleen over de vraag of een bedrijf één model kan uitzetten. De moeilijkere vraag is of zo’n mechanisme nog functioneert wanneer krachtige AI over veel servers, datacentra en netwerken is verspreid — of zelfstandig buiten één gecontroleerde omgeving opereert.
Jacob Coxon, voormalig onderzoeker bij Anthropic en OpenAI, zei bij NBC News’ Meet the Press dat een noodstop voor veel huidige AI-systemen waarschijnlijk zou werken. Dat betekent volgens hem echter niet dat iemand letterlijk één knop omzet: bij grote datacentra en uitgerolde systemen zijn veel onderdelen en uitschakelacties betrokken. Zolang een systeem aan één fysieke locatie gebonden blijft, acht hij dat lastig maar uitvoerbaar. 8
Zijn zorg gaat over de volgende fase. Als AI een verspreide, autonome «zwerm» wordt, kan een centraal uitschakelbevel technisch ineffectief worden, waarschuwde Coxon. De cruciale vraag is dan bereik: een controlemechanisme werkt alleen als het elk actief exemplaar van het systeem kan bereiken.
Na zijn vertrek bij Anthropic waarschuwde Coxon breder dat toonaangevende labs zich haasten naar zelfverbeterende AI-systemen, terwijl die mogelijk onbeheersbaar kunnen worden. 1
50
Anthropic-medeoprichter Jack Clark vindt dat het vermogen om een gevaarlijk AI-systeem uit te schakelen uiteindelijk wettelijk verplicht zou kunnen worden. Het zou dan niet slechts een vrijwillige toezegging van het ontwikkelende bedrijf zijn. Tegen de BBC zei hij dat de meeste grote labs, waaronder Anthropic, al manieren hebben om systemen stil te leggen. Hij stelde wel de vraag of een externe partij zo’n noodstop onafhankelijk moet kunnen verifiëren. 33
Dat verschil is wezenlijk. Een lab kan verklaren dat het een uitschakelprocedure heeft; een onafhankelijke beoordelaar kan nagaan of die procedure bestaat, goed is ontworpen en in een noodsituatie daadwerkelijk inzetbaar is.
Anthropic-topman Dario Amodei heeft een kader voorgesteld om de ontwikkeling van zogeheten frontier AI — de meest geavanceerde modellen — minder snel te laten gaan dan de veiligheidsmaatregelen kunnen bijbenen. Zijn plan bestaat uit drie onderdelen:
Dit is geen oproep om AI-onderzoek volledig stil te leggen. Het uitgangspunt is dat verdere ontwikkeling afhankelijk moet zijn van veiligheidsmaatregelen die ook buiten de bedrijven zelf kunnen worden gecontroleerd.
Reuters meldde dat OpenAI-topman Sam Altman en xAI-leider Elon Musk publiekelijk steun uitspraken voor de grote lijn van Amodei’s voorstel. Altman zei dat OpenAI het idee van onafhankelijke beoordelaars met toegang op werknemersniveau zou overnemen. Musk schreef: «Dario heeft gelijk.» 17
Ook Google DeepMind-topman Demis Hassabis werd in berichtgeving als positief over de richting van het voorstel beschreven. 30 Over een concrete, toerekenbare reactie van Microsoft-topman Satya Nadella bevat de aangeleverde berichtgeving geen onderbouwing. Zijn standpunt als steun of afwijzing presenteren zou daarom voorbarig zijn.
H.R. 9917, de voorgestelde AI Kill Switch Act, zou de Homeland Security Act aanpassen. Bepaalde organisaties zouden technische mogelijkheden moeten behouden om inferentie — het uitvoeren van een AI-model — te stoppen, gebruikerstoegang te beëindigen en onder de wet vallende AI-technologie uit te schakelen. 49
Het gaat om een wetsvoorstel, niet om een bewezen antwoord op elk beheersingsprobleem. De praktische waarde hangt af van de vraag of een ontwikkelaar een relevant systeem bij een ernstig incident nog kan identificeren, bereiken en uitschakelen. Precies dat is de uitdaging waarop Coxon wijst bij mogelijk verspreide systemen in de toekomst.
Anthropic-onderzoeker Evan Hubinger schatte persoonlijk de kans dat AI binnen tien jaar tot menselijke uitsterving leidt op meer dan 10%. Computerwetenschapper Geoffrey Hinton noemde een kans van 10% tegenover de BBC «niet onredelijk». 57
Dit zijn deskundige oordelen over een onzekere toekomst, geen gemeten kansen en geen wetenschappelijke consensus. Ze maken wel duidelijk waarom het debat over uitschakeling verder reikt dan gewone productveiligheid: voorstanders van strengere maatregelen stellen dat zelfs een relatief kleine kans op een onomkeerbare ramp stevige waarborgen rechtvaardigt.
De Britse regering heeft een nationaal voorstel voor een AI-noodstop afgewezen. De overheid stelt dat het Verenigd Koninkrijk AI niet simpelweg kan «uitzetten»: toegang tot modellen in het land blokkeren voorkomt niet dat zij elders worden ontwikkeld of misbruikt. 51
Daarmee raakt zij aan het geopolitieke probleem. Een land kan regels opleggen aan bedrijven en infrastructuur binnen zijn eigen rechtsgebied, maar AI-ontwikkeling is internationaal. Overheden die beducht zijn voor verlies aan concurrentiekracht kunnen vrezen dat eenzijdige beperkingen investeringen, technische kennis en strategische invloed naar minder gereguleerde concurrenten verplaatsen.
Voorstanders van zwaarder toezicht voeren juist aan dat vrijwillige bedrijfsbeloften en louter nationale regels daarom onvoldoende zijn. Als de risico’s grensoverschrijdend zijn, moeten toezicht en veiligheidsafspraken volgens hen ook internationaal geloofwaardig zijn.
De tegenstelling loopt niet simpelweg tussen voor- en tegenstanders van AI.
Een noodstop is dus het best te zien als één laag in een breder veiligheidssysteem, niet als vervanging daarvan. Als geavanceerde systemen uiteindelijk te verspreid raken voor één centrale schakelaar, worden toezicht vóór uitrol, onafhankelijke evaluatie en internationale samenwerking alleen maar belangrijker.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Volgens voormalig Anthropic en OpenAI onderzoeker Jacob Coxon kan een noodstop nu voor veel AI systemen werken, maar zou die in de praktijk uit veel afzonderlijke uitschakelhandelingen bestaan.
Volgens voormalig Anthropic en OpenAI onderzoeker Jacob Coxon kan een noodstop nu voor veel AI systemen werken, maar zou die in de praktijk uit veel afzonderlijke uitschakelhandelingen bestaan. De inzet verschuift van een beloofde uitknop naar controleerbare waarborgen: onafhankelijke beoordelaars moeten kunnen nagaan of veiligheidsprocedures werkelijk werken.
Het Amerikaanse wetsvoorstel AI Kill Switch Act is nog geen wet. De Britse regering stelt intussen dat nationale uitschakelmaatregelen AI ontwikkeling of misbruik in andere landen niet voorkomen.