Anthropic sier at det stanset forsøk på misbruk av Claude Haiku, Sonnet og Opus fra desember 2025 til august 2026, innen sju skadeområder – blant annet våpen, overvåking, biologi og modelldestillasjon. Hovedpoenget er at kraftig AI kan redusere behovet for tid, arbeidskraft og spesialkompetanse i skadelig virksomhet.
Publisert avRedigert med GPT-5.6 TerraBilder generert med GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Anthropic’s 154-page September 10, 2026 threat-intelligence report reveal about adversaries’ eight-month misuse of its Claude Haiku. Article summary: Anthropic’s report documented attempted misuse—not verified successful deployment—of older Claude Haiku, Sonnet, and Opus models across seven harm areas from December 2025 through August 2026. Its core warning was that f. Topic tags: general, news, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers
Anthropics trusselrapport, publisert 10. september 2026, beskriver operasjoner selskapet sier at det identifiserte og stanset i løpet av åtte måneder – fra desember 2025 til august 2026. Sakene gjaldt forsøk på å misbruke Claude Haiku, Sonnet og Opus til cyberoperasjoner, påvirkningsoperasjoner, overvåking, svindel, biologisk misbruk, utvikling av konvensjonelle våpen og ulovlig modelldestillasjon. 16
Det viktigste forbeholdet er dette: Rapporten handler om forsøk på å få AI-hjelp, ikke om bekreftet utplassering eller vellykket gjennomføring av de påståtte våpen-, overvåkings- eller biologiprosjektene. Anthropic presenterer dessuten sakene som utvalgte eksempler, ikke som et bilde av normal bruk av Claude. 16
Anthropics overordnede advarsel er at avanserte språkmodeller kan senke terskelen for skadelig virksomhet ved å redusere behovet for spesialkunnskap, tid og bemanning. I de offentliggjorte sakene skal aktørene ha etterspurt hjelp til alt fra research og programvareutvikling til målutvelgelse og operativ analyse. 1
16
Blant de mest alvorlige påstandene er forsøk på å bruke Claude til arbeid knyttet til konvensjonelle våpen og overvåking. Dekningen av rapporten omtalte forsøk relatert til programvare for autonome angrepsdroner, missilnavigasjon og militære anvendelser knyttet til aktører med forbindelser til Russland, Iran, Kina og Jemen. 1
Saksmaterialet omfattet også påståtte forsøk på å identifisere og målrette uigurer via WhatsApp og Telegram, samt et storskala system for teleovervåking i Mali. Eksemplene illustrerer Anthropic sitt bredere poeng: Modeller kan brukes til mer enn kodegenerering – også til research, klassifisering, analyse og utforming av operative dokumenter. 1
16
Anthropic identifiserte fem saker om biologisk misbruk. Én av dem handlet, ifølge omtalen av rapporten, om et forsøk knyttet til å øke smittsomheten til et myggoverført virus. 1
Selskapet opplyste også at enkelte brukere søkte mot konkurrerende AI-systemer etter at Claude avslo sensitive forespørsler. Det beviser ikke at forsøkene lyktes hos andre tilbydere, men viser en begrensning ved kontroll hos én enkelt aktør: Et avslag kan avbryte aktiviteten på én tjeneste, uten nødvendigvis å hindre at aktøren prøver andre alternativer. 1
Et eget kapittel handlet om ulovlig modelldestillasjon – altså bruk av svar fra en mer kapabel modell for å bidra til å trene opp et annet system. Anthropic tilskrev kampanjer til sju Kina-baserte laboratorier, blant dem Alibaba, Moonshot og DeepSeek. Selskapet beskrev bruk av mange kontoer og videresendte forespørsler for å hente ut nyttige modellsvar eller resonnering. 1
Dette er en annen type misbruk enn våpenutvikling eller overvåking, men innebærer en strategisk utfordring for AI-utviklere: Tilgang til en modell kan utnyttes til å gjenskape kapabiliteter og potensielt omgå kostnaden ved å utvikle dem på egen hånd.
Anthropic oppga at sakene omfattet Claude Haiku, Sonnet og Opus. Ifølge selskapet omfattet ingen av sakene de nyere modellklassene Fable eller Mythos – med ett unntak: en sak om ulovlig destillasjon. 12
16
Unntaket er viktig. Det er derfor for upresist å si at Fable og Mythos var fullstendig fraværende fra rapporten. Det tilgjengelige grunnlaget støtter en smalere konklusjon: De ble ikke brukt i de offentliggjorte misbrukssakene, bortsett fra destillasjonsunntaket. 12
Anthropic sier at det stanset operasjonene, utestengte de aktuelle kontoene, styrket forsvarsarbeidet og delte informasjon med myndigheter og industripartnere der det var relevant. 16
Likevel er rapporten selskapets egen redegjørelse for aktivitet observert på egen plattform. Den er verdifull dokumentasjon på hva Anthropic oppdaget og reagerte på, men er ikke en uavhengig bekreftelse på at hver påståtte aktør fullførte prosjektet sitt. Selskapet rammer selv inn rapporten som en samling bemerkelsesverdige saker, ikke en representativ kartlegging av all misbruk. 16
To dager etter rapporten publiserte Anthropics toppsjef Dario Amodei essayet We Must Pace the Frontier. Der argumenterte han for at AI-selskaper bevisst bør senke tempoet i forbedringen av de mest avanserte modellenes kapabiliteter, slik at arbeid med sikkerhet, kontroll og etterprøving kan ta igjen utviklingen. 25
Amodei tok ikke til orde for å stanse modelltrening. Det første konkrete løftet var i stedet at Anthropic skal gi tredjepartsevaluatorer permanent tilgang på nivå med ansatte, slik at de kan vurdere sikkerhetspraksis, rapportere hendelser og evaluere modelltilpasning under trening. 18
25
Den bredere planen hans består av tre trinn: kontroll på selskapsnivå, samordning mellom selskaper i demokratiske land og til slutt et videre internasjonalt samarbeid. 23
25
Rapporten fastslår at Anthropic sier det oppdaget og stanset forsøk på skadelig bruk av eldre Claude-modeller i den oppgitte perioden, på tvers av sju skadeområder. Den gir også selskapet et konkret grunnlag for argumentet om at sikkerhetstiltak må utvikles parallelt med modellkapabilitetene. 16
Det tilgjengelige kildematerialet fastslår derimot ikke at rapporten direkte utløste bestemte tiltak i den amerikanske Kongressen, avbrøt en pause i Representantenes hus eller førte til et konkret lovforbud mot «superintelligens». Det finnes et bredere politisk press for AI-sikkerhetstilsyn, og Amodei har argumentert for at myndighetene bør bidra til balanse mellom kapabiliteter og sikkerhet. Men slike konkrete årsakssammenhenger krever mer dokumentasjon enn materialet her gir. 25
27
Den praktiske lærdommen er mindre dramatisk, men viktig: Å hindre AI-misbruk handler ikke bare om at en modell sier nei til skadelige spørsmål. Det krever overvåking av koordinert misbruk, respons på kontoomgåelser og destillasjonsforsøk, deling av trusselinformasjon og troverdig sikkerhetsevaluering i takt med at modellene blir kraftigere. 16
25
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Anthropic sier at det stanset forsøk på misbruk av Claude Haiku, Sonnet og Opus fra desember 2025 til august 2026, innen sju skadeområder – blant annet våpen, overvåking, biologi og modelldestillasjon.
Anthropic sier at det stanset forsøk på misbruk av Claude Haiku, Sonnet og Opus fra desember 2025 til august 2026, innen sju skadeområder – blant annet våpen, overvåking, biologi og modelldestillasjon. Hovedpoenget er at kraftig AI kan redusere behovet for tid, arbeidskraft og spesialkompetanse i skadelig virksomhet.
Etter rapporten tok toppsjef Dario Amodei til orde for å «tempojustere frontlinjen»: Senke farten i kapabilitetsutviklingen slik at sikkerhetsarbeid og uavhengig kontroll kan holde tritt, uten å stanse AI utviklingen.