Anthropic uvádí, že mezi prosincem 2025 a srpnem 2026 narušil pokusy o zneužití Claude Haiku, Sonnet a Opus v sedmi oblastech škod, včetně zbraní, sledování, biologie a distilace modelů. Zásadní sdělení zprávy zní, že schopná AI může snížit množství práce a odborných znalostí potřebných ke škodlivé činnosti.
PublikovalUpraveno pomocí GPT-5.6 TerraObrázky vytvořeny pomocí GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Anthropic’s 154-page September 10, 2026 threat-intelligence report reveal about adversaries’ eight-month misuse of its Claude Haiku. Article summary: Anthropic’s report documented attempted misuse—not verified successful deployment—of older Claude Haiku, Sonnet, and Opus models across seven harm areas from December 2025 through August 2026. Its core warning was that f. Topic tags: general, news, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers
Anthropic ve své zprávě z 10. září 2026 popisuje operace, které jeho tým pro zpravodajství o hrozbách podle vlastních slov odhalil a narušil během osmi měsíců – od prosince 2025 do srpna 2026. Případy se týkaly pokusů zneužít Claude Haiku, Sonnet a Opus pro kybernetické operace, vlivové kampaně, sledování, podvody, biologické zneužití, vývoj konvenčních zbraní a nedovolenou distilaci modelů. 16
Je důležité rozlišovat, co zpráva skutečně dokládá: popisuje pokusy získat pomoc AI, nikoli nezávisle ověřené nasazení či úspěch údajných zbraňových, sledovacích nebo biologických projektů v praxi. Anthropic navíc předkládá vybrané významné případy, nikoli statistický obraz běžného používání Claude. 16
Hlavní varování Anthropicu je, že pokročilé modely mohou snížit objem specializovaných znalostí, času i personálních kapacit nutných pro škodlivou činnost. V popsaných případech měli údajní aktéři žádat pomoc se vším od rešerší a vývoje softwaru po podklady k volbě cílů a operační analýzy. 1
16
Mezi nejzávažnější tvrzení patří pokusy využít Claude při práci související s konvenčními zbraněmi a sledováním. Média popisující zveřejněné informace uváděla snahy spojené se softwarem pro autonomní jednosměrné útočné drony, navigačními systémy střel a vojenskými aplikacemi přisuzovanými aktérům napojeným na Rusko, Írán, Čínu a Jemen. 1
Materiály dále zahrnovaly údajné pokusy identifikovat a cílit na Ujgury přes WhatsApp a Telegram i rozsáhlý telekomunikační sledovací systém v Mali. Tyto příklady ilustrují širší problém: jazykové modely neslouží jen ke generování kódu, ale také k rešerším, klasifikaci, analýze a vytváření operačních dokumentů. 1
16
Anthropic identifikoval pět případů biologického zneužití. Jeden se podle zpravodajství o zprávě týkal pokusu souvisejícího se zvýšením přenosnosti viru šířeného komáry. 1
Společnost také uvedla, že někteří uživatelé po odmítnutí citlivých dotazů v Claude vyhledávali konkurenční AI systémy. To nedokazuje, že jejich snahy uspěly jinde. Ukazuje to ale hranici kontrol jednotlivého poskytovatele: odmítnutí může aktivitu přerušit na jedné službě, aniž by aktérovi zabránilo hledat alternativu. 1
Samostatná část zprávy se věnovala nedovolené distilaci modelů – využívání výstupů schopnějšího modelu k trénování jiného systému. Anthropic připsal takové kampaně sedmi laboratořím z Číny, včetně Alibaba, Moonshot a DeepSeek. Popsal využívání velkého množství účtů a předávaných promptů k získání užitečných výstupů či postupů uvažování modelu. 1
Jde o jiný typ zneužití než vývoj zbraní nebo sledování, pro vývojáře AI však představuje strategický problém. Přístup k modelu může být využit k napodobení jeho schopností a potenciálně obejití nákladů na jejich samostatný vývoj.
Anthropic uvádí, že popsané případy zneužití se týkaly Claude Haiku, Sonnet a Opus. Novější modelové třídy Fable a Mythos se v případech neobjevily – s jedinou výjimkou distilace modelu. 12
16
Tato výjimka je podstatná, protože koriguje příliš široké tvrzení, že Fable a Mythos ve zprávě nebyly vůbec. Dostupné podklady podporují přesnější závěr: v odhalených případech zneužití použity nebyly, vyjma jednoho případu distilace. 12
Anthropic uvedl, že operace narušil, související účty zablokoval, posílil obranu a tam, kde to bylo vhodné, sdílel informace s úřady a partnery v oboru. 16
Zpráva je ale zároveň dokumentem společnosti o aktivitě zachycené na její vlastní platformě. Je to cenný doklad toho, co Anthropic odhalil a proti čemu zasáhl, nelze ji však číst jako nezávislé potvrzení, že každý údajný aktér dokončil zamýšlený projekt. I sama firma ji vymezuje jako soubor pozoruhodných případů, nikoli reprezentativní průzkum veškerého zneužívání. 16
Dva dny po zveřejnění zprávy vydal generální ředitel Anthropicu Dario Amodei text We Must Pace the Frontier. Argumentoval v něm, že AI společnosti mají záměrně zpomalit tempo, jímž zvyšují schopnosti špičkových modelů, zatímco technický pokrok bude pokračovat. Cílem je dát více prostoru tomu, aby bezpečnostní opatření, slaďování modelů s lidskými záměry a ověřování dokázaly vývoj dohnat. 25
Amodei nenavrhoval zastavit trénování modelů. Prvním konkrétním závazkem Anthropicu má být trvalý přístup nezávislých hodnotitelů k systémům firmy na úrovni zaměstnanců. Mají tak posuzovat bezpečnostní postupy, hlásit incidenty a hodnotit slaďování modelů během tréninku. 18
25
Jeho širší tříkrokový návrh počítá s dohledem uvnitř jednotlivých společností, koordinací mezi firmami v demokratických zemích a nakonec se širší mezinárodní koordinací. 23
25
Zpráva dokládá, že Anthropic tvrdí, že ve vymezeném období odhalil a narušil pokusy o škodlivé použití starších modelů Claude v sedmi kategoriích rizik. Zároveň nabízí konkrétní zdůvodnění postoje firmy, podle něhož se bezpečnostní opatření musejí vyvíjet spolu se schopnostmi modelů. 16
Dostupné zpravodajství naopak nedokládá, že by zpráva přímo způsobila konkrétní kroky Kongresu USA, ukončení přestávky Sněmovny reprezentantů nebo přijetí určitého zákazu „superinteligence“. Tlak na dohled nad bezpečností AI je širší a Amodei tvrdí, že vlády mají pomáhat udržovat rovnováhu mezi schopnostmi a bezpečností. Uvedené konkrétní příčinné souvislosti by však vyžadovaly další důkazy. 25
27
Praktický závěr je méně dramatický, ale zásadní: prevence zneužití AI nestojí jen na tom, zda model odmítne škodlivý prompt. Vyžaduje sledování koordinovaného zneužívání, reakci na obcházení přes účty a pokusy o distilaci, sdílení informací o hrozbách a důvěryhodné bezpečnostní hodnocení, jak schopnosti modelů rostou. 16
25
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Anthropic uvádí, že mezi prosincem 2025 a srpnem 2026 narušil pokusy o zneužití Claude Haiku, Sonnet a Opus v sedmi oblastech škod, včetně zbraní, sledování, biologie a distilace modelů.
Anthropic uvádí, že mezi prosincem 2025 a srpnem 2026 narušil pokusy o zneužití Claude Haiku, Sonnet a Opus v sedmi oblastech škod, včetně zbraní, sledování, biologie a distilace modelů. Zásadní sdělení zprávy zní, že schopná AI může snížit množství práce a odborných znalostí potřebných ke škodlivé činnosti.
Po zveřejnění zprávy generální ředitel Dario Amodei vyzval k „udržování tempa hranice“: zpomalit růst schopností špičkových modelů tak, aby bezpečnostní práce a nezávislé hodnocení stíhaly držet krok, nikoli zastavit...