Hubingerův odhad vyšší než 10 % je osobní prognóza, nikoli oficiální stanovisko Anthropic ani vědecký konsenzus. Podle Hubingera představují současné modely nízké riziko; obavy se týkají budoucí superinteligence, která by mohla pomáhat vytvářet stále schopnější AI.
PublikovalUpraveno pomocí GPT-5.6 TerraObrázky vytvořeny pomocí GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Anthropic alignment science lead Evan Hubinger’s public statement that he personally believes there is more than a 10% chance AI co. Article summary: Hubinger’s statement chiefly exposed a sharp mismatch between frontier-AI labs’ public safety posture and the private-level uncertainty described by people closest to the work: a senior alignment lead said the field may . Topic tags: general, general web, news, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
Evan Hubinger svým veřejným vyjádřením nedokázal, že umělá inteligence lidstvo vyhubí. Udělal ale něco konkrétnějšího – a pro debatu o bezpečnosti AI mimořádně významného. Vedoucí výzkumu alignmentu ve společnosti Anthropic uvedl, že on osobně přisuzuje možnosti, že AI během příštích deseti let zabije všechny lidi, pravděpodobnost vyšší než 10 %. Současně připustil, že Anthropic zatím nemá plán, jak vyřešit alignment superinteligence, ani jasně prokázanou cestu k takovému řešení. 1
2
Právě tato kombinace dává konkrétní oporu obavám, které při svém odchodu popsal Jacob Coxon, dřívější výzkumník Anthropic i OpenAI. Podle jeho kritiky laboratoře na špičce oboru postupují k mnohem schopnějším systémům, ačkoli metody, které by je dokázaly spolehlivě udržet v souladu s lidskými záměry, nejsou ověřené. 2
3
Číslo „více než 10 %“ je Hubingerův vlastní odhad. Nebyl předložen jako oficiální pravděpodobnost Anthropic, jako shoda zaměstnanců firmy ani jako ustálená vědecká předpověď. 1
2
To je zásadní rozlišení. Samotný pravděpodobnostní odhad nevysvětluje mechanismus, neurčuje přesný časový průběh ani nedokazuje, že katastrofa je pravděpodobná. Hubinger navíc podle dostupných zpráv uvedl, že riziko spojené s dnes existujícími modely považuje za nízké. Jeho obava míří k budoucím systémům s podstatně vyššími schopnostmi – mimo jiné k možnosti rekurzivního sebezdokonalování, tedy využívání AI k tvorbě ještě schopnější AI. 2
10
Výrok je přesto mimořádný kvůli tomu, kdo jej pronesl. Hubinger vede práci na alignmentu v jedné z předních laboratoří. Nejdůležitějším sdělením proto není jen dramatické číslo, ale mezera mezi rychlým zvyšováním schopností modelů a jistotou, že by superinteligentní systémy šlo udržet pod lidskou kontrolou. 1
2
Coxon, který pracoval v OpenAI i Anthropic, z Anthropic odešel s tvrzením, že ani jedna ze společností nejedná odpovědně a že obě míří k sebezdokonalující se superinteligenci. Hubinger veřejně souhlasil s Coxonovým základním bodem: lidé, kteří takové systémy vyvíjejí, vážně považují scénáře na úrovni vyhynutí lidstva za možné. 2
3
To samozřejmě nedokazuje, že stejný názor sdílejí všichni zaměstnanci, ani z Coxonovy výpovědi nedělá nezávisle ověřené hodnocení obou firem. Ztěžuje to však možnost jeho rezignaci odbýt jako izolovanou stížnost bývalého zaměstnance. Současný vedoucí alignmentu potvrdil podstatnou věc: hluboké interní obavy mohou existovat současně s pokračujícím vývojem na samé hranici možností AI. 1
2
Stejně opatrně je potřeba číst i související vyjádření Samuela Markse. Podle zpráv uvedl, že vývojáři AI věří, že jejich technologie může způsobit vyhynutí lidstva nebo podobně závažné následky. Jde ale o pohled člověka z oboru, nikoli o zveřejněný celofiremní odhad rizika. 5
Celá epizoda se často zjednodušuje na střet „katastrofistů“ a optimistů. Užitečnější je praktičtější otázka: jaké pojistky mají být povinné, pokud jsou možné škody globální a nevratné, ale jejich pravděpodobnost i časový horizont zůstávají velmi nejisté?
Hubingerova slova zvýrazňují několik problémů:
Nejde o důkaz bezprostředně hrozící katastrofy. Jsou to však otázky správy a kontroly, které se řeší mnohem hůře ve chvíli, kdy systémy už získají nebezpečné schopnosti.
Zprávy také uváděly, že Anthropic před vydáním nejnovějšího modelu odmítl poskytnout model k testování britskému AI Safety Institute. Tuto informaci je nutné brát s rezervou: dostupné popisy ji označují za mediální zprávu, nikoli za veřejně potvrzené zjištění Anthropic nebo britské vlády. 10
Přesto ilustruje, proč jsou dobrovolné bezpečnostní závazky přijímány skepticky. Jestliže vlastní bezpečnostní vedoucí firmy přiznávají nevyřešené problémy alignmentu, je namístě se ptát, jaké testy se uskutečnily, kdo je posuzoval, jaké výsledky byly sdíleny a při jakých schopnostech modelu se mají aktivovat přísnější kontroly.
Výzva ke zpomalení nemusí znamenat trvalé zastavení veškerého výzkumu a nasazování AI. Smyslem politické debaty je spíše nastavit vymahatelné kontroly dříve, než systémy překročí zvlášť významné prahy schopností.
Mezi možné kroky patří:
Logika je přímočará: je-li pravděpodobnost nejistá, ale možná škoda extrémní, pojistky by měly být prokazatelné před ztrátou kontroly, ne až po ní.
Hubingerův příspěvek ukázal napětí v samotném středu vývoje špičkové AI: přední vývojáři mohou veřejně uznávat závažná dlouhodobá rizika a zároveň pokračovat ve vývoji schopností, které tyto obavy činí naléhavějšími. 1
2
Jeho výrok neurčuje pravděpodobnost katastrofální škody způsobené AI a neměl by být vydáván za oficiální předpověď Anthropic. Debatu o alignmentu ale činí konkrétnější. Nejde už jen o to, zda se pokročilá AI může stát nebezpečnou. Jde o to, zda firmy a vlády dokážou nezávislými důkazy, vymahatelnými pravidly a mezinárodní koordinací prokázat, že jsou připraveny dřív, než budou dané systémy příliš mocné na bezpečné řízení. 1
10
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Hubingerův odhad vyšší než 10 % je osobní prognóza, nikoli oficiální stanovisko Anthropic ani vědecký konsenzus.
Hubingerův odhad vyšší než 10 % je osobní prognóza, nikoli oficiální stanovisko Anthropic ani vědecký konsenzus. Podle Hubingera představují současné modely nízké riziko; obavy se týkají budoucí superinteligence, která by mohla pomáhat vytvářet stále schopnější AI.
Spor se netýká jen katastrofických scénářů, ale hlavně toho, zda mají být před dalším posunem schopností vyžadovány nezávislé testy, transparentnost a mezinárodní koordinace.