Фахівці з кібербезпеки критикують Claude Fable 5 від Anthropic, оскільки його захисні механізми агресивно блокують навіть нешкідливі запити, пов'язані з безпекою, і непомітно перенаправляють їх до слабшої моделі, не п... Основний удар критики припав на механізм, який маршрутизує запити щодо кібербезпеки, біології, х...

Create a landscape editorial hero image for this Studio Global article: What is causing cybersecurity professionals to criticize Anthropic's Claude Fable 5, and how does the model's safety guardrail system work,. Article summary: Anthropic released Claude Fable 5 on June 9, 2026 as a guardrailed public version of its powerful Mythos-class model, alongside an unrestricted twin, Claude Mythos 5, available only to vetted partners through Project Gla. Topic tags: general, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "# Claude Fable 5: Why Anthropic Put Its Most Powerful AI Behind Guardrails. * Anthropic released Claude Fable 5 on 9 June 2026. It is the first publicly available Mythos-class mode" source context "Claude Fable 5: Anthropic Locks Down Cyber and Bio" Reference image 2: visual subject "# Anthropic says these topics
Компанія Anthropic випустила Claude Fable 5 9 червня 2026 року як свою найпотужнішу модель штучного інтелекту, доступну для широкого загалу. Однак реліз миттєво викликав різку реакцію з боку спільноти кібербезпеки. Поки компанія позиціонує модель як відповідальний випуск своєї технології класу Mythos, фахівці з безпеки стверджують, що вбудовані захисні обмеження настільки агресивні, що роблять модель функціонально непридатною для законних досліджень та захисної роботи .
Суть критики не в самому існуванні засобів безпеки, а в тому, як вони були реалізовані: непомітно, надто широко та з механізмом відкату, який підміняє менш потужний ШІ без відома користувача. Ось детальний розбір цієї суперечки та технології, що стоїть за нею.
Головна скарга дослідників — надзвичайна чутливість класифікаторів контенту Fable 5. Валентина «Chompie» Пальміотті, відома дослідниця безпеки з IBM X-Force, розповіла TechCrunch, що модель відхиляє «будь-який запит, який хоча б побіжно стосується кіберсфери — навіть невинні завдання, як-от читання допису в блозі» . Це означає, що під блокування потрапляють не лише небезпечні запити, а й прохання допомогти розібратися з фундаментальними концепціями кібербезпеки.
Таке надмірне блокування має прямий негативний вплив на корисність моделі. Коли запит позначається як небезпечний, користувач отримує розмиту, спрощену відповідь від старішої версії ШІ, причому про цю підміну йому відкрито не повідомляють . Ситуацію ускладнило те, як саме було розкрито цю інформацію. Критики стверджують, що про таку поведінку стало відомо лише з надр 319-сторінкової системної картки, що призвело до звинувачень Anthropic у «таємному саботажі» можливостей моделі для певних користувачів
.
Обмеження не обмежуються лише кібербезпекою. Запобіжники також націлені на запити, пов'язані з біологією, хімією та, що критично важливо, з дистиляцією моделей ШІ. Останній пункт викликав окрему хвилю критики: деякі розробники звинувачують Anthropic у використанні «безпеки» як приводу для антиконкурентної поведінки, що заважає іншим розробникам ШІ використовувати результати роботи Fable 5 для навчання власних моделей .
Система безпеки в Fable 5 — це не простий механізм відмови. Це система маршрутизації, створена для того, щоб «мовчки» давати збій . Архітектура працює у три кроки:
Anthropic стверджує, що ці класифікатори спрацьовують у середньому менш ніж у 5% усіх сесій . Компанія публічно визнала проблему надмірного блокування. Представник компанії повідомив Business Insider, що заходи безпеки «можуть позначати безпечний, нейтральний або нешкідливий контент», але виправдав це як необхідний компроміс для публічного випуску моделі з такими потужними базовими можливостями
.
Позиція Anthropic полягає в тому, що консервативні запобіжники — це свідомий і відповідальний вибір, а не помилка. Компанія стверджує, що базова модель класу Mythos настільки вправна в таких завданнях, як пошук і використання вразливостей у програмному забезпеченні, що її необмежений публічний випуск створив би неприйнятний ризик катастрофічного зловживання .
На їхню думку, запобіжники — це компроміс у дизайні, спосіб надати публіці доступ до найсучаснішої моделі для міркувань, кодингу та написання текстів, одночасно помістивши в «пісочницю» її найнебезпечніші потенційні можливості . Надмірне блокування вони подають як тимчасову ціну за можливість випустити потужну модель «швидко і безпечно», обіцяючи з часом вдосконалювати класифікатори
.
Реліз Claude Fable 5 не можна повністю зрозуміти у відриві від контексту. Це лише половина дворівневої стратегії розгортання, яка стає новим галузевим стандартом для передових моделей ШІ .
Того ж дня, коли вийшла Fable 5, Anthropic також анонсувала Claude Mythos 5. Обидві моделі мають абсолютно однакову базову архітектуру та вагові коефіцієнти — це один і той самий «мозок». Єдина відмінність — конфігурація безпеки. У Mythos 5 класифікатори у чутливих сферах вимкнені, що дає їй повний, необмежений доступ до всіх можливостей .
Однак Mythos 5 не для широкого загалу. Вона доступна лише невеликій групі перевірених партнерів, зокрема урядовим установам та операторам критичної інфраструктури, через ініціативу під назвою Project Glasswing . Ця програма, підтримана урядом США, спочатку була запущена з 12 партнерами-засновниками, серед яких технологічні гіганти AWS, Google та Microsoft. Її мета — дозволити «кіберзахисникам» використовувати ШІ для пошуку та виправлення вразливостей у програмному забезпеченні в масштабі
. З випуском Mythos 5 доступ було розширено приблизно до 40 організацій
.
Таблиця нижче ілюструє фундаментальну різницю:
Поділ на Fable/Mythos від Anthropic є найяскравішим прикладом того, що можна назвати розгортанням ШІ з рівнями можливостей (capability-tiered AI deployment). У цій новій моделі єдиний передовий ШІ більше не є єдиним продуктом. Його повна потужність — це привілей, а не даність, а захисні обмеження є механізмом, який створює диференціацію продукту .
Ця схема не є унікальною для Anthropic. Інші провідні компанії з розробки ШІ, зокрема OpenAI, застосували подібні підходи, надаючи версії своїх найпередовіших моделей з обмеженим доступом партнерам із національної безпеки та дослідницьких установ . Запуск Fable/Mythos кристалізує майбутнє, в якому найпотужніші можливості ШІ регулюються не технологією, а статусом перевірки, де протоколи безпеки виконують функцію механізмів контролю доступу. Цей підхід уже розпалює ширшу дискусію про централізацію, справедливість та справжнє значення «публічної» безпеки ШІ.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Фахівці з кібербезпеки критикують Claude Fable 5 від Anthropic, оскільки його захисні механізми агресивно блокують навіть нешкідливі запити, пов'язані з безпекою, і непомітно перенаправляють їх до слабшої моделі, не п...
Фахівці з кібербезпеки критикують Claude Fable 5 від Anthropic, оскільки його захисні механізми агресивно блокують навіть нешкідливі запити, пов'язані з безпекою, і непомітно перенаправляють їх до слабшої моделі, не п... Основний удар критики припав на механізм, який маршрутизує запити щодо кібербезпеки, біології, хімії та дистиляції ШІ до старішої моделі Claude Opus 4.8 — факт, який, за словами критиків, був захований у 319 сторінков...
Запуск обмеженої публічної моделі (Fable 5) поряд із необмеженою моделлю для перевірених партнерів (Mythos 5) знаменує новий галузевий стандарт розгортання ШІ з рівнями можливостей, що порушує питання про рівність, пр...