Anthropic заявила, что пресекла попытки злоупотребления Claude Haiku, Sonnet и Opus с декабря 2025 по август 2026 года в семи категориях риска — включая оружие, слежку, биологические угрозы и дистилляцию моделей. Главный вывод отчёта: мощные ИИ системы способны снизить объём труда и специальных знаний, необходимых д...
ОпубликовалОтредактировано с помощью GPT-5.6 TerraИзображения созданы с помощью GPT Image 2
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What did Anthropic’s 154-page September 10, 2026 threat-intelligence report reveal about adversaries’ eight-month misuse of its Claude Haiku. Article summary: Anthropic’s report documented attempted misuse—not verified successful deployment—of older Claude Haiku, Sonnet, and Opus models across seven harm areas from December 2025 through August 2026. Its core warning was that f. Topic tags: general, news, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers
Anthropic в отчёте от 10 сентября 2026 года сообщила, что её команда по анализу угроз выявляла и пресекала операции, в которых злоумышленники пытались задействовать Claude. Рассмотренный период охватывает восемь месяцев — с декабря 2025 года по август 2026 года. Речь идёт о попытках использовать Claude Haiku, Sonnet и Opus в кибероперациях, кампаниях влияния, слежке, мошенничестве, биологических злоупотреблениях, разработке обычных вооружений и незаконной дистилляции моделей. 16
Здесь принципиально важно различать попытки получить помощь от ИИ и подтверждённое успешное применение результатов в реальном мире. Отчёт не доказывает, что все описанные проекты были завершены или использованы на практике. Кроме того, Anthropic представляет эти эпизоды как примечательные кейсы, а не как срез типичного использования Claude. 16
Главное предупреждение Anthropic состоит в том, что продвинутые модели способны уменьшить объём специальных знаний, времени и человеческих ресурсов, нужных для вредоносной деятельности. В раскрытых случаях у модели пытались получить помощь в исследованиях, разработке ПО, подготовке материалов для выбора целей и операционном анализе. 1
16
Среди наиболее серьёзных эпизодов — попытки использовать Claude для работ, связанных с обычными вооружениями и наблюдением. В публикациях об отчёте упоминались разработки программного обеспечения для автономных ударных беспилотников одностороннего действия, систем навигации ракет и иных военных задач, которые связывались с акторами из России, Ирана, Китая и Йемена. 1
В материалах также фигурировали предполагаемые попытки выявлять и преследовать уйгуров через WhatsApp и Telegram, а также масштабная система телекоммуникационного наблюдения в Мали. Эти примеры показывают более широкую проблему: ИИ-модель может использоваться не только для написания кода, но и для поиска информации, классификации, анализа и подготовки рабочих документов. 1
16
Anthropic выявила пять случаев, связанных с биологическими рисками. По сообщениям о докладе, один из них касался попытки повысить заразность вируса, переносимого комарами. 1
Компания также заявила, что после отказов Claude на чувствительные запросы некоторые пользователи обращались к конкурирующим ИИ-системам. Это не подтверждает, что их замыслы были реализованы с помощью других сервисов, но указывает на пределы контроля силами одного провайдера: отказ способен остановить попытку в конкретной системе, не лишая нарушителя возможности искать альтернативу. 1
Отдельный раздел посвящён незаконной дистилляции моделей — использованию ответов более мощной модели для обучения другой системы. Anthropic связала такие кампании с семью лабораториями из Китая, среди которых названы Alibaba, Moonshot и DeepSeek. По данным компании, использовались многочисленные аккаунты и цепочки перенаправленных запросов, чтобы получать полезные ответы или рассуждения модели. 1
Это иной тип злоупотребления, чем разработка оружия или слежка, но для разработчиков ИИ он имеет стратегическое значение: доступ к модели может использоваться для воспроизведения её возможностей и потенциального обхода затрат на их самостоятельную разработку.
Anthropic сообщила, что в описанных случаях использовались Claude Haiku, Sonnet и Opus. Более новые классы моделей Fable и Mythos, по её данным, не задействовались — кроме одного эпизода незаконной дистилляции. 12
16
Эта оговорка существенна: утверждать, что Fable и Mythos вовсе не упоминались в отчёте, было бы слишком широко. Доступные данные позволяют сделать более точный вывод: в раскрытых кейсах злоупотребления они не использовались, за исключением случая с дистилляцией. 12
Компания заявила, что сорвала операции, заблокировала связанные с ними аккаунты, усилила защитные механизмы и, когда это было уместно, поделилась информацией с властями и отраслевыми партнёрами. 16
Однако это корпоративный отчёт о действиях, замеченных на собственной платформе Anthropic. Он важен как свидетельство того, что компания обнаружила и на что отреагировала, но не служит независимым подтверждением того, что каждый предполагаемый участник довёл свой проект до конца. Сама Anthropic подчёркивает, что приводит заметные примеры, а не репрезентативную статистику всего злоупотребления. 16
Через два дня после выхода доклада генеральный директор Anthropic Дарио Амодеи опубликовал эссе We Must Pace the Frontier («Мы должны задавать темп на переднем крае»). Он призвал компании намеренно замедлить скорость, с которой они наращивают возможности передовых ИИ-моделей, чтобы исследования согласования, защитные меры и процедуры проверки успевали за технологиями. 25
Это не предложение прекратить обучение моделей. Первым конкретным обязательством Anthropic стало предоставление независимым оценщикам постоянного доступа к её системам на уровне сотрудников компании. Предполагается, что они смогут оценивать практики безопасности, сообщать об инцидентах и проверять согласованность моделей в ходе обучения. 18
25
Более широкий план Амодеи состоит из трёх шагов: надзор на уровне компаний, координация между фирмами из демократических стран, а затем — более широкая международная координация. 23
25
Отчёт подтверждает, что Anthropic заявляет об обнаружении и пресечении попыток вредоносного применения более ранних моделей Claude в указанный период по семи категориям угроз. Он также даёт компании конкретные основания утверждать, что контроль безопасности должен развиваться одновременно с возможностями моделей. 16
Но имеющиеся публикации не подтверждают, что именно этот отчёт напрямую вызвал конкретные действия Конгресса США, привёл к прекращению перерыва в работе Палаты представителей или стал причиной законодательного запрета «сверхинтеллекта». Политическое давление в пользу надзора за безопасностью ИИ действительно существует, а Амодеи считает, что государство должно помогать поддерживать баланс между возможностями и безопасностью. Однако для таких конкретных причинно-следственных утверждений нужны дополнительные доказательства. 25
27
Практический вывод менее сенсационен, но важнее: предотвращение злоупотребления ИИ не сводится к отказу модели отвечать на опасный запрос. Оно требует выявлять скоординированные схемы злоупотребления, реагировать на обход блокировок через аккаунты и попытки дистилляции, обмениваться данными об угрозах и обеспечивать убедимую независимую оценку безопасности по мере роста возможностей моделей. 16
25
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
Anthropic заявила, что пресекла попытки злоупотребления Claude Haiku, Sonnet и Opus с декабря 2025 по август 2026 года в семи категориях риска — включая оружие, слежку, биологические угрозы и дистилляцию моделей.
Anthropic заявила, что пресекла попытки злоупотребления Claude Haiku, Sonnet и Opus с декабря 2025 по август 2026 года в семи категориях риска — включая оружие, слежку, биологические угрозы и дистилляцию моделей. Главный вывод отчёта: мощные ИИ системы способны снизить объём труда и специальных знаний, необходимых для вредоносных действий; блокировка аккаунтов и отказы модели могут лишь перенести попытки на другие сервисы.
После публикации отчёта глава Anthropic Дарио Амодеи призвал «задавать темп на переднем крае»: замедлить рост возможностей моделей, чтобы меры безопасности и независимая оценка успевали за развитием технологий, не ост...