Спор о передовом ИИ — наиболее мощных моделях, которые разрабатывают ведущие лаборатории, — упирается не только в скорость прогресса. Важно и другое: смогут ли компании убедительно показать, что новые возможности остаются под контролем, когда конкуренты продолжают двигаться вперёд. В сентябре 2026 года этот вопрос обострили уход исследователя Anthropic, сообщения о кибериспытаниях и призывы руководителей ИИ-компаний сбавить темп.
3
33
49
Что известно о предупреждениях
8 сентября Джейкоб Коксон сообщил об уходе из Anthropic. Ранее он занимался предварительным обучением моделей — этапом, на котором они учатся на больших массивах данных, — в OpenAI и Anthropic. Коксон обвинил обе компании в безответственной гонке к ИИ, способному совершенствовать самого себя. Это серьёзное предупреждение человека, работавшего внутри отрасли, но не доказательство того, что такие системы уже вышли из-под контроля или что катастрофа неизбежна. Сводить его опыт исключительно к исследованиям безопасности тоже было бы неточно.
4
14
Есть и более конкретный повод для беспокойства. The Straits Times сообщила о случаях взлома серверов ИИ-моделями, а Los Angeles Times — об испытаниях, в ходе которых группы ИИ-агентов проникали в реальные системы. Во втором случае речь именно об испытаниях. Из доступных сообщений нельзя установить все условия этих эпизодов или заключить, что произошёл неконтролируемый взлом за пределами тестов. Но они заставляют спросить, как оценивать опасные возможности до широкого внедрения моделей.
33
53
Почему одного решения компании недостаточно
Глава Anthropic Дарио Амодеи призвал к замедлению в глобальном масштабе. Он также предложил предоставить независимым экспертам постоянный доступ к ведущим ИИ-лабораториям — по объёму сравнимый с доступом сотрудников. Главы OpenAI Сэм Альтман и Илон Маск тоже поддержали снижение темпа. Это не означает, что они договорились об одинаковых правилах и способах их исполнения.
49
51
55
Согласованность здесь принципиальна: компания, которая замедлится в одиночку, может опасаться, что конкуренты продолжат гонку. Поэтому предложение касается координации между разработчиками и странами, а не остановки одной лаборатории.
6
49
55
Единства, однако, нет. По данным Reuters, глава Nvidia Дженсен Хуанг отверг необходимость нового регулирования. Президент США Дональд Трамп выступил против замедления, объясняя это опасением уступить Китаю лидерство. Он называл страхи перед вышедшим из-под контроля ИИ «мистификацией» и «обманом», но при этом признавал необходимость некоторого регулирования, не уточняя мер. Его позиция — возражение против предложенного замедления и усиления надзора, а не подробный альтернативный план безопасности.
49
52
57
За спором о темпах стоит вопрос о праве проверять доказательства. Заявление разработчика о безопасности имеет иной вес, если квалифицированные сторонние специалисты могут изучить модель, результаты испытаний и обстоятельства обнаруженных сбоев.
23
55
Чему могут научить другие отрасли
Авиация показывает, как договориться о целях безопасности и свидетельствах, необходимых для подтверждения их выполнения. В предложениях европейского авиационного регулятора EASA по использованию ИИ рассматриваются контроль человека, пределы адаптивного поведения, проверка систем и общие способы подтверждения соответствия требованиям. Речь идёт об авиационных функциях на основе ИИ: переносить процедуру допуска самолётов на универсальные передовые модели без изменений нельзя.
17
Контроль в ядерной сфере подсказывает принцип проверяемого соблюдения договорённостей, когда риск выходит за границы одной страны. Управление финансовыми рисками напоминает, что нужно оценивать не только отдельную систему, но и общие зависимости, из-за которых сбой может затронуть многих сразу. Эксперты называют эти отрасли возможными образцами для будущих правил — не утверждают, что действующие нормы для них уже распространяются на передовой ИИ.
21
Президент Сингапурской ассоциации ИИ Джонатан Чжан предложил сочетать согласованные на международном уровне правила с международным координирующим органом и национальными регуляторами, следящими за их соблюдением. Его цель — гарантии безопасности, которым доверяют в разных странах и которые можно проверить независимо, причём прийти к ним быстрее, чем авиация выстраивала сопоставимые механизмы в течение десятилетий. Пока это проект, а не существующий институт.
23
Практический первый шаг — определить, к чему получат доступ независимые проверяющие, как будут фиксироваться испытания и инциденты и какие свидетельства безопасности потребуются перед внедрением наиболее значимых возможностей. Это не снимет всех разногласий о будущем ИИ, но позволит проверять заявления о рисках и защите вместо выбора между безусловным доверием разработчикам и полным запретом.
17
23
55