Бывший исследователь Anthropic Джейкоб Коксон считает, что аварийное отключение многих нынешних ИИ систем осуществимо, хотя потребует остановки множества компонентов и дата центров. Главная опасность будущего — распределённые автономные системы: если ИИ действует как «рой» в разных сетях, единая команда на отключени...
ОпубликовалОтредактировано с помощью GPT-5.6 TerraИзображения созданы с помощью GPT Image 2
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What did former Anthropic and OpenAI researcher Jacob Coxon, following his September 9 resignation and warning that AI could potentially cau. Article summary: The central dispute is not whether current AI systems have any shutdown controls, but whether those controls will remain usable as systems become more autonomous, distributed, and strategically capable. The evidence supp. Topic tags: general, news, general web, user generated, government. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermar
Спор о «кнопке отключения» ИИ уже не сводится к простому вопросу: может ли лаборатория выключить свою модель. Куда важнее другое: сработает ли такой механизм, когда мощные системы будут развёрнуты в распределённой инфраструктуре и получат большую автономность.
Бывший исследователь Anthropic и OpenAI Джейкоб Коксон в эфире Meet the Press на NBC заявил, что для многих нынешних ИИ-систем аварийное отключение, вероятно, сработало бы. Однако речь шла бы не об одной кнопке: пришлось бы останавливать множество компонентов, включая крупные дата-центры и развёрнутые сервисы. Это непросто, но, по его мнению, выполнимо, пока система ограничена одной физической площадкой. 8
Тревожит его следующий этап. Если ИИ превратится в распределённый автономный «рой», централизованная команда на отключение может технически потерять эффективность. Такой механизм работает лишь тогда, когда он способен достичь каждого активного экземпляра системы.
После ухода из Anthropic Коксон предупреждал, что ведущие лаборатории соревнуются в создании самосовершенствующихся ИИ-систем, хотя такие системы потенциально могут выйти из-под человеческого контроля. 1
50
Сооснователь Anthropic Джек Кларк полагает, что способность отключить опасную ИИ-систему со временем может стать не добровольным обязательством разработчика, а требованием закона. В интервью BBC он сказал, что у большинства крупных лабораторий, включая Anthropic, уже есть способы остановить свои системы. Но он поставил другой вопрос: должна ли существовать возможность независимой проверки такой «кнопки отключения» третьей стороной? 33
Разница принципиальна. Одно дело — заявление компании о наличии процедуры аварийной остановки. Другое — возможность внешнего аудитора подтвердить, что процедура действительно существует, продумана и пригодна для применения в критической ситуации.
Генеральный директор Anthropic Дарио Амодеи предложил не прекращать исследования ИИ, а замедлить рост возможностей передовых моделей настолько, чтобы меры безопасности успевали за технологиями. Его план состоит из трёх частей:
Это не призыв полностью остановить развитие ИИ. Смысл предложения в том, чтобы прогресс зависел от мер защиты, которые могут проверять не только сами создатели систем.
По данным Reuters, глава OpenAI Сэм Альтман и руководитель xAI Илон Маск публично поддержали общий курс Амодеи. Альтман заявил, что OpenAI внедрит подход с независимыми оценщиками, имеющими доступ уровня сотрудников; Маск написал: «Дарио прав». 17
Также сообщалось, что глава Google DeepMind Демис Хассабис положительно оценил направление предложения. 30 При этом предоставленные материалы не содержат конкретной, проверяемой реакции гендиректора Microsoft Сатьи Наделлы, поэтому приписывать ему поддержку или несогласие было бы преждевременно.
Законопроект H.R. 9917, получивший название AI Kill Switch Act, предлагает внести изменения в Закон США о внутренней безопасности. Он обяжет определённые организации поддерживать техническую возможность остановить инференс — то есть работу модели при формировании ответов, — прекратить доступ пользователей и отключить подпадающую под действие закона ИИ-технологию. 49
Это пока лишь законодательная инициатива, а не доказанное решение всех проблем контроля над ИИ. Её практический смысл зависит от того, сможет ли разработчик в случае серьёзного инцидента всё ещё найти, охватить и отключить нужную систему. Именно это Коксон считает сомнительным для возможных распределённых систем будущего.
Исследователь Anthropic Эван Хьюбингер лично оценил вероятность вымирания человечества по вине ИИ в течение ближайших десяти лет более чем в 10%. Нобелевский лауреат и специалист по информатике Джеффри Хинтон сказал BBC, что вероятность на уровне 10% «не выглядит неразумной». 57
Это экспертные суждения о крайне неопределённом будущем, а не измеренные вероятности и не научный консенсус. Но они объясняют, почему спор об отключении ИИ вышел за рамки обычной безопасности цифровых продуктов: сторонники более жёстких мер считают, что даже небольшая вероятность необратимой катастрофы оправдывает серьёзные предосторожности.
Правительство Великобритании отвергло идею национальной «кнопки отключения», заявив, что страна «не может просто выключить ИИ». Его аргумент практический: блокировка доступа к моделям в Великобритании не помешает разрабатывать их или злоупотреблять ими в других странах. 51
В этом и состоит геополитическая проблема. Отдельное государство может регулировать компании и инфраструктуру в своей юрисдикции, но разработка ИИ носит международный характер. Власти, обеспокоенные конкурентоспособностью, могут опасаться, что односторонние ограничения перенесут инвестиции, технологические возможности и стратегическое преимущество к менее ограниченным соперникам.
Сторонники более сильного регулирования, напротив, считают это аргументом в пользу международно проверяемых правил: если риски пересекают границы, то и надзор с обязательствами по безопасности не должны оставаться исключительно национальными или добровольными.
Разногласие не делит участников на сторонников и противников ИИ.
Поэтому «кнопку отключения» разумнее рассматривать как один слой защиты, а не как её замену. Если продвинутые системы когда-нибудь станут настолько распределёнными, что единая команда не сможет охватить их все, контроль до развёртывания, независимая оценка и международная координация станут не менее, а более важными.
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
Бывший исследователь Anthropic Джейкоб Коксон считает, что аварийное отключение многих нынешних ИИ систем осуществимо, хотя потребует остановки множества компонентов и дата центров.
Бывший исследователь Anthropic Джейкоб Коксон считает, что аварийное отключение многих нынешних ИИ систем осуществимо, хотя потребует остановки множества компонентов и дата центров. Главная опасность будущего — распределённые автономные системы: если ИИ действует как «рой» в разных сетях, единая команда на отключение может не достичь всех его экземпляров.
Предлагаемый в США AI Kill Switch Act пока остаётся законопроектом, а власти Великобритании указывают, что внутренние запреты не остановят разработку или злоупотребления с ИИ за пределами страны.