Накануне запланированной на 24 сентября встречи президента США Дональда Трампа и председателя КНР Си Цзиньпина в Белом доме технический термин «дистилляция моделей» стал частью дипломатического спора. Американские ведомства заявили, что китайские разработчики таким способом извлекали возможности передовых моделей США. Пекин отверг обвинения. Одновременно стороны искали более узкую область для сотрудничества — связь на случай опасных инцидентов с искусственным интеллектом.
17
1
39
19
Что такое дистилляция и где проходит граница?
При дистилляции одну ИИ-модель обучают на ответах другой, обычно более мощной. Так можно создать менее затратную систему, способную выполнять часть тех же задач. Это распространённый исследовательский метод, а не другое название кражи.
48
Ключевой вопрос — как были получены и использованы ответы исходной модели. Работа с собственными системами или с разрешения их владельца отличается от сбора ответов конкурента через обманный доступ вопреки установленным ограничениям. Пекин подчёркивает, что дистилляцией пользуются в том числе американские компании. Но распространённость метода сама по себе не отвечает на вопрос о действиях конкретных разработчиков.
23
5 Представленные источники не позволяют независимо установить, как Anthropic применяет дистилляцию при разработке собственных моделей.
В чём США обвинили китайские компании?
8 сентября ФБР, Агентство национальной безопасности США и Агентство по кибербезопасности и защите инфраструктуры выпустили совместное предупреждение о том, что они назвали вредоносной дистилляцией в промышленных масштабах.
1 Ведомства назвали DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun и Z.AI. По их утверждению, как минимум с конца 2024 года компании извлекли миллиарды токенов — единиц текста, используемых ИИ-системами, — через миллионы запросов к передовым моделям, включая версии Claude от Anthropic, GPT от OpenAI, Gemini от Google и Grok от xAI.
16
14
Согласно сообщениям о предупреждении, для получения ответов предположительно использовались подставные учётные записи и сети посредников.
5 Американские ведомства оценили происходившее как действия, совершавшиеся вероятно, с ведома властей Китая. Это не то же самое, что утверждение о доказанном руководстве операцией со стороны государства.
16 Речь идёт об обвинениях США, а не об установленном факте кражи со стороны каждой названной компании. Отдельно Anthropic обвинила DeepSeek и Moonshot в перенаправлении части пользовательских запросов к её модели Claude.
49
Спор начался ещё до сентябрьского предупреждения: в июле советник Белого дома по науке и технологиям Майкл Крациос обвинил Moonshot в масштабной попытке получить возможности ведущих американских моделей с помощью дистилляции.
47 При этом имеющиеся материалы не подтверждают, что именно показатели производительности или эффективности DeepSeek стали причиной обвинений OpenAI. Сами по себе такие показатели не доказывали бы извлечение данных без разрешения.
Как ответил Пекин?
Китайские официальные лица отвергли обвинения во вредоносном извлечении возможностей моделей.
49 Газета «Жэньминь жибао» заявила, что ИИ не должен быть «монополией великих держав», и призвала к сотрудничеству в управлении рисками при недискриминационных условиях развития.
33 В китайской трактовке спор касается и того, не превращается ли защита американских технологий в ограничение возможностей Китая развивать собственный ИИ.
39
Эта позиция и претензии США отвечают на разные вопросы. Один — допустима ли дистилляция как метод вообще. Другой — был ли разрешён конкретный способ получения ответов чужих моделей. Доступные сообщения не позволяют достоверно изложить позицию каждой из шести названных компаний; отсутствие подробностей здесь не следует считать свидетельством их молчания.
О чём стороны могли договориться?
Соперничество в области ИИ должно было стать одним из вопросов встречи, несмотря на интерес обеих сторон к обсуждению общих рисков.
17
34 Трамп публично предлагал называть технологию «сверхинтеллектом», поскольку выражение «искусственный интеллект», по его словам, звучит неубедительно. Однако смена термина сама по себе не была договорённостью на переговорах.
50 Имеющиеся источники также не подтверждают создание предложенных в других сообщениях «AI Force» или должности «AI Czar», официальный отказ от мер безопасности либо конкретные обязательства Си по сохранению контроля человека над ИИ.
Более предметное предложение прозвучало после переговоров министра финансов США Скотта Бессента с вице-премьером КНР Хэ Лифэном в Нью-Йорке. По словам Бессента, Вашингтон предложил механизм оповещения об инцидентах с ИИ, достаточно серьёзных, чтобы затронуть национальную безопасность. Предполагалось, что Трамп и Си рассмотрят эту идею; сообщения подтверждают наличие предложения, но не действующего соглашения.
18
19
Такой канал мог бы помочь быстрее сообщать об опасном инциденте. Сам по себе он не разрешил бы спор о дистилляции, не установил бы пределы разработки ИИ и не изменил бы американские ограничения на поставки передовых ИИ-чипов в Китай — ещё один источник разногласий.
19
40 Главный вопрос остаётся открытым: смогут ли Вашингтон и Пекин провести практически применимую границу между допустимым обучением моделей и извлечением чужих возможностей без разрешения, сохранив при этом связь для обсуждения общих рисков.
17
48
18