Это история того запуска — что на самом деле умеет модель, сколько она стоит и почему её появление стало важным моментом в продолжающейся конкуренции США и Китая в сфере ИИ.
Kimi K3 набрала 57,1 балла в независимом индексе Artificial Analysis Intelligence Index v4.1, что обеспечило ей 3-е место в мире после Claude Fable 5 (60) и GPT-5.6 Sol (59) . Разрыв — около 3 баллов, что по историческим меркам считается небольшим, но чётко показывает: самый широкий доступный тест интеллекта всё же отдаёт предпочтение ведущим американским моделям
. Сама Moonshot признала это, заявив, что K3 «всё ещё отстаёт от самых мощных проприетарных моделей» Anthropic и OpenAI по общим совокупным показателям
.
Где K3 действительно вырывается вперёд — так это на конкретных, реальных агентных тестах:
| Бенчмарк | Kimi K3 | Claude Fable 5 | GPT-5.6 Sol | Claude Opus 4.8 |
|---|---|---|---|---|
| Terminal-Bench 2.1 | 88.3 | 84.6 | 88.8 | 84.6 |
| DeepSWE | 73.0 | 70.0 | 67.5 | 59.0 |
| BrowseComp | 91.2 | 88.0 | 90.4 | 84.3 |
| Automation Bench | 75.6 | — | — | — |
| SpreadsheetBench 2 | 34.8 | 34.7 | 32.4 | 31.6 |
На этих пяти агентных тестах, а также на Program Bench (77.8), K3 выиграла 5 из 6, опередив и Fable 5, и GPT-5.6 Sol по этим конкретным показателям . Она также существенно превзошла Claude Opus 4.8 по всем опубликованным бенчмаркам — это значимый результат, потому что Opus 4.8 стоит $5 за входные и $25 за выходные токены на миллион, что делает её прямым конкурентом по цене
.
На платформе Arena, созданной исследователями из Калифорнийского университета в Беркли для слепого сравнения предпочтений пользователей, K3 возглавила таблицу лидеров по коду вскоре после запуска . Оценки Arena, основанные на сравнении толпы, показали, что K3 заняла первое место во фронтенд-веб-разработке с результатом 1 679, опередив Fable 5 (1 631) и GPT-5.6 Sol (1 618)
.
В оптимизации GPU-ядер — методах, улучшающих взаимодействие моделей ИИ с аппаратным обеспечением — Moonshot сообщила, что K3 «существенно превзошла» Opus 4.8, GPT-5.6 Sol и GPT-5.5 . Это коммерчески значимо, поскольку лучшая оптимизация ядер означает меньшую задержку и большую пропускную способность на том же оборудовании.
Модель использует разрежённую архитектуру MoE с 896 экспертами, из которых активируются только 16 на каждый токен, что делает её стоимость вывода примерно сопоставимой с GPT-5.6 Sol, несмотря на впечатляющие 2,8 триллиона параметров . Она также внедряет Kimi Delta Attention (KDA) и Attention Residuals (AttnRes) — новые архитектурные компоненты, предназначенные для улучшения рассуждений с длинным контекстом
.
Одним из самых disruptive аспектов Kimi K3 с точки зрения рынка является ценообразование на API, которое значительно дешевле топ-моделей из США:
| Модель | Вход (за 1 млн токенов) | Выход (за 1 млн токенов) |
|---|---|---|
| Kimi K3 | $3.00 | $15.00 |
| GPT-5.6 Sol | $5.00 | $30.00 |
| Claude Fable 5 | $10.00 | $50.00 |
| Claude Opus 4.8 | $5.00 | $25.00 |
Kimi K3 стоит примерно на 40% меньше, чем GPT-5.6 Sol, и примерно на 70% меньше, чем Claude Fable 5, по опубликованным ставкам . Эти три модели образуют чёткую лестницу в 3,3 раза: Fable 5 стоит в 3,3 раза дороже Kimi K3 как для входа, так и для выхода, а GPT-5.6 Sol находится почти ровно посередине
.
Кроме того, у K3 есть ставка для попаданий в кэш при вводе — $0.30 за миллион токенов, что в 10 раз дешевле, чем при промахе кэша, для запросов контекста, которые уже обслуживались ранее . В пересчёте на одну задачу K3 оценивается в 50-65% дешевле флагманских моделей США
.
Ценообразование Moonshot для K3 знаменует собой заметный сдвиг: теперь она позиционируется как модель уровня frontier, а не бюджетный вариант . Предыдущие модели Kimi, такие как K2.5 и K2.6, стоили $0.60 за входные и $2.50-4.00 за выходные токены, так что K3 примерно в 3-4 раза дороже своих предшественниц
. Однако она остаётся дешевле, чем первоклассные американские модели, при этом обеспечивая сопоставимую или лучшую производительность в конкретных агентных задачах.
19 июля 2026 года — примерно через 48 часов после запуска — Moonshot AI объявила о временной приостановке приёма новых подписок на Kimi K3. Компания написала в X: «Kimi K3 получил гораздо больше любви, чем мы ожидали, и наши GPU это чувствуют. За последние 48 часов спрос приблизился к пределам нашей текущей ёмкости» .
Компания заявила, что приоритезирует вычислительные ресурсы для существующих подписчиков, наращивая мощности как можно быстрее, и планирует открывать новые места для подписки партиями . Существующие пользователи сохранили полный доступ, а корпоративные и API-сервисы продолжили работу
.
Многие новостные издания отметили, что этот инцидент подчёркивает продолжающиеся ограничения вычислительных мощностей Китая из-за экспортных ограничений США на чипы . South China Morning Post написала, что ситуация «подчёркивает проблемы, с которыми сталкиваются китайские лаборатории ИИ при обслуживании своих продуктов для глобальных пользователей»
. Полные веса модели, которые позволили бы третьим сторонам запускать её на собственном оборудовании, были запланированы только на 27 июля — это означало, что Moonshot оставалась единственным поставщиком мощностей для вывода в период запуска
.
Moonshot использовала паузу, чтобы разделить свою подписку на два плана: Kimi Membership (для веба, приложения и Work) и Kimi Code Membership (для рабочих процессов кодинга) — реструктуризация, предназначенная для более эффективного распределения вычислительных ресурсов .
Запуск Kimi K3 имел последствия, выходящие за рамки бенчмарков. The Straits Times прямо сообщила, что K3 «подогрела обвал» в технологическом секторе, и несколько изданий связали релиз с распродажей акций американских полупроводниковых и ИИ-компаний . Хотя конкретные цифры по индексу Philadelphia Semiconductor или движению акций Nvidia не удалось независимо подтвердить в рамках доступного набора источников, общий рыночный контекст распродажи хорошо задокументирован.
Со стороны корпоративных новостей, Reuters сообщило 20 июля 2026 года, что приостановка подписки «происходит в то время, когда компания ищет свежее финансирование, при этом источники говорят, что она движется к первичному публичному размещению акций в Гонконге» . Однако ни один источник в рамках доступных доказательств не подтвердил конкретную резолюцию акционеров с целевой оценкой в $30 миллиардов. В отчёте Reuters упоминается push к IPO без указания целевой оценки
.
Полные веса модели Kimi K3 запланированы к публичному выпуску 27 июля 2026 года . Это критически важная деталь, поскольку она означает, что разработчики и организации смогут в конечном итоге скачать, запускать, проверять, донастраивать и владеть моделью, а не просто арендовать её через API
. Двухэтапный релиз — сначала API, а через одиннадцать дней открытые веса — является сутью всего анонса
.
До открытого релиза весов разработчики могут получить доступ к K3 через kimini.com, Kimi API или OpenRouter . Модель совместима с OpenAI SDK, поддерживает вызов инструментов, структурированный вывод, автоматическое кэширование контекста и имеет окно контекста в 1 миллион токенов без дополнительной платы за длинный контекст
.
Тем не менее, запустить модель с 2,8 триллиона параметров локально непросто. Размер файла оценивается примерно в 1,5 ТБ, а рекомендуемое оборудование включает 64+ корпоративных GPU NVIDIA H100 . Для большинства команд API останется практической точкой доступа.
Kimi K3 — это не та модель, которая свергает GPT-5.6 Sol или Claude Fable 5 по общему интеллекту — Moonshot сама это признаёт. Но это модель, которая доказывает, что система с открытым весом может конкурировать с проприетарными моделями frontier в конкретных, коммерчески ценных задачах, стоя при этом в разы дешевле. Это самая большая открытая модель из когда-либо выпущенных, и она появилась с таким реальным спросом, что за два дня обрушила GPU-инфраструктуру компании.
Эта комбинация — производительность уровня frontier в агентных тестах, агрессивное ценообразование, открытые веса и чёткий сигнал спроса — делает K3 важной вехой в ландшафте ИИ, независимо от того, на каком месте она находится в каком-либо отдельном рейтинге.