Ниже приведены результаты независимых и вендорских тестов:
| Показатель / Бенчмарк | Kimi K3 | Сравнение | Источник |
|---|---|---|---|
| Индекс Intelligence от Artificial Analysis | 57 | Claude Fable 5 — 60 (отрыв 3 пункта); превосходит Claude Opus 4.8 и GPT-5.5 | |
| Общий рейтинг (независимый) | #4 из 186–189 моделей | Опережает Claude Opus 4.8 и GPT-5.5 | |
| Frontend Code Arena (Elo) | 1,679 Elo | Превосходит Claude Fable 5 | |
| Агентные бенчмарки (Program Bench, SWE Marathon, SpreadsheetBench 2, Automation Bench, BrowseComp) | #1 в 4 из 8 | Единственная открытая модель, лидирующая в агентных тестах | |
| Внутренние тесты Moonshot | Превосходит другие протестированные модели | Всё ещё отстаёт от Claude Fable 5 и GPT-5.6 Sol |
Важный нюанс: сама Moonshot признаёт, что Kimi K3 «всё ещё отстаёт от самых мощных проприетарных моделей — Claude Fable 5 и GPT-5.6 Sol», но подчёркивает, что это единственная открытая модель такого уровня .
Плоское ценообразование без привязки к длине контекста :
| Тип токена | Цена за миллион токенов |
|---|---|
| Входные (кэш-промах) | $3.00 |
| Входные (кэш-попадание) | $0.30 |
| Выходные | $15.00 |
Это примерно вдвое дешевле за задачу по сравнению с закрытыми американскими аналогами .
Инфраструктура:
Рыночные риски:
Kimi K3 — знаковый релиз: крупнейшая открытая модель в истории, работающая на уровне лучших закрытых американских аналогов и вдвое дешевле. Открытие весов 27 июля 2026 года под разрешительной лицензией может ускорить децентрализацию ИИ-возможностей. Основные ограничения: высокие требования к оборудованию для самостоятельного развёртывания, сохраняющиеся ограничения на поставки чипов между США и Китаем, а также необходимость независимой верификации заявленных характеристик.