| Версия | Всего параметров | Активных параметров | Контекстное окно | Макс. вывод |
|---|---|---|---|---|
| V4-Pro | 1,6 трлн (MoE) | ~49B на токен | 1 млн токенов | 384K токенов |
| V4-Flash | 284 млрд (MoE) | ~13B на токен | 1 млн токенов | 384K токенов |
Обе версии мультимодальны (текст, изображение, видео), поддерживают JSON-вывод и вызовы инструментов, доступны через API и веб-интерфейс .
| Версия | Ввод (вне пика) | Вывод (вне пика) | Кэш-попадание |
|---|---|---|---|
| V4-Pro | $0,435 | $0,87 | Скидка 90% |
| V4-Flash | $0,14 | $0,28 | Скидка 90% |
DeepSeek также проводил акцию со скидкой 75% на V4-Pro до начала мая 2026 года . Для сравнения: цена вывода GPT-5.5 составляет около $30 за миллион токенов, что делает V4-Flash примерно в 107 раз дешевле по выводу .
Результаты бенчмарков DeepSeek V4 дают неоднозначную картину:
Важное примечание от оценки NIST CAISI (май 2026): Самоотчётные бенчмарки DeepSeek утверждают о паритете с GPT-5.4 и Opus 4.6, однако независимая оценка CAISI показала, что V4 «существенно менее способна» на непубличных тестах, что указывает на возможное завышение некоторых самоотчётных результатов . Индекс интеллекта Artificial Analysis оценивает GPT-5.5 (high) в 53 балла против DeepSeek V4 Pro (Reasoning, High Effort) в 41* — GPT-5.5 умнее и быстрее (69 против 56 токенов/с), но DeepSeek значительно дешевле ($0,18 против $4,35 за миллион токенов в режиме рассуждения) .
Команда Qwen из Alibaba представила Qwen 3.8 Max на Всемирной конференции по ИИ в Шанхае 19 июля 2026 года . Это первая флагманская модель команды с более чем 1 триллионом параметров.
| Атрибут | Детали |
|---|---|
| Всего параметров | 2,4 трлн (разреженный MoE) |
| Архитектура | Mixture-of-Experts, мультимодальная (текст + зрение) |
| Контекстное окно | 983 616 токенов на endpoint Qwen Cloud ; в некоторых источниках ~1 млн |
| Макс. вывод | 64 000 токенов |
| Лицензия | Пока не опубликована; Alibaba обещает открытые веса «скоро» |
Общедоступные тарифы pay-as-you-go не опубликованы. Доступ в настоящее время осуществляется по подписке через Qwen Chat и отдельных партнёров API. BenchLM указывает цену Qwen 3.8 Max Preview как «Не указана» . Некоторые сторонние трекеры показывают автоматическую цену в $1,50/$5,00 за миллион токенов ввода/вывода, но это не подтверждено Alibaba .
Alibaba утверждает, что Qwen 3.8 «уступает только Fable 5» (лучшей модели Claude от Anthropic), что, по собственной оценке Alibaba, ставит её выше GPT-5.5 и DeepSeek V4 . Заявлены улучшения в программировании, профессиональной продуктивности, полном цикле разработки, анализе данных и офисных рабочих процессах по сравнению с Qwen 3.7 Max .
Однако независимые бенчмарки не опубликованы. BenchLM, сайт отслеживания эталонных тестов, отслеживает 321 бенчмарк для Qwen 3.8 Max Preview, из которых по состоянию на 20 июля 2026 года не подтверждено ни одного . Как выразился один аналитик: «Qwen 3.8 стоит протестировать, но пока рано рассматривать его как стабильную замену в production для Kimi K3, GPT-5.6 Sol или Claude Fable 5» .
Для контекста: предшественники Qwen заложили прочную основу: Qwen 3.6-Max-Preview (20 апреля 2026) — текстовая модель на 35B всех / 3B активных параметров с контекстом 262K, заявлявшая о первом месте в шести бенчмарках по программированию и агентам . Qwen 3.7-Max (май 2026) расширил контекстное окно до 1 млн токенов с возможностями агента-рассуждателя . Но ни одна из них не считалась моделью передового уровня за пределами агентного программирования.
Alibaba прямо позиционирует Qwen 3.8 как «уступающую только Fable 5» . Если это утверждение подтвердится при независимой оценке, Qwen 3.8 окажется впереди GPT-5.5 и значительно впереди DeepSeek V4. Но при нулевом количестве подтверждённых бенчмарков это остаётся маркетинговым заявлением, а не установленным фактом. Anthropic's Fable 5, согласно собственным формулировкам Alibaba, является признанным лидером на передовом рубеже .
Агрессивное ценообразование DeepSeek привело к гонке на выживание по стоимости API. V4-Flash по цене $0,14 за миллион токенов на вводе радикально дешевле любой западной модели передового уровня. Alibaba пока не установила цену Qwen 3.8, но Qwen 3.6 уже был агрессивно оценён (~$1,25/$7,50 ввод/вывод) .
Открытая лицензия MIT для DeepSeek V4 означает, что возможен и самостоятельный хостинг, что ещё больше сжимает маржу для провайдеров с закрытым исходным кодом . Как говорится в одном анализе, практический эффект заключается в том, что «разработчики теперь могут получить доступ к почти передовым возможностям (в задачах программирования) за долю стоимости GPT-5.5 или Claude».