| Варіант | Усього параметрів | Активні параметри | Вікно контексту | Макс. вивід |
|---|---|---|---|---|
| V4-Pro | 1,6 трлн (MoE) | ~49B на токен | 1M токенів | 384K токенів |
| V4-Flash | 284 млрд (MoE) | ~13B на токен | 1M токенів | 384K токенів |
Обидва варіанти є мультимодальними (текст, зображення, відео), підтримують виведення у форматі JSON та виклики інструментів, а також доступні через API та веб-інтерфейс .
| Варіант | Введення (позапікове) | Виведення (позапікове) | Потрапляння в кеш |
|---|---|---|---|
| V4-Pro | $0,435 | $0,87 | Знижка 90% |
| V4-Flash | $0,14 | $0,28 | Знижка 90% |
DeepSeek також провів акцію зі знижкою 75% на V4-Pro до початку травня 2026 року . Для порівняння, вартість виведення GPT-5.5 становить близько $30/MTok, що робить V4-Flash приблизно в 107 разів дешевшим .
Результати тестів DeepSeek V4 розповідають неоднозначну історію:
Важливе застереження від оцінки NIST CAISI (травень 2026): Власні бенчмарки DeepSeek стверджують про паритет із GPT-5.4 та Opus 4.6, але незалежна оцінка CAISI виявила, що V4 є "значно менш потужною" за непублічними тестами, що свідчить про можливе завищення деяких результатів . Індекс інтелекту Artificial Analysis оцінює GPT-5.5 (високий) у 53 бали проти DeepSeek V4 Pro (Reasoning, High Effort) у 41* — GPT-5.5 є розумнішою та швидшою (69 проти 56 токенів/с), але DeepSeek є набагато дешевшою ($0,18 проти $4,35/MTok у режимі міркування) .
Команда Qwen з Alibaba представила Qwen 3.8 Max на Всесвітній конференції зі штучного інтелекту в Шанхаї 19 липня 2026 року . Це перша флагманська модель команди з кількістю параметрів понад 1 трильйон.
| Атрибут | Деталі |
|---|---|
| Усього параметрів | 2,4 трлн (sparse MoE) |
| Архітектура | Mixture-of-Experts, мультимодальна (текст + зір підтверджено) |
| Вікно контексту | 983 616 токенів для кінцевої точки Qwen Cloud ; деякі джерела вказують ~1M |
| Макс. вивід | 64 000 токенів |
| Ліцензія | Ще не опублікована; Alibaba обіцяє відкриті ваги "скоро" |
Жодних публічних цін за принципом "плати за використання" не опубліковано. Доступ зараз здійснюється за підпискою через Qwen Chat та окремих партнерів API. BenchLM вказує ціну Qwen 3.8 Max Preview як "Не вказано" . Деякі сторонні трекери показують автоматичне ціноутворення на рівні $1,50/$5,00 за мільйон вхідних/вихідних токенів, але це не підтверджено Alibaba .
Alibaba стверджує, що Qwen 3.8 є "другою лише після Fable 5" (найкраща модель Claude від Anthropic), що за версією Alibaba ставить її вище за GPT-5.5 та DeepSeek V4 . Заявляються покращення в кодуванні, професійній продуктивності, повноцінній розробці, аналізі даних та офісних робочих процесах порівняно з Qwen 3.7 Max .
Однак, жодних незалежних бенчмарків опубліковано не було. BenchLM, сайт для відстеження результатів тестів, відстежує 321 бенчмарк для Qwen 3.8 Max Preview, з яких 0 підтверджених результатів станом на 20 липня 2026 року . Як зазначив один аналітик, "Qwen 3.8 вартий тестування, але занадто рано розглядати його як стабільну заміну для Kimi K3, GPT-5.6 Sol або Claude Fable 5" .
Для контексту, попередники Qwen створили міцну основу: Qwen 3.6-Max-Preview (20 квітня 2026) — це текстова модель із 35B загальних / 3B активних параметрів і контекстом 262K, яка претендувала на першість у шести бенчмарках кодування та агентів . Qwen 3.7-Max (травень 2026) розширив контекстне вікно до 1 млн токенів і отримав можливості агента з міркуванням . Але жодна з них не вважалася моделлю переднього краю за межами агентного кодування.
Alibaba прямо позиціонує Qwen 3.8 як "другу лише після Fable 5" . Якщо це твердження підтвердиться незалежними оцінками, Qwen 3.8 мала б випередити GPT-5.5 та значно випередити DeepSeek V4. Але з нульовими підтвердженими бенчмарками це залишається маркетинговою заявою, а не встановленим фактом. Fable 5 від Anthropic, згідно з власним формулюванням Alibaba, наразі є визнаним лідером переднього краю .
Агресивне ціноутворення DeepSeek спричинило гонку на дно у вартості API. V4-Flash за $0,14/M за введення є радикально дешевшим за будь-яку західну модель переднього краю. Alibaba ще не встановила ціну на Qwen 3.8, але Qwen 3.6 вже була агресивною за ціною (~$1,25/$7,50 вхід/вихід) .
Відкрита ліцензія MIT для DeepSeek V4 означає можливість самостійного хостингу, що ще більше стискає маржу для закритих провайдерів . Як зазначив один аналітик, практичний ефект полягає в тому, що "розробники тепер можуть отримати доступ до можливостей, близьких до передових (у завданнях кодування), за частку вартості GPT-5.5 або Claude".