Alibaba поєднала Qwen3.8 Flash — мультимодальну хмарну модель за $0,16 за мільйон вхідних і $0,47 за мільйон вихідних токенів — із Flash Next, відкритим прев’ю архітектури Qwen4. Flash Next має основну модель на 125 млрд параметрів і ще 51 млрд параметрів N грамових embeddings, але активує лише 6 млрд параметрів для...
ОпублікувавВідредаговано за допомогою GPT-5.6 LunaЗображення створено за допомогою GPT Image 1.5
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Alibaba announce with the release of the multimodal Qwen3.8-Flash and the open-weight Qwen3.8-Flash-Next prototype for its future Q. Article summary: Alibaba is pairing a low-cost production model with an open-weight architectural preview: it is trying to make Qwen a widely deployed cloud service while seeding the developer ecosystem for the forthcoming Qwen4 generati. Topic tags: general, documentation, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
Alibaba представила одразу два близькі за назвою, але різні за призначенням продукти. Qwen3.8-Flash — мультимодальна модель для використання у виробничих системах через QwenCloud. Qwen3.8-Flash-Next — модель із відкритими вагами, яка демонструє архітектурні рішення, заплановані для майбутнього сімейства Qwen4. 5
15
Стратегія компанії виглядає доволі прямолінійно: низька ціна хмарного доступу має залучити корпоративні навантаження, а відкриті ваги — сформувати спільноту розробників, інструменти та сумісність навколо наступного покоління Qwen. Водночас важливо враховувати, що значна частина показників продуктивності та вартості походить від Alibaba або з її модельної картки, а не з незалежних тестів.
Alibaba описує Qwen3.8-Flash як мультимодальну модель на базі суміші експертів (Mixture of Experts, MoE), орієнтовану на програмування, офісні завдання та роботу з довгим контекстом. Стандартне контекстне вікно становить 262 144 токени, а для великих файлів, тривалих діалогів і дослідницьких сценаріїв його можна розширити до 1 мільйона токенів. 5
15
Заявлена ціна в QwenCloud — $0,16 за мільйон вхідних токенів і $0,47 за мільйон вихідних токенів. Alibaba повідомила, що виробничий API буде доступний найближчим часом; подальші повідомлення описували QwenCloud як сервіс, що надає модель за цими тарифами. 4
15
За такого рівня цін Flash — це не лише реліз нової моделі, а й інфраструктурний продукт. Розробники можуть дешевше експериментувати з обробкою документів, програмними агентами та великою кількістю запитів, не сплачуючи типову премію за найпотужніші моделі.
Flash-Next — не просто дешевший тариф або альтернативний API. Це модель із відкритими вагами, призначена для демонстрації архітектурних ідей майбутнього Qwen4. У репозиторії вказано 125 млрд параметрів основної моделі, додаткові 51 млрд параметрів N-грамових embeddings і лише 6 млрд активних параметрів на токен.
Йдеться про розріджену архітектуру Mixture of Experts: модель містить великий набір параметрів, але для обробки кожного токена задіюється лише його частина. Теоретично це дає змогу зменшити обчислення на токен і водночас зберегти більший потенціал, ніж у щільної моделі зі схожими обчислювальними витратами.
Модельна картка вказує на нативне контекстне вікно 262 144 токени, яке можна розширити до 1 мільйона токенів за допомогою YaRN. 13 Оскільки Flash і Flash-Next є різними релізами, розробникам варто окремо перевіряти ліміти, поведінку під час обслуговування та вимоги до пам’яті для конкретної версії.
| Параметр | Qwen3.8-Flash | Qwen3.8-Flash-Next |
|---|---|---|
| Основна роль | Хмарна модель для продакшену | Відкрите прев’ю архітектури Qwen4 |
| Сценарії | Мультимодальне програмування, офісні та агентські завдання | Мультимодальне програмування, офісні та довготривалі агентські завдання |
| Контекст | 262 144 токени за замовчуванням, до 1 мільйона | 262 144 токени нативно, за повідомленнями — до 1 мільйона з YaRN |
| Ціна API | $0,16 за 1 млн вхідних токенів; $0,47 за 1 млн вихідних | Окрему ціну API для відкритих ваг не встановлено |
| Архітектура | Alibaba описує лінійку Flash як мультимодальну MoE | 125 млрд параметрів основної моделі, 51 млрд N-грамових embeddings, 6 млрд активних на токен |
| Доступність | Виробничий API QwenCloud анонсовано на 26 серпня 2026 року | Ваги та модельна картка з’явилися наприкінці серпня 2026 року |
Час виходу підкреслює зв’язок між продуктами. Репозиторій і матеріали модельної картки Flash-Next стали доступними до або одночасно з оголошенням виробничого API, давши розробникам ранній доступ до архітектури, поки Alibaba готувала хмарний сервіс. 7
Alibaba стверджує, що нова лінійка Flash потребувала приблизно в дев’ять разів менших витрат на навчання, ніж Qwen3.7-Plus, водночас показуючи кращі результати, особливо в програмуванні та офісних завданнях. 5
15
Це масштабна заява, але її слід сприймати як порівняння, оприлюднене самою компанією, а не як незалежний аудит. Витрати на навчання залежать від цін на обладнання, тривалості тренування, підготовки даних, невдалих запусків і методики підрахунку.
Водночас розріджена архітектура дає технічне підґрунтя для акценту Alibaba на ефективності: для кожного токена активується лише частина доступних параметрів. Для покупців різниця проста: тариф хмарного Flash можна безпосередньо закладати в бюджет API, тоді як показник «в дев’ять разів дешевше» поки що краще розглядати як стратегічний сигнал, доки не з’являться зіставні незалежні вимірювання.
У модельній картці Flash-Next наведено такі результати:
У таблиці порівняння, яку відтворює модельна картка, Flash-Next випереджає наведений результат Claude Opus 4.6 Max у SWE-bench Pro, SWE-bench Multilingual, CoWorkBench і JobBench. Наприклад, у SWE-bench Pro вказано 62,5 проти 53,4, а в SWE-bench Multilingual — 81,0 проти 77,5.
Ці дані вказують на сильні позиції моделі в програмній інженерії та завданнях офісних агентів. Але вони не доводять, що Flash-Next універсально краща за Claude чи інші передові системи. Показники оприлюднені постачальником, методики оцінювання можуть відрізнятися, а результати Flash-Next не слід автоматично переносити на кожне розгортання виробничого Qwen3.8-Flash.
У джерелах Flash-Next описується як модель із відкритими вагами. Один із опублікованих оглядів зазначає ліцензію qwen-community-1.0, однак перед комерційним поширенням, донавчанням або запуском власного сервісу розробникам варто перевірити чинні умови в офіційному репозиторії та модельній картці. 6
«Відкриті ваги» не означає автоматично необмежене використання. Ліцензія може містити вимоги щодо поширення, атрибуції, допустимих сценаріїв або похідних моделей. Наданих даних недостатньо, щоб робити ширші висновки про комерційні права на всі компоненти релізу.
Реліз відбувся на тлі масштабного нарощування інвестицій Alibaba у ШІ-інфраструктуру. За даними Reuters, квартальний дохід хмарного бізнесу зріс на 45%, тоді як капітальні витрати збільшилися на 75%, а квартальний чистий прибуток скоротився на 75%. 18
Reuters також повідомляв, що Alibaba залучає $10 млрд через розміщення акцій у Гонконзі для фінансування планів у сфері ШІ. Разом ці цифри демонструють ціну стратегії Qwen: попит на хмарні та ШІ-обчислення зростає, але будівництво необхідної інфраструктури вже тисне на прибуток і грошові потоки.
Тому низька ціна може бути стратегічно вигідною навіть за невисокої короткострокової маржі моделі. Дешеві обчислення здатні підвищити завантаження хмарної інфраструктури Alibaba, залучити корпоративні проєкти та зробити Qwen одним із базових варіантів для застосунків із довгим контекстом.
Flash-Next розширює присутність Alibaba за межами власного API. Розробники можуть тестувати, адаптувати й самостійно розгортати модель, знайомлячись з інструментами та архітектурою Qwen без негайної прив’язки до QwenCloud.
Для Alibaba це може дати кілька переваг:
Доступні джерела підтверджують таке трактування як стратегічну інтерпретацію, але не доводять, що Qwen уже завоював екосистему розробників у Китаї. Перевірених актуальних даних про кількість активних розробників, завантажень чи корпоративних впроваджень немає.
Qwen3.8-Flash і Flash-Next найкраще розглядати як дві частини однієї продуктової стратегії. Flash — це недорогий хмарний сервіс із довгим контекстом. Flash-Next — відкритий екосистемний і архітектурний експеримент, спрямований у бік Qwen4.
Поєднання ціни $0,16 за мільйон вхідних токенів, контексту до 1 мільйона токенів, заявленого шляху з 6 млрд активних параметрів у значно більшій моделі та сильних опублікованих Alibaba результатів у програмуванні й агентських завданнях робить реліз важливим для розробників, які стежать за економікою інференсу. 4
Однак застереження мають значення. Виробничу модель і відкрите прев’ю не можна ототожнювати, заяву про дев’ятикратне скорочення витрат не перевірено незалежно, бенчмарки опубліковані постачальником, а масштаб adoption неможливо точно оцінити за наданими даними.
Alibaba виглядає серйозним і добре профінансованим учасником китайської гонки ШІ, але не беззаперечним лідером. Готовність компанії витрачати значні кошти свідчить, що Qwen розглядається як довгострокова ставка на хмарний бізнес та екосистему, а не як інструмент швидкого прибутку. 18
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Alibaba поєднала Qwen3.8 Flash — мультимодальну хмарну модель за $0,16 за мільйон вхідних і $0,47 за мільйон вихідних токенів — із Flash Next, відкритим прев’ю архітектури Qwen4.
Alibaba поєднала Qwen3.8 Flash — мультимодальну хмарну модель за $0,16 за мільйон вхідних і $0,47 за мільйон вихідних токенів — із Flash Next, відкритим прев’ю архітектури Qwen4. Flash Next має основну модель на 125 млрд параметрів і ще 51 млрд параметрів N грамових embeddings, але активує лише 6 млрд параметрів для кожного токена.
Запуск відповідає ширшій стратегії Alibaba: доходи хмарного бізнесу зростають, однак збільшення капітальних витрат на 75% супроводжувалося падінням квартального чистого прибутку на 75%.
Alibaba поєднала Qwen3.8 Flash — мультимодальну хмарну модель за $0,16 за мільйон вхідних і $0,47 за мільйон вихідних токенів — із Flash Next, відкритим прев’ю архітектури Qwen4. Flash Next має основну модель на 125 млрд параметрів і ще 51 млрд параметрів N грамових embeddings, але активує лише 6 млрд параметрів для...
ОпублікувавВідредаговано за допомогою GPT-5.6 LunaЗображення створено за допомогою GPT Image 1.5
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Alibaba announce with the release of the multimodal Qwen3.8-Flash and the open-weight Qwen3.8-Flash-Next prototype for its future Q. Article summary: Alibaba is pairing a low-cost production model with an open-weight architectural preview: it is trying to make Qwen a widely deployed cloud service while seeding the developer ecosystem for the forthcoming Qwen4 generati. Topic tags: general, documentation, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
Alibaba представила одразу два близькі за назвою, але різні за призначенням продукти. Qwen3.8-Flash — мультимодальна модель для використання у виробничих системах через QwenCloud. Qwen3.8-Flash-Next — модель із відкритими вагами, яка демонструє архітектурні рішення, заплановані для майбутнього сімейства Qwen4. 5
15
Стратегія компанії виглядає доволі прямолінійно: низька ціна хмарного доступу має залучити корпоративні навантаження, а відкриті ваги — сформувати спільноту розробників, інструменти та сумісність навколо наступного покоління Qwen. Водночас важливо враховувати, що значна частина показників продуктивності та вартості походить від Alibaba або з її модельної картки, а не з незалежних тестів.
Alibaba описує Qwen3.8-Flash як мультимодальну модель на базі суміші експертів (Mixture of Experts, MoE), орієнтовану на програмування, офісні завдання та роботу з довгим контекстом. Стандартне контекстне вікно становить 262 144 токени, а для великих файлів, тривалих діалогів і дослідницьких сценаріїв його можна розширити до 1 мільйона токенів. 5
15
Заявлена ціна в QwenCloud — $0,16 за мільйон вхідних токенів і $0,47 за мільйон вихідних токенів. Alibaba повідомила, що виробничий API буде доступний найближчим часом; подальші повідомлення описували QwenCloud як сервіс, що надає модель за цими тарифами. 4
15
За такого рівня цін Flash — це не лише реліз нової моделі, а й інфраструктурний продукт. Розробники можуть дешевше експериментувати з обробкою документів, програмними агентами та великою кількістю запитів, не сплачуючи типову премію за найпотужніші моделі.
Flash-Next — не просто дешевший тариф або альтернативний API. Це модель із відкритими вагами, призначена для демонстрації архітектурних ідей майбутнього Qwen4. У репозиторії вказано 125 млрд параметрів основної моделі, додаткові 51 млрд параметрів N-грамових embeddings і лише 6 млрд активних параметрів на токен.
Йдеться про розріджену архітектуру Mixture of Experts: модель містить великий набір параметрів, але для обробки кожного токена задіюється лише його частина. Теоретично це дає змогу зменшити обчислення на токен і водночас зберегти більший потенціал, ніж у щільної моделі зі схожими обчислювальними витратами.
Модельна картка вказує на нативне контекстне вікно 262 144 токени, яке можна розширити до 1 мільйона токенів за допомогою YaRN. 13 Оскільки Flash і Flash-Next є різними релізами, розробникам варто окремо перевіряти ліміти, поведінку під час обслуговування та вимоги до пам’яті для конкретної версії.
| Параметр | Qwen3.8-Flash | Qwen3.8-Flash-Next |
|---|---|---|
| Основна роль | Хмарна модель для продакшену | Відкрите прев’ю архітектури Qwen4 |
| Сценарії | Мультимодальне програмування, офісні та агентські завдання | Мультимодальне програмування, офісні та довготривалі агентські завдання |
| Контекст | 262 144 токени за замовчуванням, до 1 мільйона | 262 144 токени нативно, за повідомленнями — до 1 мільйона з YaRN |
| Ціна API | $0,16 за 1 млн вхідних токенів; $0,47 за 1 млн вихідних | Окрему ціну API для відкритих ваг не встановлено |
| Архітектура | Alibaba описує лінійку Flash як мультимодальну MoE | 125 млрд параметрів основної моделі, 51 млрд N-грамових embeddings, 6 млрд активних на токен |
| Доступність | Виробничий API QwenCloud анонсовано на 26 серпня 2026 року | Ваги та модельна картка з’явилися наприкінці серпня 2026 року |
Час виходу підкреслює зв’язок між продуктами. Репозиторій і матеріали модельної картки Flash-Next стали доступними до або одночасно з оголошенням виробничого API, давши розробникам ранній доступ до архітектури, поки Alibaba готувала хмарний сервіс. 7
Alibaba стверджує, що нова лінійка Flash потребувала приблизно в дев’ять разів менших витрат на навчання, ніж Qwen3.7-Plus, водночас показуючи кращі результати, особливо в програмуванні та офісних завданнях. 5
15
Це масштабна заява, але її слід сприймати як порівняння, оприлюднене самою компанією, а не як незалежний аудит. Витрати на навчання залежать від цін на обладнання, тривалості тренування, підготовки даних, невдалих запусків і методики підрахунку.
Водночас розріджена архітектура дає технічне підґрунтя для акценту Alibaba на ефективності: для кожного токена активується лише частина доступних параметрів. Для покупців різниця проста: тариф хмарного Flash можна безпосередньо закладати в бюджет API, тоді як показник «в дев’ять разів дешевше» поки що краще розглядати як стратегічний сигнал, доки не з’являться зіставні незалежні вимірювання.
У модельній картці Flash-Next наведено такі результати:
У таблиці порівняння, яку відтворює модельна картка, Flash-Next випереджає наведений результат Claude Opus 4.6 Max у SWE-bench Pro, SWE-bench Multilingual, CoWorkBench і JobBench. Наприклад, у SWE-bench Pro вказано 62,5 проти 53,4, а в SWE-bench Multilingual — 81,0 проти 77,5.
Ці дані вказують на сильні позиції моделі в програмній інженерії та завданнях офісних агентів. Але вони не доводять, що Flash-Next універсально краща за Claude чи інші передові системи. Показники оприлюднені постачальником, методики оцінювання можуть відрізнятися, а результати Flash-Next не слід автоматично переносити на кожне розгортання виробничого Qwen3.8-Flash.
У джерелах Flash-Next описується як модель із відкритими вагами. Один із опублікованих оглядів зазначає ліцензію qwen-community-1.0, однак перед комерційним поширенням, донавчанням або запуском власного сервісу розробникам варто перевірити чинні умови в офіційному репозиторії та модельній картці. 6
«Відкриті ваги» не означає автоматично необмежене використання. Ліцензія може містити вимоги щодо поширення, атрибуції, допустимих сценаріїв або похідних моделей. Наданих даних недостатньо, щоб робити ширші висновки про комерційні права на всі компоненти релізу.
Реліз відбувся на тлі масштабного нарощування інвестицій Alibaba у ШІ-інфраструктуру. За даними Reuters, квартальний дохід хмарного бізнесу зріс на 45%, тоді як капітальні витрати збільшилися на 75%, а квартальний чистий прибуток скоротився на 75%. 18
Reuters також повідомляв, що Alibaba залучає $10 млрд через розміщення акцій у Гонконзі для фінансування планів у сфері ШІ. Разом ці цифри демонструють ціну стратегії Qwen: попит на хмарні та ШІ-обчислення зростає, але будівництво необхідної інфраструктури вже тисне на прибуток і грошові потоки.
Тому низька ціна може бути стратегічно вигідною навіть за невисокої короткострокової маржі моделі. Дешеві обчислення здатні підвищити завантаження хмарної інфраструктури Alibaba, залучити корпоративні проєкти та зробити Qwen одним із базових варіантів для застосунків із довгим контекстом.
Flash-Next розширює присутність Alibaba за межами власного API. Розробники можуть тестувати, адаптувати й самостійно розгортати модель, знайомлячись з інструментами та архітектурою Qwen без негайної прив’язки до QwenCloud.
Для Alibaba це може дати кілька переваг:
Доступні джерела підтверджують таке трактування як стратегічну інтерпретацію, але не доводять, що Qwen уже завоював екосистему розробників у Китаї. Перевірених актуальних даних про кількість активних розробників, завантажень чи корпоративних впроваджень немає.
Qwen3.8-Flash і Flash-Next найкраще розглядати як дві частини однієї продуктової стратегії. Flash — це недорогий хмарний сервіс із довгим контекстом. Flash-Next — відкритий екосистемний і архітектурний експеримент, спрямований у бік Qwen4.
Поєднання ціни $0,16 за мільйон вхідних токенів, контексту до 1 мільйона токенів, заявленого шляху з 6 млрд активних параметрів у значно більшій моделі та сильних опублікованих Alibaba результатів у програмуванні й агентських завданнях робить реліз важливим для розробників, які стежать за економікою інференсу. 4
Однак застереження мають значення. Виробничу модель і відкрите прев’ю не можна ототожнювати, заяву про дев’ятикратне скорочення витрат не перевірено незалежно, бенчмарки опубліковані постачальником, а масштаб adoption неможливо точно оцінити за наданими даними.
Alibaba виглядає серйозним і добре профінансованим учасником китайської гонки ШІ, але не беззаперечним лідером. Готовність компанії витрачати значні кошти свідчить, що Qwen розглядається як довгострокова ставка на хмарний бізнес та екосистему, а не як інструмент швидкого прибутку. 18
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Alibaba поєднала Qwen3.8 Flash — мультимодальну хмарну модель за $0,16 за мільйон вхідних і $0,47 за мільйон вихідних токенів — із Flash Next, відкритим прев’ю архітектури Qwen4.
Alibaba поєднала Qwen3.8 Flash — мультимодальну хмарну модель за $0,16 за мільйон вхідних і $0,47 за мільйон вихідних токенів — із Flash Next, відкритим прев’ю архітектури Qwen4. Flash Next має основну модель на 125 млрд параметрів і ще 51 млрд параметрів N грамових embeddings, але активує лише 6 млрд параметрів для кожного токена.
Запуск відповідає ширшій стратегії Alibaba: доходи хмарного бізнесу зростають, однак збільшення капітальних витрат на 75% супроводжувалося падінням квартального чистого прибутку на 75%.