Qwen3.8 Flash — мультимодальная модель для работы через QwenCloud: $0,16 за миллион входных токенов и $0,47 за миллион выходных. Qwen3.8 Flash Next открывает архитектурные наработки будущего семейства Qwen4: 125 млрд параметров основной модели, ещё 51 млрд параметров N граммных эмбеддингов и только 6 млрд активных п...
ОпубликовалОтредактировано с помощью GPT-5.6 LunaИзображения созданы с помощью GPT Image 1.5
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What did Alibaba announce with the release of the multimodal Qwen3.8-Flash and the open-weight Qwen3.8-Flash-Next prototype for its future Q. Article summary: Alibaba is pairing a low-cost production model with an open-weight architectural preview: it is trying to make Qwen a widely deployed cloud service while seeding the developer ecosystem for the forthcoming Qwen4 generati. Topic tags: general, documentation, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
Alibaba представила сразу два близких, но не взаимозаменяемых продукта. Qwen3.8-Flash — мультимодальная модель, ориентированная на использование в продакшене через QwenCloud. Qwen3.8-Flash-Next — модель с открытыми весами и ранний просмотр архитектуры, которую компания связывает с будущим семейством Qwen4. 5
15
Логика релиза проста: низкая цена облачного доступа должна привлечь корпоративные сценарии, а открытые веса — сформировать вокруг Qwen экосистему разработчиков, инструментов и интеграций. При этом значительная часть заявлений о производительности и стоимости основана на материалах Alibaba и её модельной документации, а не на независимом тестировании.
Alibaba описывает Qwen3.8-Flash как мультимодальную модель на архитектуре mixture of experts (MoE), предназначенную для программирования, офисных задач и приложений с длинным контекстом. Базовое окно контекста составляет 262 144 токена, а для больших файлов, длинных диалогов и исследовательских рабочих процессов его можно расширить до 1 млн токенов. 5
15
Заявленная цена в QwenCloud — $0,16 за миллион входных токенов и $0,47 за миллион выходных. Alibaba сообщила, что производственный API станет доступен в ближайшее время; последующие публикации описывали QwenCloud как сервис, предоставляющий модель по этим тарифам. 4
15
Для разработчиков это прежде всего инфраструктурное предложение. Такая стоимость снижает порог для экспериментов с обработкой документов, кодирующими агентами и большими потоками запросов — сценариями, где цена инференса быстро становится важнее небольшой разницы в результатах тестов.
Flash-Next — не просто более дешёвый тариф API. Это модель с открытыми весами, предназначенная для демонстрации архитектурных идей будущего Qwen4. В репозитории указаны 125 млрд параметров основной модели, дополнительные 51 млрд параметров N-граммных эмбеддингов и лишь 6 млрд параметров, активируемых для каждого токена.
Такой разреженный дизайн MoE предполагает, что модель располагает большим общим пулом параметров, но при обработке каждого токена задействует только его часть. В теории это позволяет сократить вычисления на токен и одновременно сохранить более высокий потолок ёмкости, чем у сопоставимой плотной модели.
Модельная документация указывает нативное окно контекста в 262 144 токена, которое можно расширить до 1 млн токенов с помощью YaRN. Поскольку Flash и Flash-Next — разные релизы, разработчикам следует отдельно проверять ограничения, требования к памяти и особенности развёртывания конкретной версии. 13
| Параметр | Qwen3.8-Flash | Qwen3.8-Flash-Next |
|---|---|---|
| Основная роль | Облачная производственная модель | Открытый превью-вариант архитектуры Qwen4 |
| Сценарии | Мультимодальное программирование, офисные задачи и агентные процессы | Программирование, офисная работа и длительные агентные задачи |
| Контекст | 262 144 токена по умолчанию; расширение до 1 млн | 262 144 токена нативно; до 1 млн с YaRN, согласно документации |
| Цена | $0,16 за 1 млн входных токенов; $0,47 за 1 млн выходных | Цена API Alibaba для открытых весов не установлена |
| Архитектура | Мультимодальная MoE-модель | 125 млрд параметров основной модели, 51 млрд параметров N-граммных эмбеддингов, 6 млрд активных параметров на токен |
| Доступность | Производственный API QwenCloud анонсирован на конец августа 2026 года | Репозиторий и материалы модельной карты появились в конце августа 2026 года |
Порядок выхода подчёркивает связь продуктов. Материалы Flash-Next дали разработчикам ранний доступ к архитектуре, пока Alibaba готовила облачный сервис Flash. 7
Alibaba утверждает, что новая линейка Flash требует примерно в девять раз меньших затрат на обучение, чем Qwen3.7-Plus, и при этом показывает более высокие результаты, особенно в программировании и офисных задачах. 5
15
Это серьёзное заявление, но пока его следует воспринимать как сравнение, представленное самой компанией, а не как независимо проверенное исследование. Итоговая стоимость обучения зависит от цен на оборудование, продолжительности вычислений, подготовки данных, неудачных запусков и методики подсчёта.
Разреженная архитектура действительно даёт техническое объяснение акценту Alibaba на эффективности: для каждого токена активируется только часть параметров. Для покупателей, однако, практическая картина проще: тариф QwenCloud можно напрямую учитывать в бюджете API, а показатель «одна девятая» пока разумнее рассматривать как стратегический сигнал, а не окончательно установленный факт.
В модельной карте Flash-Next приведены следующие результаты:
В сравнительной таблице Alibaba Flash-Next опережает указанный результат Claude Opus 4.6 Max на SWE-bench Pro, SWE-bench Multilingual, CoWorkBench и JobBench. Например, на SWE-bench Pro приводится соотношение 62,5 против 53,4, а на SWE-bench Multilingual — 81,0 против 77,5.
Эти цифры указывают на сильные стороны модели в программной инженерии и офисных агентных задачах. Но они не доказывают универсальное превосходство Flash-Next над Claude или другими передовыми системами: результаты опубликованы поставщиком, методики могут различаться, а показатели Flash-Next нельзя автоматически переносить на каждое развёртывание производственной Qwen3.8-Flash.
Flash-Next описывается как модель с открытыми весами. В одном из опубликованных обзоров для неё указана лицензия qwen-community-1.0, однако перед распространением, дообучением или запуском коммерческого сервиса разработчикам стоит свериться с лицензией в официальном репозитории и модельной карте. 6
Термин «открытые веса» сам по себе не означает, что использование полностью не ограничено. Лицензия может устанавливать условия для перераспределения, атрибуции, допустимых сценариев и производных моделей. Имеющихся данных недостаточно, чтобы делать более широкие выводы о коммерческих правах на каждый компонент релиза.
Запуск Qwen происходит на фоне масштабного наращивания ИИ-инфраструктуры Alibaba. По данным Reuters, квартальная выручка облачного бизнеса выросла на 45%, капитальные расходы — на 75%, а квартальная чистая прибыль снизилась на 75%. 18
Reuters также сообщало, что Alibaba привлекала $10 млрд через размещение акций в Гонконге для финансирования ИИ-направления. Эти цифры показывают цену стратегии: спрос на облачные мощности и ИИ растёт, но строительство инфраструктуры уже заметно давит на прибыль и денежные потоки.
Поэтому низкие тарифы полезны Alibaba даже в том случае, если они ограничивают краткосрочную маржу моделей. Дешёвый инференс может повысить загрузку облачной инфраструктуры, привлечь корпоративные нагрузки и сделать Qwen одним из стандартных вариантов для приложений с длинным контекстом.
Flash-Next расширяет присутствие Qwen за пределами собственного API. Разработчики могут тестировать модель, адаптировать её и запускать самостоятельно, получая опыт работы с инструментами и архитектурой Qwen без немедленного перехода на QwenCloud.
Такой подход способен дать Alibaba несколько преимуществ:
Это стратегическая интерпретация, а не доказательство того, что Qwen уже завоевал экосистему разработчиков Китая. Источники не дают проверенных текущих данных о числе активных разработчиков, загрузок или корпоративных внедрений.
Qwen3.8-Flash и Flash-Next лучше понимать как две части одной продуктовой стратегии. Flash — недорогой облачный сервис для длинного контекста и массовых рабочих нагрузок. Flash-Next — открытая экосистема и архитектурный задел для Qwen4.
Сочетание цены $0,16 за миллион входных токенов, контекста до 1 млн токенов, всего 6 млрд активных параметров на токен при значительно более крупной модели и сильных опубликованных результатах в программировании и агентных задачах делает релиз заметным для тех, кто следит за экономикой инференса. 4
Но важны оговорки: производственную модель нельзя смешивать с архитектурным превью, заявление о стоимости обучения не прошло независимый аудит, бенчмарки опубликованы поставщиком, а масштабы пользовательского внедрения пока нельзя надёжно измерить по имеющимся данным. Alibaba выглядит серьёзным и хорошо финансируемым участником китайской гонки ИИ, но не безусловным лидером. Готовность компании жертвовать краткосрочной прибылью показывает, что Qwen рассматривается как долгосрочная ставка на облако и экосистему, а не как быстрый источник маржи. 18
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
Qwen3.8 Flash — мультимодальная модель для работы через QwenCloud: $0,16 за миллион входных токенов и $0,47 за миллион выходных.
Qwen3.8 Flash — мультимодальная модель для работы через QwenCloud: $0,16 за миллион входных токенов и $0,47 за миллион выходных. Qwen3.8 Flash Next открывает архитектурные наработки будущего семейства Qwen4: 125 млрд параметров основной модели, ещё 51 млрд параметров N граммных эмбеддингов и только 6 млрд активных параметров на токен.
Релиз вписывается в более широкую ставку Alibaba на ИИ инфраструктуру: выручка облачного бизнеса выросла на 45%, капитальные расходы — на 75%, а квартальная чистая прибыль снизилась на 75%.
Qwen3.8 Flash — мультимодальная модель для работы через QwenCloud: $0,16 за миллион входных токенов и $0,47 за миллион выходных. Qwen3.8 Flash Next открывает архитектурные наработки будущего семейства Qwen4: 125 млрд параметров основной модели, ещё 51 млрд параметров N граммных эмбеддингов и только 6 млрд активных п...
ОпубликовалОтредактировано с помощью GPT-5.6 LunaИзображения созданы с помощью GPT Image 1.5
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What did Alibaba announce with the release of the multimodal Qwen3.8-Flash and the open-weight Qwen3.8-Flash-Next prototype for its future Q. Article summary: Alibaba is pairing a low-cost production model with an open-weight architectural preview: it is trying to make Qwen a widely deployed cloud service while seeding the developer ecosystem for the forthcoming Qwen4 generati. Topic tags: general, documentation, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
Alibaba представила сразу два близких, но не взаимозаменяемых продукта. Qwen3.8-Flash — мультимодальная модель, ориентированная на использование в продакшене через QwenCloud. Qwen3.8-Flash-Next — модель с открытыми весами и ранний просмотр архитектуры, которую компания связывает с будущим семейством Qwen4. 5
15
Логика релиза проста: низкая цена облачного доступа должна привлечь корпоративные сценарии, а открытые веса — сформировать вокруг Qwen экосистему разработчиков, инструментов и интеграций. При этом значительная часть заявлений о производительности и стоимости основана на материалах Alibaba и её модельной документации, а не на независимом тестировании.
Alibaba описывает Qwen3.8-Flash как мультимодальную модель на архитектуре mixture of experts (MoE), предназначенную для программирования, офисных задач и приложений с длинным контекстом. Базовое окно контекста составляет 262 144 токена, а для больших файлов, длинных диалогов и исследовательских рабочих процессов его можно расширить до 1 млн токенов. 5
15
Заявленная цена в QwenCloud — $0,16 за миллион входных токенов и $0,47 за миллион выходных. Alibaba сообщила, что производственный API станет доступен в ближайшее время; последующие публикации описывали QwenCloud как сервис, предоставляющий модель по этим тарифам. 4
15
Для разработчиков это прежде всего инфраструктурное предложение. Такая стоимость снижает порог для экспериментов с обработкой документов, кодирующими агентами и большими потоками запросов — сценариями, где цена инференса быстро становится важнее небольшой разницы в результатах тестов.
Flash-Next — не просто более дешёвый тариф API. Это модель с открытыми весами, предназначенная для демонстрации архитектурных идей будущего Qwen4. В репозитории указаны 125 млрд параметров основной модели, дополнительные 51 млрд параметров N-граммных эмбеддингов и лишь 6 млрд параметров, активируемых для каждого токена.
Такой разреженный дизайн MoE предполагает, что модель располагает большим общим пулом параметров, но при обработке каждого токена задействует только его часть. В теории это позволяет сократить вычисления на токен и одновременно сохранить более высокий потолок ёмкости, чем у сопоставимой плотной модели.
Модельная документация указывает нативное окно контекста в 262 144 токена, которое можно расширить до 1 млн токенов с помощью YaRN. Поскольку Flash и Flash-Next — разные релизы, разработчикам следует отдельно проверять ограничения, требования к памяти и особенности развёртывания конкретной версии. 13
| Параметр | Qwen3.8-Flash | Qwen3.8-Flash-Next |
|---|---|---|
| Основная роль | Облачная производственная модель | Открытый превью-вариант архитектуры Qwen4 |
| Сценарии | Мультимодальное программирование, офисные задачи и агентные процессы | Программирование, офисная работа и длительные агентные задачи |
| Контекст | 262 144 токена по умолчанию; расширение до 1 млн | 262 144 токена нативно; до 1 млн с YaRN, согласно документации |
| Цена | $0,16 за 1 млн входных токенов; $0,47 за 1 млн выходных | Цена API Alibaba для открытых весов не установлена |
| Архитектура | Мультимодальная MoE-модель | 125 млрд параметров основной модели, 51 млрд параметров N-граммных эмбеддингов, 6 млрд активных параметров на токен |
| Доступность | Производственный API QwenCloud анонсирован на конец августа 2026 года | Репозиторий и материалы модельной карты появились в конце августа 2026 года |
Порядок выхода подчёркивает связь продуктов. Материалы Flash-Next дали разработчикам ранний доступ к архитектуре, пока Alibaba готовила облачный сервис Flash. 7
Alibaba утверждает, что новая линейка Flash требует примерно в девять раз меньших затрат на обучение, чем Qwen3.7-Plus, и при этом показывает более высокие результаты, особенно в программировании и офисных задачах. 5
15
Это серьёзное заявление, но пока его следует воспринимать как сравнение, представленное самой компанией, а не как независимо проверенное исследование. Итоговая стоимость обучения зависит от цен на оборудование, продолжительности вычислений, подготовки данных, неудачных запусков и методики подсчёта.
Разреженная архитектура действительно даёт техническое объяснение акценту Alibaba на эффективности: для каждого токена активируется только часть параметров. Для покупателей, однако, практическая картина проще: тариф QwenCloud можно напрямую учитывать в бюджете API, а показатель «одна девятая» пока разумнее рассматривать как стратегический сигнал, а не окончательно установленный факт.
В модельной карте Flash-Next приведены следующие результаты:
В сравнительной таблице Alibaba Flash-Next опережает указанный результат Claude Opus 4.6 Max на SWE-bench Pro, SWE-bench Multilingual, CoWorkBench и JobBench. Например, на SWE-bench Pro приводится соотношение 62,5 против 53,4, а на SWE-bench Multilingual — 81,0 против 77,5.
Эти цифры указывают на сильные стороны модели в программной инженерии и офисных агентных задачах. Но они не доказывают универсальное превосходство Flash-Next над Claude или другими передовыми системами: результаты опубликованы поставщиком, методики могут различаться, а показатели Flash-Next нельзя автоматически переносить на каждое развёртывание производственной Qwen3.8-Flash.
Flash-Next описывается как модель с открытыми весами. В одном из опубликованных обзоров для неё указана лицензия qwen-community-1.0, однако перед распространением, дообучением или запуском коммерческого сервиса разработчикам стоит свериться с лицензией в официальном репозитории и модельной карте. 6
Термин «открытые веса» сам по себе не означает, что использование полностью не ограничено. Лицензия может устанавливать условия для перераспределения, атрибуции, допустимых сценариев и производных моделей. Имеющихся данных недостаточно, чтобы делать более широкие выводы о коммерческих правах на каждый компонент релиза.
Запуск Qwen происходит на фоне масштабного наращивания ИИ-инфраструктуры Alibaba. По данным Reuters, квартальная выручка облачного бизнеса выросла на 45%, капитальные расходы — на 75%, а квартальная чистая прибыль снизилась на 75%. 18
Reuters также сообщало, что Alibaba привлекала $10 млрд через размещение акций в Гонконге для финансирования ИИ-направления. Эти цифры показывают цену стратегии: спрос на облачные мощности и ИИ растёт, но строительство инфраструктуры уже заметно давит на прибыль и денежные потоки.
Поэтому низкие тарифы полезны Alibaba даже в том случае, если они ограничивают краткосрочную маржу моделей. Дешёвый инференс может повысить загрузку облачной инфраструктуры, привлечь корпоративные нагрузки и сделать Qwen одним из стандартных вариантов для приложений с длинным контекстом.
Flash-Next расширяет присутствие Qwen за пределами собственного API. Разработчики могут тестировать модель, адаптировать её и запускать самостоятельно, получая опыт работы с инструментами и архитектурой Qwen без немедленного перехода на QwenCloud.
Такой подход способен дать Alibaba несколько преимуществ:
Это стратегическая интерпретация, а не доказательство того, что Qwen уже завоевал экосистему разработчиков Китая. Источники не дают проверенных текущих данных о числе активных разработчиков, загрузок или корпоративных внедрений.
Qwen3.8-Flash и Flash-Next лучше понимать как две части одной продуктовой стратегии. Flash — недорогой облачный сервис для длинного контекста и массовых рабочих нагрузок. Flash-Next — открытая экосистема и архитектурный задел для Qwen4.
Сочетание цены $0,16 за миллион входных токенов, контекста до 1 млн токенов, всего 6 млрд активных параметров на токен при значительно более крупной модели и сильных опубликованных результатах в программировании и агентных задачах делает релиз заметным для тех, кто следит за экономикой инференса. 4
Но важны оговорки: производственную модель нельзя смешивать с архитектурным превью, заявление о стоимости обучения не прошло независимый аудит, бенчмарки опубликованы поставщиком, а масштабы пользовательского внедрения пока нельзя надёжно измерить по имеющимся данным. Alibaba выглядит серьёзным и хорошо финансируемым участником китайской гонки ИИ, но не безусловным лидером. Готовность компании жертвовать краткосрочной прибылью показывает, что Qwen рассматривается как долгосрочная ставка на облако и экосистему, а не как быстрый источник маржи. 18
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
Qwen3.8 Flash — мультимодальная модель для работы через QwenCloud: $0,16 за миллион входных токенов и $0,47 за миллион выходных.
Qwen3.8 Flash — мультимодальная модель для работы через QwenCloud: $0,16 за миллион входных токенов и $0,47 за миллион выходных. Qwen3.8 Flash Next открывает архитектурные наработки будущего семейства Qwen4: 125 млрд параметров основной модели, ещё 51 млрд параметров N граммных эмбеддингов и только 6 млрд активных параметров на токен.
Релиз вписывается в более широкую ставку Alibaba на ИИ инфраструктуру: выручка облачного бизнеса выросла на 45%, капитальные расходы — на 75%, а квартальная чистая прибыль снизилась на 75%.