Alibaba presenta Qwen3.8 Flash como un modelo multimodal para producción, con un precio anunciado de 0,16 dólares por millón de tokens de entrada y 0,47 dólares por millón de tokens de salida. Qwen3.8 Flash Next funciona como una vista previa de pesos abiertos de la arquitectura prevista para Qwen4: combina un model...
Publicado porEditado con GPT-5.6 LunaImágenes generadas con GPT Image 1.5
Respuesta de investigación

Create a landscape editorial hero image for this Studio Global article: What did Alibaba announce with the release of the multimodal Qwen3.8-Flash and the open-weight Qwen3.8-Flash-Next prototype for its future Q. Article summary: Alibaba is pairing a low-cost production model with an open-weight architectural preview: it is trying to make Qwen a widely deployed cloud service while seeding the developer ecosystem for the forthcoming Qwen4 generati. Topic tags: general, documentation, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
Alibaba ha presentado dos lanzamientos relacionados, pero con funciones diferentes. Qwen3.8-Flash es el modelo multimodal orientado a producción y ofrecido a través de QwenCloud con tarifas especialmente bajas. Qwen3.8-Flash-Next es una versión de pesos abiertos que sirve como anticipo de la arquitectura que la compañía pretende utilizar en la futura familia Qwen4. 5
15
La estrategia es directa: utilizar una inferencia alojada barata para atraer cargas de trabajo empresariales y, al mismo tiempo, publicar los pesos para ganar adopción entre desarrolladores, herramientas y comunidades técnicas. Las cifras de rendimiento y costes son llamativas, aunque muchas proceden de Alibaba o de la tarjeta del propio modelo y no de pruebas independientes.
Alibaba describe Qwen3.8-Flash como un modelo multimodal de mezcla de expertos —MoE, por sus siglas en inglés— pensado para programación, tareas de oficina y aplicaciones con contexto extenso. La compañía afirma que ofrece una ventana de contexto predeterminada de 262.144 tokens, ampliable hasta 1 millón de tokens para archivos grandes, conversaciones prolongadas y flujos de investigación. 5
15
El precio anunciado para QwenCloud es de 0,16 dólares por cada millón de tokens de entrada y 0,47 dólares por cada millón de tokens de salida. Alibaba indicó que la API de producción estaría disponible próximamente, mientras que informaciones posteriores describieron QwenCloud ofreciendo el modelo a esas tarifas. 4
15
Con ese precio, Flash se presenta tanto como un modelo como una pieza de infraestructura. Los desarrolladores pueden probar procesamiento documental, agentes de programación y automatizaciones de gran volumen sin asumir el coste habitual de los modelos de frontera.
Flash-Next no es simplemente un nivel alternativo de la API. Es un modelo de pesos abiertos diseñado para mostrar ideas arquitectónicas que Alibaba vincula con Qwen4. El repositorio identifica un modelo principal de 125.000 millones de parámetros, otros 51.000 millones de parámetros en embeddings N-gram y solo 6.000 millones de parámetros activados por token.
Se trata de un diseño disperso de mezcla de expertos: el modelo contiene un conjunto muy amplio de parámetros, pero cada token utiliza solo una fracción de ellos. En teoría, esto puede reducir el cálculo necesario para cada token y mantener, al mismo tiempo, una capacidad potencial mayor que la de un modelo denso de tamaño comparable.
La información de la tarjeta del modelo señala una ventana nativa de 262.144 tokens, ampliable hasta 1 millón mediante YaRN. 13 Como Flash y Flash-Next son lanzamientos distintos, quienes vayan a desplegarlos deberían comprobar los límites exactos, el comportamiento del servicio y los requisitos de memoria en la documentación de la versión elegida.
| Característica | Qwen3.8-Flash | Qwen3.8-Flash-Next |
|---|---|---|
| Función principal | Modelo alojado para producción | Vista previa de pesos abiertos de la arquitectura de Qwen4 |
| Usos | Programación multimodal, tareas de oficina y agentes | Programación multimodal, tareas de oficina y agentes de larga duración |
| Contexto | 262.144 tokens por defecto; ampliable a 1 millón | 262.144 tokens de forma nativa; ampliable a 1 millón con YaRN, según la información publicada |
| Precio alojado | 0,16 dólares por millón de tokens de entrada; 0,47 dólares por millón de salida | No hay un precio de API de Alibaba establecido para los pesos abiertos |
| Arquitectura | Alibaba presenta la línea Flash como una MoE multimodal | 125.000 millones de parámetros principales, 51.000 millones en embeddings N-gram y 6.000 millones activos por token |
| Disponibilidad | API de producción de QwenCloud anunciada para su lanzamiento | Los pesos y la información de la tarjeta del modelo aparecieron a finales de agosto de 2026 |
El calendario refuerza la relación entre ambos productos. El repositorio y la documentación de Flash-Next estuvieron disponibles antes o al mismo tiempo que el anuncio de la API de producción, lo que permitió a los desarrolladores conocer la arquitectura mientras Alibaba preparaba el servicio alojado. 7
Alibaba asegura que la nueva línea Flash requiere aproximadamente una novena parte del coste de entrenamiento de Qwen3.7-Plus y que, pese a ello, mejora el rendimiento, especialmente en programación y tareas de oficina. 5
15
Es una afirmación importante, pero debe interpretarse como una comparación comunicada por la empresa, no como un estudio de costes auditado de forma independiente. El precio del hardware, la duración del entrenamiento, la preparación de los datos, los intentos fallidos y el método contable pueden cambiar sustancialmente el resultado.
La arquitectura dispersa sí ofrece una explicación técnica plausible para el énfasis de Alibaba en la eficiencia: solo se activa una parte de los parámetros disponibles para cada token. Para los compradores, no obstante, conviene separar ambos mensajes. El precio de la API puede utilizarse directamente para preparar presupuestos; la cifra de una novena parte debe considerarse por ahora una señal estratégica y arquitectónica.
La tarjeta de Qwen3.8-Flash-Next informa de los siguientes resultados:
En la tabla comparativa reproducida por la tarjeta del modelo, Flash-Next supera el resultado atribuido a Claude Opus 4.6 Max en SWE-bench Pro, SWE-bench Multilingual, CoWorkBench y JobBench. Por ejemplo, la comparación publicada es de 62,5 frente a 53,4 en SWE-bench Pro y de 81,0 frente a 77,5 en SWE-bench Multilingual.
Las cifras apuntan a un rendimiento sólido en ingeniería de software y tareas de agentes para entornos laborales. No demuestran que Flash-Next sea superior a Claude u otros sistemas de frontera en todos los usos. Los resultados proceden del proveedor, las configuraciones de evaluación pueden variar y los datos de Flash-Next no deben trasladarse automáticamente a cualquier despliegue de Qwen3.8-Flash en producción.
Las fuentes describen Flash-Next como un modelo de pesos abiertos. Un resumen publicado identifica la licencia como qwen-community-1.0, pero los desarrolladores deberían comprobar la licencia vigente en el repositorio oficial y en la tarjeta del modelo antes de redistribuirlo comercialmente, ajustarlo o ponerlo a disposición mediante un servicio alojado. 6
“Pesos abiertos” no significa necesariamente que todos los usos estén permitidos sin restricciones. La licencia puede establecer condiciones sobre redistribución, atribución, usos aceptables o modelos derivados. La evidencia disponible no basta para hacer una afirmación más amplia sobre los permisos comerciales de todos los componentes del lanzamiento.
El lanzamiento se produce mientras Alibaba aumenta con fuerza su inversión en infraestructura de IA. Reuters informó de que los ingresos trimestrales de nube crecieron un 45 %, mientras que el gasto de capital aumentó un 75 % y el beneficio neto trimestral cayó un 75 %. 18
Reuters también informó de que Alibaba planeaba captar 10.000 millones de dólares mediante una colocación de acciones en Hong Kong para financiar sus objetivos de IA. En conjunto, las cifras muestran el intercambio que hay detrás de la estrategia de Qwen: la demanda de nube y computación para IA crece, pero construir la capacidad necesaria presiona de inmediato los beneficios y la generación de caja.
Los precios bajos pueden ser útiles incluso si reducen el margen a corto plazo. Una inferencia barata puede elevar la utilización de la infraestructura de Alibaba, atraer cargas empresariales y convertir Qwen en una opción habitual para aplicaciones con grandes volúmenes de datos y contexto extenso.
El lanzamiento de Flash-Next amplía el alcance de Alibaba más allá de su propia API. Los desarrolladores pueden probar, adaptar y alojar el modelo por su cuenta, familiarizándose con las herramientas y la arquitectura de Qwen sin tener que comprometerse desde el primer momento con QwenCloud.
Este enfoque puede beneficiar a Alibaba de varias maneras:
La evidencia permite interpretar el lanzamiento como una estrategia de distribución, pero no demuestra que Qwen ya haya conquistado el ecosistema de desarrolladores chino. Las fuentes no aportan cifras verificadas sobre desarrolladores activos, descargas o despliegues empresariales.
Qwen3.8-Flash y Flash-Next se entienden mejor como dos piezas de una misma estrategia. Flash es el servicio de nube económico y con contexto extenso; Flash-Next es la apuesta por el ecosistema abierto y por la arquitectura que podría sostener Qwen4.
La combinación de un precio de 0,16 dólares por millón de tokens de entrada, hasta 1 millón de tokens de contexto, una ruta con 6.000 millones de parámetros activos dentro de un modelo mucho mayor y unos resultados de programación y agentes publicados por el proveedor convierte el lanzamiento en una noticia relevante para quienes siguen la economía de la inferencia. 4
Pero los matices son importantes: el modelo de producción y la vista previa no deben confundirse, la afirmación sobre el coste de entrenamiento no está auditada de forma independiente, las comparaciones de rendimiento proceden del proveedor y la adopción todavía no puede cuantificarse con la evidencia disponible.
Alibaba parece un competidor serio y bien financiado en la carrera de la IA en China, pero no un líder indiscutible. Su disposición a gastar con fuerza indica que Qwen se está tratando como una apuesta de largo plazo para la nube y el ecosistema de desarrolladores, no como una fuente de beneficios inmediatos. 18
Studio Global AI
Esta página incluye una respuesta respaldada por fuentes que puede continuar dentro de Studio Global.
Alibaba presenta Qwen3.8 Flash como un modelo multimodal para producción, con un precio anunciado de 0,16 dólares por millón de tokens de entrada y 0,47 dólares por millón de tokens de salida.
Alibaba presenta Qwen3.8 Flash como un modelo multimodal para producción, con un precio anunciado de 0,16 dólares por millón de tokens de entrada y 0,47 dólares por millón de tokens de salida. Qwen3.8 Flash Next funciona como una vista previa de pesos abiertos de la arquitectura prevista para Qwen4: combina un modelo principal de 125.000 millones de parámetros con 51.000 millones adicionales en embeddings N...
La estrategia llega mientras los ingresos de nube crecen un 45 %, el gasto de capital aumenta un 75 % y el beneficio trimestral cae un 75 %, una señal de que Alibaba prioriza la expansión de su infraestructura de IA s...
Alibaba presenta Qwen3.8 Flash como un modelo multimodal para producción, con un precio anunciado de 0,16 dólares por millón de tokens de entrada y 0,47 dólares por millón de tokens de salida. Qwen3.8 Flash Next funciona como una vista previa de pesos abiertos de la arquitectura prevista para Qwen4: combina un model...
Publicado porEditado con GPT-5.6 LunaImágenes generadas con GPT Image 1.5
Respuesta de investigación

Create a landscape editorial hero image for this Studio Global article: What did Alibaba announce with the release of the multimodal Qwen3.8-Flash and the open-weight Qwen3.8-Flash-Next prototype for its future Q. Article summary: Alibaba is pairing a low-cost production model with an open-weight architectural preview: it is trying to make Qwen a widely deployed cloud service while seeding the developer ecosystem for the forthcoming Qwen4 generati. Topic tags: general, documentation, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
Alibaba ha presentado dos lanzamientos relacionados, pero con funciones diferentes. Qwen3.8-Flash es el modelo multimodal orientado a producción y ofrecido a través de QwenCloud con tarifas especialmente bajas. Qwen3.8-Flash-Next es una versión de pesos abiertos que sirve como anticipo de la arquitectura que la compañía pretende utilizar en la futura familia Qwen4. 5
15
La estrategia es directa: utilizar una inferencia alojada barata para atraer cargas de trabajo empresariales y, al mismo tiempo, publicar los pesos para ganar adopción entre desarrolladores, herramientas y comunidades técnicas. Las cifras de rendimiento y costes son llamativas, aunque muchas proceden de Alibaba o de la tarjeta del propio modelo y no de pruebas independientes.
Alibaba describe Qwen3.8-Flash como un modelo multimodal de mezcla de expertos —MoE, por sus siglas en inglés— pensado para programación, tareas de oficina y aplicaciones con contexto extenso. La compañía afirma que ofrece una ventana de contexto predeterminada de 262.144 tokens, ampliable hasta 1 millón de tokens para archivos grandes, conversaciones prolongadas y flujos de investigación. 5
15
El precio anunciado para QwenCloud es de 0,16 dólares por cada millón de tokens de entrada y 0,47 dólares por cada millón de tokens de salida. Alibaba indicó que la API de producción estaría disponible próximamente, mientras que informaciones posteriores describieron QwenCloud ofreciendo el modelo a esas tarifas. 4
15
Con ese precio, Flash se presenta tanto como un modelo como una pieza de infraestructura. Los desarrolladores pueden probar procesamiento documental, agentes de programación y automatizaciones de gran volumen sin asumir el coste habitual de los modelos de frontera.
Flash-Next no es simplemente un nivel alternativo de la API. Es un modelo de pesos abiertos diseñado para mostrar ideas arquitectónicas que Alibaba vincula con Qwen4. El repositorio identifica un modelo principal de 125.000 millones de parámetros, otros 51.000 millones de parámetros en embeddings N-gram y solo 6.000 millones de parámetros activados por token.
Se trata de un diseño disperso de mezcla de expertos: el modelo contiene un conjunto muy amplio de parámetros, pero cada token utiliza solo una fracción de ellos. En teoría, esto puede reducir el cálculo necesario para cada token y mantener, al mismo tiempo, una capacidad potencial mayor que la de un modelo denso de tamaño comparable.
La información de la tarjeta del modelo señala una ventana nativa de 262.144 tokens, ampliable hasta 1 millón mediante YaRN. 13 Como Flash y Flash-Next son lanzamientos distintos, quienes vayan a desplegarlos deberían comprobar los límites exactos, el comportamiento del servicio y los requisitos de memoria en la documentación de la versión elegida.
| Característica | Qwen3.8-Flash | Qwen3.8-Flash-Next |
|---|---|---|
| Función principal | Modelo alojado para producción | Vista previa de pesos abiertos de la arquitectura de Qwen4 |
| Usos | Programación multimodal, tareas de oficina y agentes | Programación multimodal, tareas de oficina y agentes de larga duración |
| Contexto | 262.144 tokens por defecto; ampliable a 1 millón | 262.144 tokens de forma nativa; ampliable a 1 millón con YaRN, según la información publicada |
| Precio alojado | 0,16 dólares por millón de tokens de entrada; 0,47 dólares por millón de salida | No hay un precio de API de Alibaba establecido para los pesos abiertos |
| Arquitectura | Alibaba presenta la línea Flash como una MoE multimodal | 125.000 millones de parámetros principales, 51.000 millones en embeddings N-gram y 6.000 millones activos por token |
| Disponibilidad | API de producción de QwenCloud anunciada para su lanzamiento | Los pesos y la información de la tarjeta del modelo aparecieron a finales de agosto de 2026 |
El calendario refuerza la relación entre ambos productos. El repositorio y la documentación de Flash-Next estuvieron disponibles antes o al mismo tiempo que el anuncio de la API de producción, lo que permitió a los desarrolladores conocer la arquitectura mientras Alibaba preparaba el servicio alojado. 7
Alibaba asegura que la nueva línea Flash requiere aproximadamente una novena parte del coste de entrenamiento de Qwen3.7-Plus y que, pese a ello, mejora el rendimiento, especialmente en programación y tareas de oficina. 5
15
Es una afirmación importante, pero debe interpretarse como una comparación comunicada por la empresa, no como un estudio de costes auditado de forma independiente. El precio del hardware, la duración del entrenamiento, la preparación de los datos, los intentos fallidos y el método contable pueden cambiar sustancialmente el resultado.
La arquitectura dispersa sí ofrece una explicación técnica plausible para el énfasis de Alibaba en la eficiencia: solo se activa una parte de los parámetros disponibles para cada token. Para los compradores, no obstante, conviene separar ambos mensajes. El precio de la API puede utilizarse directamente para preparar presupuestos; la cifra de una novena parte debe considerarse por ahora una señal estratégica y arquitectónica.
La tarjeta de Qwen3.8-Flash-Next informa de los siguientes resultados:
En la tabla comparativa reproducida por la tarjeta del modelo, Flash-Next supera el resultado atribuido a Claude Opus 4.6 Max en SWE-bench Pro, SWE-bench Multilingual, CoWorkBench y JobBench. Por ejemplo, la comparación publicada es de 62,5 frente a 53,4 en SWE-bench Pro y de 81,0 frente a 77,5 en SWE-bench Multilingual.
Las cifras apuntan a un rendimiento sólido en ingeniería de software y tareas de agentes para entornos laborales. No demuestran que Flash-Next sea superior a Claude u otros sistemas de frontera en todos los usos. Los resultados proceden del proveedor, las configuraciones de evaluación pueden variar y los datos de Flash-Next no deben trasladarse automáticamente a cualquier despliegue de Qwen3.8-Flash en producción.
Las fuentes describen Flash-Next como un modelo de pesos abiertos. Un resumen publicado identifica la licencia como qwen-community-1.0, pero los desarrolladores deberían comprobar la licencia vigente en el repositorio oficial y en la tarjeta del modelo antes de redistribuirlo comercialmente, ajustarlo o ponerlo a disposición mediante un servicio alojado. 6
“Pesos abiertos” no significa necesariamente que todos los usos estén permitidos sin restricciones. La licencia puede establecer condiciones sobre redistribución, atribución, usos aceptables o modelos derivados. La evidencia disponible no basta para hacer una afirmación más amplia sobre los permisos comerciales de todos los componentes del lanzamiento.
El lanzamiento se produce mientras Alibaba aumenta con fuerza su inversión en infraestructura de IA. Reuters informó de que los ingresos trimestrales de nube crecieron un 45 %, mientras que el gasto de capital aumentó un 75 % y el beneficio neto trimestral cayó un 75 %. 18
Reuters también informó de que Alibaba planeaba captar 10.000 millones de dólares mediante una colocación de acciones en Hong Kong para financiar sus objetivos de IA. En conjunto, las cifras muestran el intercambio que hay detrás de la estrategia de Qwen: la demanda de nube y computación para IA crece, pero construir la capacidad necesaria presiona de inmediato los beneficios y la generación de caja.
Los precios bajos pueden ser útiles incluso si reducen el margen a corto plazo. Una inferencia barata puede elevar la utilización de la infraestructura de Alibaba, atraer cargas empresariales y convertir Qwen en una opción habitual para aplicaciones con grandes volúmenes de datos y contexto extenso.
El lanzamiento de Flash-Next amplía el alcance de Alibaba más allá de su propia API. Los desarrolladores pueden probar, adaptar y alojar el modelo por su cuenta, familiarizándose con las herramientas y la arquitectura de Qwen sin tener que comprometerse desde el primer momento con QwenCloud.
Este enfoque puede beneficiar a Alibaba de varias maneras:
La evidencia permite interpretar el lanzamiento como una estrategia de distribución, pero no demuestra que Qwen ya haya conquistado el ecosistema de desarrolladores chino. Las fuentes no aportan cifras verificadas sobre desarrolladores activos, descargas o despliegues empresariales.
Qwen3.8-Flash y Flash-Next se entienden mejor como dos piezas de una misma estrategia. Flash es el servicio de nube económico y con contexto extenso; Flash-Next es la apuesta por el ecosistema abierto y por la arquitectura que podría sostener Qwen4.
La combinación de un precio de 0,16 dólares por millón de tokens de entrada, hasta 1 millón de tokens de contexto, una ruta con 6.000 millones de parámetros activos dentro de un modelo mucho mayor y unos resultados de programación y agentes publicados por el proveedor convierte el lanzamiento en una noticia relevante para quienes siguen la economía de la inferencia. 4
Pero los matices son importantes: el modelo de producción y la vista previa no deben confundirse, la afirmación sobre el coste de entrenamiento no está auditada de forma independiente, las comparaciones de rendimiento proceden del proveedor y la adopción todavía no puede cuantificarse con la evidencia disponible.
Alibaba parece un competidor serio y bien financiado en la carrera de la IA en China, pero no un líder indiscutible. Su disposición a gastar con fuerza indica que Qwen se está tratando como una apuesta de largo plazo para la nube y el ecosistema de desarrolladores, no como una fuente de beneficios inmediatos. 18
Studio Global AI
Esta página incluye una respuesta respaldada por fuentes que puede continuar dentro de Studio Global.
Alibaba presenta Qwen3.8 Flash como un modelo multimodal para producción, con un precio anunciado de 0,16 dólares por millón de tokens de entrada y 0,47 dólares por millón de tokens de salida.
Alibaba presenta Qwen3.8 Flash como un modelo multimodal para producción, con un precio anunciado de 0,16 dólares por millón de tokens de entrada y 0,47 dólares por millón de tokens de salida. Qwen3.8 Flash Next funciona como una vista previa de pesos abiertos de la arquitectura prevista para Qwen4: combina un modelo principal de 125.000 millones de parámetros con 51.000 millones adicionales en embeddings N...
La estrategia llega mientras los ingresos de nube crecen un 45 %, el gasto de capital aumenta un 75 % y el beneficio trimestral cae un 75 %, una señal de que Alibaba prioriza la expansión de su infraestructura de IA s...