| Variante | Parámetros totales | Parámetros activos | Ventana de contexto | Salida máxima |
|---|---|---|---|---|
| V4-Pro | 1,6 billones (MoE) | ~49B por token | 1M tokens | 384K tokens |
| V4-Flash | 284 mil millones (MoE) | ~13B por token | 1M tokens | 384K tokens |
Ambas variantes son multimodales (texto, imagen, video), admiten salida JSON y llamadas a herramientas, y están disponibles a través de API y web .
| Variante | Entrada (fuera de hora pico) | Salida (fuera de hora pico) | Acierto de caché |
|---|---|---|---|
| V4-Pro | $0.435 | $0.87 | 90% de descuento |
| V4-Flash | $0.14 | $0.28 | 90% de descuento |
DeepSeek también ofreció una promoción del 75% de descuento en V4-Pro hasta principios de mayo de 2026 . A modo de comparación, el precio de salida de GPT-5.5 es de aproximadamente 30 USD/MTok, lo que hace que V4-Flash sea aproximadamente 107 veces más barato en la salida .
Los resultados de los benchmarks de DeepSeek V4 cuentan una historia matizada:
Advertencia importante de la evaluación CAISI del NIST (mayo de 2026): Los benchmarks autoinformados por DeepSeek afirman estar a la par con GPT-5.4 y Opus 4.6, pero la evaluación independiente de CAISI encontró que V4 era "sustancialmente menos capaz" en benchmarks no públicos, lo que sugiere que algunas puntuaciones autoinformadas podrían estar infladas . El Índice de Inteligencia de Artificial Analysis sitúa a GPT-5.5 (alto) en 53 frente a DeepSeek V4 Pro (Razonamiento, Alto Esfuerzo) en 41*: GPT-5.5 es más inteligente y más rápido (69 frente a 56 tok/s), pero DeepSeek es dramáticamente más barato (0.18 USD frente a 4.35 USD/MTok en modo de razonamiento) .
El equipo Qwen de Alibaba presentó una vista previa de Qwen 3.8 Max en la Conferencia Mundial de IA en Shanghái el 19 de julio de 2026 . Es el primer modelo insignia del equipo con más de 1 billón de parámetros.
| Atributo | Detalle |
|---|---|
| Parámetros totales | 2,4 billones (MoE disperso) |
| Arquitectura | Mixture-of-Experts, multimodal (texto + visión confirmados) |
| Ventana de contexto | 983,616 tokens por endpoint de Qwen Cloud ; repetido como ~1M en algunas fuentes |
| Salida máxima | 64,000 tokens |
| Licencia | Aún no publicada; Alibaba dice que los pesos abiertos llegarán "pronto" |
No se ha publicado ningún precio de pago por uso. El acceso es actualmente a través de suscripción mediante Qwen Chat y socios API selectos. BenchLM enumera el precio de la vista previa de Qwen 3.8 Max como "No listado" . Algunos rastreadores de terceros muestran un precio automático de 1.50/5.00 USD por millón de tokens de entrada/salida, pero esto no está confirmado por Alibaba .
Alibaba afirma que Qwen 3.8 es "solo superado por Fable 5" (el mejor modelo Claude de Anthropic), lo que, según la propia clasificación de Alibaba, lo situaría por delante de GPT-5.5 y DeepSeek V4 . Se afirma que hay mejoras en codificación, productividad profesional, desarrollo full-stack, análisis de datos y flujos de trabajo de oficina en comparación con Qwen 3.7 Max .
Sin embargo, no se han publicado benchmarks independientes. BenchLM, un sitio de seguimiento de benchmarks, rastrea 321 benchmarks para Qwen 3.8 Max Preview con 0 resultados verificados al 20 de julio de 2026 . Como señaló un análisis, "Qwen 3.8 vale la pena probarlo, pero es demasiado pronto para tratarlo como un reemplazo de producción estable para Kimi K3, GPT-5.6 Sol o Claude Fable 5" .
Para contextualizar, los predecesores de Qwen sentaron una base sólida: Qwen 3.6-Max-Preview (20 de abril de 2026) era un modelo de solo texto con 35B totales / 3B de parámetros activos y 262K de contexto que afirmaba ser el número 1 en seis benchmarks de codificación y agentes . Qwen 3.7-Max (mayo de 2026) amplió su ventana de contexto a 1 millón de tokens con capacidades de agente de razonamiento . Pero ninguno fue considerado generalmente de nivel fronterizo fuera de la codificación agéntica.
Alibaba posiciona explícitamente a Qwen 3.8 como "solo superado por Fable 5" . Si esta afirmación se sostiene bajo una evaluación independiente, colocaría a Qwen 3.8 por delante de GPT-5.5 y muy por delante de DeepSeek V4. Pero con cero benchmarks verificados, esto sigue siendo una afirmación de marketing, no un hecho establecido. El Fable 5 de Anthropic parece ser el líder reconocido de la frontera actual según el propio marco de Alibaba .
Los precios agresivos de DeepSeek han provocado una carrera hacia el mínimo en los costos de API. V4-Flash a 0.14 USD/M de entrada es radicalmente más barato que cualquier modelo fronterizo occidental. Alibaba aún no ha fijado el precio de Qwen 3.8, pero Qwen 3.6 ya tenía un precio agresivo (~1.25/7.50 USD entrada/salida) .
La licencia MIT de pesos abiertos para DeepSeek V4 significa que el autoalojamiento también es posible, comprimiendo aún más los márgenes de los proveedores de código cerrado . Como señaló un análisis, el efecto práctico es que "los desarrolladores ahora pueden acceder a capacidades casi de frontera (en tareas de codificación) a una fracción del costo de GPT-5.5 o Claude".