Los precios de la API se fijaron en $0.14 por millón de tokens de entrada y $0.28 por millón de tokens de salida, con entrada en caché desde $0.028 por millón de tokens . Esto convierte a V4-Flash en una de las APIs de razonamiento de clase frontier más baratas disponibles, más económica que Gemini 2.5 Flash, que cuesta $0.30/$2.50 por millón de tokens .
La versión "0731", lanzada el 31 de julio de 2026, es la beta pública oficial de la API. Según las evaluaciones, esta versión supera al modelo V4-Pro-Preview en pruebas de agentes, con puntuaciones de 82.7 en Terminal Bench 2.1 y 76.7 en Cybergym . El modelo admite modos de razonamiento configurables (estándar, alto y esfuerzo máximo de pensamiento), además de un modo sin razonamiento para procesos de alto rendimiento .
MiniMax lanzó H3 el 31 de julio de 2026, presentándolo como un modelo de generación multimodal de propósito general capaz de procesar texto, imágenes, video y audio en un contexto unificado . El modelo genera clips de hasta 15 segundos a resolución 2K (2560×1440) a 24 fps, con audio estéreo nativo producido en la misma pasada de inferencia, sin necesidad de un proceso de audio separado .
H3 acepta hasta 9 imágenes + 3 clips de video + 3 pistas de audio como entradas de referencia simultáneas . MiniMax se comprometió a publicar los pesos del modelo en cuestión de días, extendiendo el enfoque de código abierto a la generación de video, un área donde la mayoría de los competidores comerciales siguen siendo propietarios . La empresa afirma que el costo por segundo de H3 a resolución 2K es menos de un tercio del de sus rivales principales .
ByteDance anunció Seedance 2.5 en su conferencia Volcano Engine FORCE el 23 de junio de 2026 , y el acceso público a la API se abrió el 16 de julio de 2026 .
La mejora principal: generación de video de 30 segundos en una sola pasada, que entrega un clip completo en una generación continua, sin necesidad de unir segmentos más cortos . La resolución alcanza hasta 4K (3840×2160) con profundidad de color de 10 bits . El modelo acepta hasta 50 entradas de referencia multimodales (imágenes, clips de audio, modelos 3D en blanco, referencias de estilo e indicaciones de escena), frente a las 12 de la versión anterior .
ByteDance también lanzó la edición a nivel de región, que permite a los usuarios modificar áreas específicas de un clip generado sin tener que regenerar toda la secuencia . Las aplicaciones abarcan cine, publicidad, educación, fabricación industrial y simulación para vehículos autónomos .
Estos tres lanzamientos, concentrados en gran medida el 31 de julio de 2026, comparten temas estratégicos comunes:
El marco original sugería que estos tres lanzamientos ocurrieron el 26 de diciembre de 2024, junto con afirmaciones más amplias sobre los modelos chinos de código abierto que representaban el 41% de las descargas mundiales y las acusaciones de EE. UU. sobre destilación de modelos. Los resultados de búsqueda disponibles no respaldan ni la fecha de diciembre de 2024 ni esas estadísticas específicas. Es posible que esas afirmaciones estén relacionadas con eventos anteriores de DeepSeek-V3 o Qwen, pero esta investigación no pudo verificarlas a través de las fuentes proporcionadas.
| Modelo | Fecha de lanzamiento | Especificaciones clave |
|---|---|---|
| DeepSeek V4-Flash | Vista previa: 24 abr 2026; Beta pública: 31 jul 2026 | 284B MoE (13B activos), contexto 1M, $0.14/M tokens de entrada |
| MiniMax H3 | 31 jul 2026 | Video 2K de 15s, audio estéreo nativo, pesos abiertos prometidos |
| ByteDance Seedance 2.5 | Anunciado: 23 jun 2026; API: 16 jul 2026 | 30s en una pasada, 4K, 50 entradas multimodales de referencia |
Estos tres modelos —DeepSeek V4-Flash, MiniMax H3 y ByteDance Seedance 2.5— representan una aceleración coordinada del sector de la IA en China a mediados de 2026, definida por menores costos, distribución de pesos abiertos y capacidades de generación drásticamente más largas.