DeepSeek probó V4.1 Flash entre el 8 y el 10 de septiembre de 2026 con un identificador temporal, antes de lanzarlo oficialmente el 10 de septiembre como deepseek flash. El modelo incorpora comprensión visual nativa en lugar de depender de la extensión experimental V4 Flash Vision; DeepSeek informa una arquitectura...
Publicado porEditado con GPT-5.6 TerraImágenes generadas con GPT Image 2
Respuesta de investigación

Create a landscape editorial hero image for this Studio Global article: What is DeepSeek V4.1 Flash, and what are the key details of its September 2026 time-limited internal beta—including its new native multimod. Article summary: DeepSeek V4.1 Flash was initially a short, evaluation-oriented API beta of an intermediate Flash-tier model. It launched on September 8, 2026 with a new architecture and native visual understanding, unlike the earlier V4. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
La breve beta de DeepSeek V4.1 Flash ya es historia. El modelo pasó de una prueba de API con fecha de caducidad a un lanzamiento oficial el 10 de septiembre de 2026. Para utilizar la versión actual en la API de DeepSeek, el nombre documentado es:
deepseek-flash
DeepSeek confirma que V4.1 Flash está disponible con soporte multimodal nativo mediante ese identificador. 9
La prueba limitada comenzó alrededor del 8 de septiembre de 2026 y se identificaba así:
deepseek-v4.1-flash-expires-on-0910
El propio nombre anticipaba que era una ruta de evaluación de corta duración, prevista para dejar de funcionar alrededor del 10 de septiembre. Los desarrolladores no tenían que modificar su base_url: bastaba con cambiar el campo del modelo. Durante la beta, la tarificación era equivalente a la de V4 Flash y cada cuenta podía realizar hasta 20 solicitudes simultáneas. 7
20
Por ello, aquella versión servía para comparativas, validación de integraciones y primeras pruebas multimodales, no como dependencia estable para producción.
La novedad técnica más relevante es que V4.1 Flash incorpora comprensión visual de forma nativa en su nueva arquitectura. No es el mismo planteamiento que deepseek-v4-flash-vision-exp, la variante experimental de visión que coexistía con V4 Flash.
Tras el lanzamiento, DeepSeek indicó que las solicitudes dirigidas a deepseek-v4-flash y deepseek-v4-flash-vision-exp se enrutarían temporalmente a V4.1 Flash por compatibilidad. 5
Según la compañía, el modelo es un sistema mixture-of-experts (MoE, o mezcla de expertos) de 552.000 millones de parámetros, basado en una arquitectura Causal Encoder–Decoder. DeepSeek afirma que activa 8.000 millones de parámetros para procesar la entrada y 16.000 millones para generar la salida. 5
En términos prácticos para quien usa la API, texto e imágenes forman parte del mismo modelo: ya no es necesario elegir la antigua extensión experimental de visión.
Durante la beta circularon observaciones de usuarios que hablaban de unos 300 a 500 tokens de salida por segundo, e incluso de casos por encima de 500. Se trataba de reportes generados por testers, no de un acuerdo de nivel de servicio ni de un benchmark estandarizado publicado por DeepSeek. 15
El rendimiento efectivo puede variar según la longitud del prompt y de la respuesta, la región, la concurrencia, la implementación y la configuración del modelo. Esas cifras pueden indicar que el modelo resultó rápido en ciertas condiciones, pero no deben interpretarse como capacidad garantizada para programación, prototipado de interfaces u otras cargas de trabajo.
En el anuncio inicial, DeepSeek planteó redirigir desde el 14 de septiembre las solicitudes a deepseek-v4-pro hacia V4.1 Flash, con la tarifa de Flash, mientras llegaba una futura V4.1 Pro. La compañía también presentó resultados de benchmarks en los que V4.1 Flash superaba a modelos insignia según sus propias mediciones. 5
Sin embargo, una actualización posterior del registro de cambios de la API señala que DeepSeek decidió mantener el servicio de API de V4 Pro después del 14 de septiembre, sin cambios en la facturación. Para integraciones actuales, esta actualización oficial más reciente es la referencia más útil. 9
La lección para los equipos técnicos es clara: durante una transición de productos, el enrutamiento y la disponibilidad de los modelos pueden cambiar con rapidez. Conviene usar el nombre de modelo documentado, seguir el registro de cambios de la API y ejecutar pruebas de regresión antes de asumir que un alias o un endpoint redirigido tendrá un comportamiento idéntico.
| Beta del 8 al 10 de septiembre | Lanzamiento oficial |
|---|---|
deepseek-v4.1-flash-expires-on-0910 |
deepseek-flash |
| Ruta temporal de evaluación | Modelo documentado de la API |
| Precio equivalente al de V4 Flash durante la beta | Se aplican los precios y condiciones vigentes del lanzamiento |
| Máximo de 20 solicitudes simultáneas por cuenta | Consultar la documentación actual para conocer los límites operativos |
La relevancia duradera de V4.1 Flash no es su endpoint de dos días, sino el lanzamiento de un modelo Flash multimodal nativo, basado en una arquitectura nueva y con un identificador permanente para API. 5
9
Studio Global AI
Esta página incluye una respuesta respaldada por fuentes que puede continuar dentro de Studio Global.
DeepSeek probó V4.1 Flash entre el 8 y el 10 de septiembre de 2026 con un identificador temporal, antes de lanzarlo oficialmente el 10 de septiembre como deepseek flash.
DeepSeek probó V4.1 Flash entre el 8 y el 10 de septiembre de 2026 con un identificador temporal, antes de lanzarlo oficialmente el 10 de septiembre como deepseek flash. El modelo incorpora comprensión visual nativa en lugar de depender de la extensión experimental V4 Flash Vision; DeepSeek informa una arquitectura MoE de 552.000 millones de parámetros.
La beta mantuvo el base url, tuvo precios equivalentes a V4 Flash y un límite de 20 solicitudes simultáneas por cuenta.