Los modelos de pesos abiertos llegaron al 62% del volumen de tokens de Vercel AI Gateway el sábado anterior al 25 de agosto y mantuvieron una cuota del 54% el martes, frente al 46% de los modelos propietarios. DeepSeek V4 Flash fue el principal catalizador: sus pesos actualizados mejoraron notablemente el rendimient...
Respuesta de investigación

Create a landscape editorial hero image for this Studio Global article: What drove the record surge in usage of low-cost Chinese open-weight AI models—particularly DeepSeek’s latest lightweight model—on Vercel’s. Article summary: The surge was driven by developers shifting high-volume workloads to inexpensive Chinese open-weight models, led by DeepSeek V4 Flash: a lightweight model whose updated weights improved agentic performance substantially.. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
Una combinación de precio y capacidad está cambiando el reparto del tráfico en AI Gateway, la API unificada de Vercel para acceder a cientos de modelos de inteligencia artificial. El martes 25 de agosto de 2026, los modelos de pesos abiertos representaron el 54% del volumen de tokens procesados por la plataforma, frente al 46% de los modelos propietarios. El sábado anterior, su cuota había alcanzado un récord del 62%, dejando a los modelos cerrados con el 38%.4
El detonante inmediato fue DeepSeek V4 Flash. Una actualización de sus pesos elevó su rendimiento en programación, uso de herramientas y flujos de trabajo agénticos, sin convertirlo en un modelo de precio premium.19
| Momento reportado en agosto | Modelos de pesos abiertos | Modelos propietarios |
|---|---|---|
| Sábado anterior | 62% | 38% |
| Martes 25 de agosto | 54% | 46% |
En otras palabras, los modelos abiertos tuvieron una ventaja de 8 puntos porcentuales el martes y de 24 puntos en el récord anterior. La comparación se refiere específicamente a los tokens procesados a través de AI Gateway. No mide los ingresos, los beneficios ni el número de empresas que utiliza cada modelo.
Vercel indicó que DeepSeek V4 Flash comenzó a funcionar con pesos actualizados por defecto en AI Gateway. En Terminal-Bench, una prueba centrada en tareas de terminal y línea de comandos, su puntuación subió de 56,9 en la vista previa de abril a 82,7: una mejora de 25,8 puntos.19
Además, los usuarios existentes no tuvieron que cambiar el identificador del modelo ni el código de sus aplicaciones para recibir los nuevos pesos.19 Esa actualización redujo la fricción técnica y facilitó que cargas de trabajo ya desplegadas aprovecharan el nuevo rendimiento.
El atractivo del modelo, por tanto, no se limitó a que fuera barato. Sus mejores capacidades agénticas lo hicieron más adecuado para tareas de programación y uso de herramientas a gran escala, mientras que su posicionamiento como modelo eficiente ofrecía a los desarrolladores una forma de controlar el coste de inferencia. Según Vercel, admite razonamiento, uso de herramientas y almacenamiento en caché implícito, además de una ventana de contexto de 1 millón de tokens.27
El precio reforzó esa posición. Reuters informó de que DeepSeek lanzó V4 Pro con un precio de entrada aproximadamente nueve veces superior al de V4 Flash y un precio de salida 14 veces mayor, lo que subraya la diferencia entre el modelo eficiente y la oferta premium de la compañía.17 Comparaciones independientes también muestran una ventaja de precio considerable para V4 Flash, aunque los resultados de las pruebas varían según el benchmark y la configuración.25
La información disponible vincula la caída del volumen de los modelos propietarios con una menor demanda empresarial de Fable 5, de Anthropic, debido a su mayor coste.4 La explicación resulta plausible en cargas de trabajo donde los desarrolladores priorizan el rendimiento por unidad de coste y el volumen procesado antes que la máxima capacidad del modelo. Sin embargo, los datos agregados de AI Gateway no demuestran que esa sea la única causa de cada solicitud o cliente.
Fable 5 sigue orientado a tareas prolongadas, ambiguas y compuestas por varios pasos, según la descripción de producto de Vercel.3 El cambio observado en agosto parece, por ello, menos un veredicto universal de que los modelos abiertos sean mejores y más una decisión de enrutamiento: utilizar un modelo económico para grandes volúmenes de trabajo compatible y reservar los modelos propietarios premium para los casos que justifiquen su precio.
La principal cautela está en distinguir entre uso y facturación. Un informe anterior de Vercel mostró que los modelos de pesos abiertos habían alcanzado el 29% del volumen de tokens de AI Gateway, pero representaban menos del 4% del gasto.44 La diferencia se explica porque contar tokens no refleja cuánto se paga por cada token de entrada o de salida.
Por eso, el cruce registrado en agosto indica que los modelos abiertos procesaron una mayor parte del trabajo de la plataforma, no necesariamente que generaran más negocio para los proveedores. Los modelos propietarios pueden conservar una cuota desproporcionada del gasto aun cuando los modelos más baratos gestionen más tokens.
Los datos apuntan hacia una estrategia de enrutamiento de modelos más deliberada:
La lección más amplia del tráfico de Vercel en agosto es que los modelos de pesos abiertos pueden ganar volumen en producción cuando combinan una capacidad suficiente con costes muy inferiores. DeepSeek V4 Flash ofrece el ejemplo más claro, pero el cambio de fondo consiste en asignar cada tarea al modelo más barato que pueda ejecutarla de forma fiable, no en sustituir de golpe a todos los modelos propietarios.
Studio Global AI
Esta página incluye una respuesta respaldada por fuentes que puede continuar dentro de Studio Global.
Los modelos de pesos abiertos llegaron al 62% del volumen de tokens de Vercel AI Gateway el sábado anterior al 25 de agosto y mantuvieron una cuota del 54% el martes, frente al 46% de los modelos propietarios.
Los modelos de pesos abiertos llegaron al 62% del volumen de tokens de Vercel AI Gateway el sábado anterior al 25 de agosto y mantuvieron una cuota del 54% el martes, frente al 46% de los modelos propietarios. DeepSeek V4 Flash fue el principal catalizador: sus pesos actualizados mejoraron notablemente el rendimiento en tareas agénticas sin perder su ventaja de precio.
El avance en volumen no significa que los modelos abiertos generaran la mayor parte del gasto: datos anteriores de Vercel mostraban que los modelos propietarios podían concentrar la inversión pese a procesar menos tok...