Gemini 3.7 Flash se lanzó el 13 de agosto de 2026 como el modelo de trabajo de Google para programación, desarrollo web y agentes. Hasta el 31 de diciembre de 2026, la API cuesta 0,75 dólares por millón de tokens de entrada y 3,75 dólares por millón de tokens de salida; el 1 de enero de 2027, las tarifas subirán a 1...
Respuesta de investigación

Create a landscape editorial hero image for this Studio Global article: What is Gemini 3.7 Flash, when did it launch, where is it available, and why does Google call it its fastest-growing model ever despite disc. Article summary: Gemini 3.7 Flash is Google’s production “workhorse” Gemini model for complex coding, web development, and tool-using agents. It launched on August 13, 2026, and is available through the Gemini API/AI Studio, Google Antig. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
Gemini 3.7 Flash es el nuevo modelo de producción de Google pensado para hacer el trabajo pesado: programación compleja, desarrollo web, uso de herramientas y flujos de agentes con varios pasos. Se lanzó el 13 de agosto de 2026 y está disponible a través de la Gemini API, Google AI Studio, Google Antigravity y Gemini Enterprise Agent Platform.
Su principal atractivo no es liderar todas las pruebas de inteligencia. La propuesta de Flash combina una capacidad cercana a la frontera, una velocidad de generación muy alta y un precio inicial bajo. Para los desarrolladores que ejecutan bucles de agentes de forma repetida, esa mezcla puede ser más importante que ganar un benchmark concreto.
Google describe Gemini 3.7 Flash como su modelo de crecimiento más rápido hasta la fecha. Sin embargo, la información disponible no incluye los datos necesarios para comprobar esa afirmación: no hay una base de uso publicada, un periodo de medición, un número de desarrolladores activos, un volumen de tokens ni un modelo de comparación identificado.
La conclusión prudente es más limitada: Google está diseñando Flash para acelerar la adopción entre desarrolladores, y su precio promocional junto con su integración en varias herramientas de la compañía respaldan esa estrategia. El superlativo sobre crecimiento debe considerarse una afirmación empresarial todavía no cuantificada, no una estadística de mercado demostrada de forma independiente.
Las tarifas iniciales de la API, vigentes hasta el 31 de diciembre de 2026, son:
A partir del 1 de enero de 2027, las tarifas estándar serán de 1,50 dólares por millón de tokens de entrada y 7,50 dólares por millón de tokens de salida: exactamente el doble. Los precios indicados para modalidades con descuento o por lotes también subirán, de 0,375/1,875 a 0,75/3,75 dólares por millón de tokens de entrada/salida.
La fecha de vencimiento es importante para cualquier proyecto en producción. Un sistema que parezca especialmente económico durante el lanzamiento debe presupuestarse de nuevo con las tarifas de 2027 antes de comprometerse con una arquitectura a largo plazo.
Además, el precio por token solo ofrece una parte de la factura real de un agente. El gasto final depende de la longitud del contexto, las llamadas a herramientas, los reintentos, la reutilización de entradas almacenadas, el esfuerzo de razonamiento y el volumen de salida. El coste de un benchmark no equivale necesariamente al precio de ejecutar un flujo completo en producción.
Los datos de Artificial Analysis sitúan a Gemini 3.7 Flash en 56 puntos del Intelligence Index. Eso lo coloca por encima de Claude Sonnet 5, con 55, y justo por debajo de GPT-5.6 Terra, con 57, en la comparación citada.
La velocidad es su diferenciador más claro. Artificial Analysis midió aproximadamente 340 tokens de salida por segundo y una puntuación media de tiempo por tarea de 1,7; según ese análisis, Flash es alrededor de un 40 % más rápido que GPT-5.6 Terra con el máximo nivel de razonamiento.
Estas cifras reflejan el rendimiento medido del modelo o del proveedor, no una experiencia idéntica en todas las aplicaciones. La red, el enrutamiento, el tamaño del prompt, la latencia de las herramientas y los ajustes de razonamiento pueden modificar notablemente el tiempo de respuesta de principio a fin.
Google afirma que Gemini 3.7 Flash mejora de forma sustancial frente a Gemini 3.6 Flash en ingeniería de software, depuración, resolución de incidencias, desarrollo web y flujos de agentes. Entre los resultados citados figuran:
Los resultados apuntan a un modelo sólido para programación y agentes que trabajan desde la terminal, pero no a un ganador absoluto. GPT-5.6 Terra conserva la ventaja en el resultado citado de Terminal-Bench; Flash responde con mayor velocidad y un coste inicial menor.
Con un nivel alto de razonamiento, ARC Prize informa de que Gemini 3.7 Flash obtuvo:
Son resultados destacables, sobre todo por el coste por tarea comunicado. Aun así, ARC-AGI debe interpretarse como una señal de rendimiento en un benchmark, no como una predicción directa de la fiabilidad de un agente de software. En producción, un agente puede realizar varias llamadas al modelo, usar herramientas externas, repetir acciones fallidas y procesar contextos mucho más grandes que los de una tarea de evaluación.
La tabla no es una clasificación universal. Los benchmarks proceden de evaluaciones diferentes y las fuentes no establecen una prueba única y controlada para todos los modelos. Además, los precios pueden corresponder a condiciones distintas de alojamiento, descuentos o disponibilidad.
Las comparaciones apuntan a una decisión de posicionamiento deliberada. Gemini 3.7 Flash se acerca a la frontera en el Intelligence Index, pero no obtiene la puntuación más alta: GPT-5.6 Terra aparece ligeramente por delante, con 57, y también lidera la comparación citada de Terminal-Bench.
Google está poniendo el foco en el equilibrio entre inteligencia, latencia y coste. Un modelo lo bastante rápido para el desarrollo interactivo y lo bastante barato para realizar llamadas repetidas puede resultar más útil dentro de una plataforma de agentes que otro modelo más lento y caro capaz de ganar una prueba específica.
Ese enfoque encaja con asistentes de programación, resolución automática de incidencias, agentes de desarrollo web y flujos que leen contexto, llaman a herramientas, revisan resultados y vuelven a intentarlo. En la oleada de lanzamientos de agosto de 2026, Qwen3.8-Max refuerza la competencia en agentes e ingeniería de software; GLM-5.3 y Nemotron 3.5 Lightning presionan en precio y eficiencia; y Claude Opus 5 y GPT-5.6 compiten en capacidad de gama alta.
Gemini 3.7 Flash se entiende mejor como un modelo de trabajo de alto rendimiento que como el sistema indiscutiblemente más inteligente. Su argumento más sólido combina una puntuación de 56 en el Intelligence Index, una generación de unos 340 tokens por segundo, resultados competitivos en programación y agentes de terminal y un precio inicial especialmente bajo.
Para los desarrolladores, la principal advertencia es económica. La tarifa de lanzamiento de 0,75/3,75 dólares termina el 31 de diciembre de 2026; al día siguiente comenzará la tarifa estándar de 1,50/7,50 dólares. La afirmación de Google sobre su crecimiento podría acabar confirmándose, pero sin cifras de uso que la respalden, la evidencia actual demuestra sobre todo una estrategia: convertir la inferencia rápida y asequible en la opción predeterminada para el uso de agentes a escala.
Studio Global AI
Esta página incluye una respuesta respaldada por fuentes que puede continuar dentro de Studio Global.
Gemini 3.7 Flash se lanzó el 13 de agosto de 2026 como el modelo de trabajo de Google para programación, desarrollo web y agentes.
Gemini 3.7 Flash se lanzó el 13 de agosto de 2026 como el modelo de trabajo de Google para programación, desarrollo web y agentes. Hasta el 31 de diciembre de 2026, la API cuesta 0,75 dólares por millón de tokens de entrada y 3,75 dólares por millón de tokens de salida; el 1 de enero de 2027, las tarifas subirán a 1,50 y 7,50 dólares.
Con una puntuación de 56 en el Intelligence Index y una velocidad aproximada de 340 tokens de salida por segundo, Flash prioriza el rendimiento por coste y la escala de uso frente al liderazgo absoluto en inteligencia.