Los mayores avances se producen en ingeniería de software compleja y comprensión de documentos. En la prueba DeepSWE V1.1, el 65,3% de 3.7 Flash se acerca al rendimiento de GPT-5.6 Terra en esa evaluación específica .
Sin embargo, los competidores de Google siguen liderando en las pruebas de codificación más reconocidas. Para ponerlo en contexto: Claude Sonnet 5 obtuvo un 76,1% en Terminal-Bench 2.1 y un 63,2% en SWE-Bench Pro, mientras que GPT-5.6 Terra alcanzó aproximadamente un 70% y un 60%, respectivamente .
Gemini 3.7 Flash se lanzó con un precio introductorio de 0,75 $ por millón de tokens de entrada y 3,75 $ por millón de tokens de salida, lo que supone un 50% menos que Gemini 3.6 Flash, que costaba 1,50 $/7,50 $ . Esta tarifa promocional estará vigente hasta el 31 de diciembre de 2026; a partir del 1 de enero de 2027, el precio volverá a ser de 1,50 $/7,50 $
.
Comparativa de precios (por millón de tokens, entrada/salida):
| Modelo | Entrada ($/M tokens) | Salida ($/M tokens) |
|---|---|---|
| Gemini 3.7 Flash (intro) | 0,75 $ | 3,75 $ |
| Gemini 3.6 Flash | 1,50 $ | 7,50 $ |
| Claude Sonnet 5 (estándar) | 3,00 $ | 15,00 $ |
| GPT-5.6 Terra | ~2,50 $ | ~15,00 $ |
3.7 Flash es entre un 60% y un 75% más barato que Claude Sonnet 5 y GPT-5.6 Terra en un cálculo de coste combinado . Pero en las pruebas de codificación puras, los competidores siguen estando por delante. Para los desarrolladores, 3.7 Flash ofrece una excelente relación coste-rendimiento para tareas de agentes de alto volumen donde no se requiere una precisión absoluta.
Hassabis fue reemplazado en las operaciones diarias por Koray Kavukcuoglu, director de tecnología de DeepMind, que ahora es vicepresidente senior y reporta directamente a Sundar Pichai .