No se limita a transcribir. Gemini también puede transformar texto seleccionado, resumir contenido o generar imágenes dentro de la aplicación en uso . Si se activa el modo de razonamiento, el asistente puede ejecutar tareas complejas de varios pasos mediante instrucciones de voz .
Por ahora, el dictado inteligente está disponible en inglés; Google promete añadir más idiomas. La función amplía la aplicación nativa de Gemini para macOS, presentada en Google I/O 2026 con una barra de chat que se abre mediante Opción + Espacio y capacidades para compartir la pantalla .
El 21 de julio, Google presentó tres modelos de la familia Gemini Flash: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite y Gemini 3.5 Flash Cyber, este último orientado a tareas de seguridad y con acceso restringido . El movimiento llegó sin el esperado Gemini 3.5 Pro, que sigue sin publicarse .
Es el modelo generalista de la nueva tanda, pensado para programación, trabajo con conocimiento y tareas multimodales. Google afirma que mejora el rendimiento y utiliza hasta un 17 % menos de tokens que Gemini 3.5 Flash .
En la API, su precio es de 1,50 dólares por millón de tokens de entrada y 7,50 dólares por millón de tokens de salida, frente a los 9 dólares por millón de tokens de salida de la generación anterior . Cuenta con una ventana de contexto de 1 millón de tokens y un corte de conocimiento situado en marzo de 2026 .
Está disponible en Gemini API, Google AI Studio, Android Studio, la aplicación Gemini, Google Antigravity y las herramientas empresariales de Gemini .
Flash-Lite está diseñado para trabajos de gran volumen y baja latencia, como búsquedas realizadas por agentes y procesamiento de documentos . Google lo presenta como su modelo más rápido y económico de la clase 3.5, con una velocidad de 350 tokens de salida por segundo .
Su precio es de 0,30 dólares por millón de tokens de entrada y 2,50 dólares por millón de tokens de salida . También ofrece un contexto de 1 millón de tokens y comenzó a incorporarse tanto a la API de Gemini como a la aplicación y a Google Search .
Ambos modelos están disponibles desde el lanzamiento y pueden utilizarse sin coste dentro de la aplicación Gemini, aunque las condiciones pueden variar según la función o el servicio .
Gemini Spark, el agente personal de Google presentado inicialmente en I/O 2026, se está desplegando para más suscriptores en distintos países . A diferencia de un chatbot convencional, Spark puede trabajar en la nube y continuar con una tarea aunque el usuario cierre el portátil o bloquee el teléfono .
Entre sus nuevas capacidades destacan:
El despliegue mantiene varias limitaciones geográficas: no incluye el Espacio Económico Europeo, Suiza, Reino Unido ni Nigeria .
El ecosistema de aplicaciones vinculadas a Gemini también crece. En el caso de Spark, Google comenzó a incorporar Canva, Instacart y OpenTable como aplicaciones conectadas .
El agente también puede leer y escribir información en Google Keep y Google Tasks . Además, permite conexiones personalizadas mediante servidores URL compatibles con el Model Context Protocol (MCP), un estándar para conectar asistentes de IA con aplicaciones y servicios externos .
Estas integraciones buscan que Gemini pueda pasar de recomendar una acción a realizarla directamente, siempre que el usuario conceda los permisos necesarios.
La función de avatares permite guardar una representación personal y utilizarla para añadirse a cualquier imagen sin tener que volver a subir una fotografía cada vez . Gemini genera después contenido visual que incorpora la apariencia del usuario a partir de ese avatar guardado.
El cambio simplifica la creación de imágenes personalizadas, especialmente para quienes suelen generar varias escenas con su propia imagen.
La generación de imágenes personalizada de Gemini, que combina el modelo de imágenes Nano Banana con las capacidades de Personal Intelligence, ahora está disponible sin coste para todos los usuarios elegibles en Estados Unidos . Antes, esta función estaba reservada a los suscriptores de Google AI Plus, Pro y Ultra.
Con el permiso correspondiente, Gemini puede utilizar el contexto de servicios conectados como Gmail, Google Photos, YouTube y Search para crear imágenes más ajustadas a los intereses, el estilo de vida y los recuerdos del usuario . En lugar de escribir una descripción extensa, bastaría con pedir algo como “diseña la casa de mis sueños” o “crea una ilustración de mi mascota favorita y de mí” .
La función está dirigida a usuarios mayores de 18 años que hayan iniciado sesión con una cuenta de Google en Estados Unidos . Su expansión no significa que esté disponible gratuitamente en todos los países.
La actualización de julio combina tres apuestas de Google: modelos más eficientes para reducir costes, agentes capaces de ejecutar tareas y herramientas creativas que aprovechan más contexto personal. El resultado es un Gemini menos centrado en responder preguntas y más orientado a escribir dentro de otras aplicaciones, navegar por la web, modificar archivos y generar contenido adaptado a cada usuario.
El acceso, sin embargo, sigue dependiendo del país, el idioma, el tipo de cuenta y el plan contratado. En especial, Spark continúa reservado a suscriptores, mientras que varias funciones de voz e imagen todavía tienen una disponibilidad geográfica limitada.