La fonction de dictée intelligente ne se contente pas de retranscrire chaque mot : elle produit un texte mis en forme, supprime les hésitations comme « euh » et « hum » et tient compte des corrections formulées en cours de phrase . Le résultat est inséré directement à l’emplacement du curseur .
Gemini peut aussi transformer un passage sélectionné ou générer un visuel à l’endroit où l’utilisateur travaille . Avec le mode de raisonnement activé, l’assistant est en mesure d’exécuter des tâches complexes en plusieurs étapes à partir d’instructions vocales .
Pour l’instant, cette dictée est disponible en anglais ; Google annonce l’arrivée d’autres langues ultérieurement . Elle complète l’application native Gemini pour macOS, lancée à Google I/O 2026 avec une barre de discussion accessible par Option + Espace et le partage d’écran .
Le 21 juillet 2026, Google a lancé trois modèles : Gemini 3.6 Flash, Gemini 3.5 Flash-Lite et Gemini 3.5 Flash Cyber, ce dernier étant réservé à des usages de cybersécurité avec un accès limité . Le très attendu Gemini 3.5 Pro, lui, n’a toujours pas été publié .
Présenté comme le modèle de référence pour les tâches courantes, Gemini 3.6 Flash améliore les performances en programmation, en traitement multimodal et dans les tâches de connaissance, tout en utilisant jusqu’à 17 % de jetons en moins que Gemini 3.5 Flash .
Son tarif d’API est fixé à 1,50 dollar par million de jetons en entrée et 7,50 dollars par million de jetons en sortie, contre 9 dollars pour la génération du modèle précédent . Il dispose d’une fenêtre de contexte d’un million de jetons et d’une base de connaissances arrêtée à mars 2026 .
Le modèle est accessible via l’API Gemini, Google AI Studio, Android Studio, l’application Gemini, Google Antigravity et l’application Gemini Enterprise . Les deux nouveaux modèles sont également utilisables gratuitement dans l’application Gemini .
Gemini 3.5 Flash-Lite vise les tâches à fort volume et faible latence, comme la recherche agentique ou le traitement de documents . Google le présente comme son modèle 3.5 le plus rapide et le plus économique, avec un débit annoncé de 350 jetons générés par seconde .
L’API coûte 0,30 dollar par million de jetons en entrée et 2,50 dollars par million de jetons en sortie . Flash-Lite propose lui aussi une fenêtre de contexte d’un million de jetons et commence à être intégré à Google Search, en plus de l’API Gemini et de l’application Gemini .
Gemini Spark, l’agent personnel présenté pour la première fois lors de Google I/O 2026, s’étend à davantage d’abonnés dans le monde . Fonctionnant dans le cloud, il peut continuer une tâche même lorsque l’utilisateur ferme son ordinateur portable ou verrouille son téléphone .
Le déploiement s’accompagne de plusieurs améliorations importantes :
Il ne s’agit toutefois pas d’un lancement universel : Spark reste inaccessible aux utilisateurs gratuits et n’est pas proposé dans l’Espace économique européen, en Suisse, au Royaume-Uni et au Nigeria .
Le Drop élargit également les connexions de l’écosystème Gemini. Côté Spark, Google ajoute progressivement Canva, Instacart et OpenTable parmi les applications tierces connectées .
L’agent peut aussi lire et modifier des éléments de Google Keep et Google Tasks . Les utilisateurs peuvent enfin connecter certaines applications personnelles ou tierces grâce à des serveurs MCP — le Model Context Protocol, un standard permettant à un agent d’utiliser des outils et des données externes .
Ces intégrations s’inscrivent dans le cadre plus large des connexions de Gemini avec les applications Google et certains services tiers .
Gemini propose désormais de créer un avatar personnel réutilisable. Une fois celui-ci enregistré, l’utilisateur peut demander à apparaître dans de nouvelles images sans devoir importer une photo à chaque requête .
Le système génère alors des contenus visuels intégrant l’apparence de la personne à partir de son avatar sauvegardé .
La génération d’images personnalisées, qui associe le modèle Nano Banana aux fonctions de Personal Intelligence, est désormais gratuite pour tous les utilisateurs éligibles aux États-Unis : ils doivent avoir au moins 18 ans et être connectés à un compte Google .
Auparavant réservée aux abonnés Google AI Plus, Pro et Ultra, cette fonction peut s’appuyer — si les applications sont connectées — sur le contexte provenant de Gmail, Google Photos, YouTube et Google Search pour créer des images adaptées aux goûts, aux habitudes et aux souvenirs de l’utilisateur .
Il devient ainsi possible de demander simplement « imagine la maison de mes rêves » ou « crée une illustration de moi avec mon animal préféré », sans rédiger une description très détaillée . Cette gratuité concerne pour l’instant les utilisateurs éligibles aux États-Unis ; elle ne constitue pas une annonce de disponibilité générale en France ou dans le reste de l’Europe.
Avec ces six nouveautés, Google fait évoluer Gemini d’un chatbot vers une interface capable de rédiger dans les applications, de naviguer sur le Web, d’exécuter des tâches en arrière-plan et de produire des contenus personnalisés. Les modèles Flash ciblent l’efficacité et les coûts, tandis que Spark mise sur l’automatisation.
La disponibilité reste cependant très inégale selon les pays, les langues et les formules d’abonnement. Pour les utilisateurs européens, les fonctions vocales sur Mac et les nouveaux modèles sont les annonces les plus immédiatement concrètes ; Spark et la génération d’images personnalisées restent soumis à des restrictions géographiques ou d’éligibilité.