Un autre rapport cite un libellé repéré dans l’application mobile Gemini : « Meet our new video model. Remix your videos, edit directly in chat, try a template, and more. » Si ce texte est exact, Omni ne serait pas seulement un nom de modèle en arrière-plan : Google pourrait en faire une expérience produit pour créer, remixer et modifier des vidéos directement dans Gemini.
Il existe aussi des récits autour de démos précoces et de clips viraux. Gadgets360 évoque des démonstrations montrant des mouvements plus réalistes, un rendu du texte plus propre et une meilleure composition de scène, tandis qu’une discussion YouTube décrit deux vidéos circulant sur X avec des métadonnées présentées comme liées à « Google Gemini Omni Mode ». Ces éléments restent toutefois beaucoup plus fragiles que les libellés d’interface : dans les sources disponibles, Google n’a pas officiellement annoncé Omni, et ces clips ne sont pas vérifiés comme des sorties du modèle.
Si les libellés repérés disent vrai, quatre fonctions semblent se dessiner :
C’est l’angle produit le plus intéressant. En revanche, rien dans les éléments publics disponibles ne confirme encore la durée des clips, la résolution, l’accès API, les limites de prompt, la vitesse de génération, la qualité audio, les garde-fous de sécurité ou le prix.
Veo 3.1 reste le point de comparaison officiel. Google a lancé Veo 3.1 et Veo 3.1 Fast en aperçu payant via la Gemini API, Google AI Studio et Vertex AI, avec aussi une disponibilité dans l’application Gemini et Flow. Google présentait Veo 3.1 comme une mise à jour apportant un son natif plus riche, davantage de contrôle narratif et de meilleurs résultats pour la génération de vidéo à partir d’images.
Google a ensuite continué d’étendre la famille Veo 3.1. En janvier 2026, l’entreprise indiquait que Veo 3.1 pouvait créer des vidéos plus expressives à partir d’images, générer des vidéos verticales pour des plateformes comme YouTube Shorts et effectuer une mise à l’échelle en 1080p ou 4K dans Gemini, Flow, la Gemini API, Vertex AI et Google Vids. En mars 2026, Google a aussi présenté Veo 3.1 Lite comme son modèle vidéo le plus économique, à moins de 50 % du coût de Veo 3.1 Fast tout en conservant la même vitesse.
Dans ce contexte, la fuite Omni ne prouve pas un simple bond de caractéristiques techniques. La différence la plus nette se situe plutôt dans l’expérience : templates, édition dans le chat, remix et création directement dans Gemini. Les affirmations sur de meilleurs mouvements, un texte plus lisible ou une composition plus propre peuvent se révéler exactes, mais elles ne sont pas encore appuyées par une fiche modèle officielle, un benchmark ou un test public reproductible.
Les trois hypothèses restent ouvertes.
Première possibilité : Omni pourrait être un nouveau nom pour un parcours vidéo Gemini existant ou amélioré. WaveSpeed rapporte que le libellé « Powered by Omni » apparaissait près de « Toucan », présenté comme le nom interne de l’outil vidéo actuel de Gemini alimenté par Veo 3.1. Si ce positionnement est exact, Omni pourrait désigner un remplacement, un drapeau de test ou une nouvelle chaîne de génération.
Deuxième possibilité : Omni serait bien un nouveau modèle vidéo. Le libellé mobile rapporté parle de « our new video model », et Gadgets360 décrit Gemini Omni comme un modèle susceptible de permettre la création et l’édition de vidéos directement dans Gemini.
Troisième possibilité : Omni ferait partie d’un système multimodal plus large. Certains récapitulatifs de fuite spéculent sur une architecture capable d’unifier texte, image, vidéo et audio au sein de Gemini. C’est plausible comme direction produit, mais cela reste une spéculation dans les sources disponibles. Google n’a pas confirmé si « Omni » est un nom commercial, un nom de code interne, une famille de modèles, une couche d’interface ou une architecture plus générale.
Il n’existe pas assez d’éléments vérifiés pour dire combien Omni coûterait à utiliser ou à faire tourner. Les rapports disponibles ne confirment ni le prix, ni la latence, ni les quotas, ni la durée maximale des vidéos, ni la taille du modèle, ni la disponibilité API, ni les besoins de calcul.
Le meilleur point de comparaison reste la stratégie déjà visible autour de Veo : Google segmente sa famille vidéo selon le coût et les usages, avec Veo 3.1 Lite présenté comme une option à moins de la moitié du coût de Veo 3.1 Fast, tout en gardant la même vitesse. Cela montre que l’économie de la génération vidéo est un sujet important pour Google, mais cela ne dit rien, à ce stade, du positionnement tarifaire d’Omni.
Pour l’instant, toute affirmation selon laquelle Omni serait lent, très coûteux, réservé à des testeurs internes ou limité à des clips très courts doit donc être traitée comme non confirmée, sauf publication de preuves par Google ou par un testeur vérifiable.
Les sources disponibles ne permettent pas d’établir un classement honnête entre Omni, Runway, Pika et OpenAI Sora. Il manque des données comparables sur le réalisme, la cohérence temporelle, la durée, la contrôlabilité, la sécurité ou le coût — et Omni lui-même n’est pas encore documenté publiquement.
La seule comparaison défendable concerne le positionnement. Si les libellés de Gemini sont exacts, Google pourrait chercher à concurrencer les outils vidéo IA non seulement sur la qualité des sorties, mais aussi sur le flux de travail : lancer une idée dans Gemini, choisir un template, remixer un clip, puis affiner le résultat par conversation dans la même interface. Ce serait un différenciateur important face à des outils plus séparés, mais pas une preuve qu’Omni surpasse Sora, Runway ou Pika en qualité d’image.
Les vraies questions sont simples :
En attendant ces réponses, Gemini Omni doit être lu comme un signal crédible sur la direction vidéo de Google, pas comme une fiche technique confirmée. Pour l’instant, l’histoire tient surtout dans quelques libellés d’interface ; le reste attend encore que Google le rende officiel.