L’histoire est rapidement devenue virale. Google a fermement démenti avoir utilisé le document, tandis que les tentatives menées pour reproduire la prétendue fuite ont toutes échoué. Au-delà de ce cas particulier, l’épisode pose une question sensible pour les studios, les entreprises et les indépendants : peut-on encore considérer un document stocké en ligne comme réellement confidentiel lorsqu’une IA est capable de répondre avec assurance à des questions imprévues ?
Klub Kofta Studio explique qu’un joueur de son serveur Discord posait à Gemini des questions « stupides » sur le contenu à venir d’Operation Octo. D’après les captures d’écran partagées par le développeur, l’IA aurait alors fourni le nom exact et particulièrement précis de « Vantage Tripod », un personnage que son créateur assure n’avoir jamais mentionné à qui que ce soit .
« D’une manière ou d’une autre, l’IA a donné le nom exact et très spécifique de “Vantage Tripod”, que je n’avais jamais mentionné à personne », a écrit le développeur sur Reddit. Il ajoutait que, « à sa connaissance », la seule trace numérique de cette information se trouvait dans l’un de ses Google Docs et qu’il ne discutait pas lui-même avec l’IA .
Les fans savaient déjà qu’un personnage appelé « Tripod Fish » était prévu, mais pas que son nom complet pourrait être « Vantage Tripod » . Le développeur affirme également que Gemini a livré des informations exactes sur des mécaniques de jeu encore inédites, ajoutées dans le même document seulement la veille de l’échange .
Interrogé par plusieurs médias, dont Polygon, Android Authority et PC Guide, Google a rejeté l’idée que Gemini puisse être entraîné à partir de fichiers privés de Google Workspace, notamment Google Docs. L’entreprise affirme ne pas analyser les documents privés pour entraîner ses modèles d’IA .
Google précise que Gemini peut accéder à Google Drive ou à Google Docs uniquement si l’utilisateur lui en donne explicitement l’autorisation pour une tâche précise, par exemple résumer un document .
Cette réponse ne fournit toutefois pas d’explication alternative au fait que Gemini aurait produit la chaîne de caractères très spécifique « Vantage Tripod », si le récit du développeur est exact .
Après la publication du témoignage, des journalistes, des développeurs et des membres de la communauté ont posé à Gemini des questions similaires au sujet d’Operation Octo. Aucun n’est parvenu à obtenir « Vantage Tripod » ni une information inédite comparable . Le joueur qui avait reçu la réponse initiale n’a lui-même pas réussi à reproduire l’échange .
Aucun audit technique, test contrôlé ou historique complet des prompts n’a été rendu public pour confirmer que Gemini aurait effectivement accédé au document privé .
Plusieurs médias, dont Numerama et The Hook, envisagent donc une autre hypothèse : celle d’une hallucination non reproductible, c’est-à-dire un nom plausible généré par le modèle à partir de motifs statistiques, plutôt qu’une véritable récupération depuis le fichier du développeur . Le fait que la réponse ne soit apparue qu’une seule fois nourrit le scepticisme, même si aucune explication définitive n’a été établie .
Même si Google nie toute utilisation des documents privés pour entraîner Gemini, cette affaire révèle l’incertitude persistante des utilisateurs sur les données auxquelles les systèmes d’IA peuvent accéder. Il leur est difficile de vérifier indépendamment si un contenu privé intervient dans l’entraînement d’un modèle ou dans la génération d’une réponse . Cette zone grise suffit à fragiliser la confiance envers les outils de productivité en ligne utilisés pour des projets sensibles.
Les outils de recherche dopés à l’IA peuvent s’appuyer sur des pages indexées, des contenus mis en cache, des liens partagés par l’utilisateur ou d’autres éléments de l’écosystème Google. Sans informations détaillées sur la manière dont une réponse est construite, les développeurs et les entreprises ont du mal à déterminer si leurs plans de lancement ou leurs secrets commerciaux sont réellement protégés dans un document hébergé dans le cloud .
Le risque ne vient pas seulement d’une fuite réelle. Une IA qui invente avec aplomb un nom ressemblant à un secret authentique peut tout de même déclencher une alerte, une enquête interne ou une perte de confiance. Cette impression de compromission est particulièrement difficile à réfuter lorsque la réponse semble trop précise pour être fortuite .
Pour bénéficier de la protection accordée aux secrets commerciaux, une information doit rester secrète et faire l’objet de mesures raisonnables de protection. Si elle semble pouvoir apparaître dans la réponse d’un chatbot, cette confidentialité devient plus difficile à défendre, quelle que soit l’origine réelle de la réponse. L’affaire pourrait ainsi dissuader certains professionnels d’utiliser des outils cloud pour préparer des projets confidentiels .
L’affaire « Vantage Tripod » reste non résolue. Le témoignage du développeur n’a pas été vérifié par un audit indépendant et n’a pas pu être reproduit. Google nie que Gemini analyse les documents privés de ses utilisateurs pour entraîner ses modèles et affirme que l’accès à Docs nécessite une autorisation explicite .
L’explication la plus prudente pourrait être celle d’une hallucination plausible, combinée à un contexte incomplet. Mais le problème de fond demeure : dans les systèmes d’IA opaques, l’incertitude elle-même devient un risque pour les créateurs et les entreprises qui confient leurs informations sensibles au cloud.