Klub Kofta Studio è il creatore di Operation Octo, un gioco tower defense disponibile su Steam. Secondo il suo racconto, un membro del server Discord del gioco aveva rivolto a Gemini alcune domande curiose sui contenuti futuri.
Dalle schermate della conversazione condivise dallo sviluppatore, l’IA avrebbe risposto con il nome preciso “Vantage Tripod”, riferito a un personaggio ancora inedito .
«In qualche modo, l’IA ha tirato fuori il nome esatto e molto specifico del personaggio, “Vantage Tripod”, che non avevo mai detto a nessuno», ha scritto lo sviluppatore su Reddit. «Per quanto ne so, l’unico posto in cui questa informazione esiste in formato digitale è uno dei miei Google Docs, e non ero io a parlare con l’IA!»
La comunità dei giocatori sapeva già dell’esistenza prevista di un personaggio chiamato “Tripod Fish”, ma non del nome completo “Vantage Tripod”. Lo sviluppatore ha inoltre affermato che Gemini avrebbe fornito informazioni corrette su meccaniche non ancora pubblicate, annotate nello stesso documento appena il giorno prima dell’interazione .
Interpellata da diverse testate, tra cui Polygon, Android Authority e PC Guide, Google ha respinto l’ipotesi che Gemini venga addestrato sui file privati di Google Workspace, inclusi i documenti Google Docs.
L’azienda ha dichiarato di non analizzare i documenti privati per addestrare i propri modelli. Secondo Google, Gemini può accedere a Google Drive o a Google Docs soltanto quando l’utente concede un’autorizzazione esplicita per attività specifiche, come un riepilogo .
Google non ha però fornito una spiegazione alternativa per la comparsa della stringa “Vantage Tripod”, qualora il racconto dello sviluppatore fosse corretto .
Nei giorni successivi alla pubblicazione del post su Reddit, giornalisti, sviluppatori e membri della community hanno provato a rivolgere a Gemini domande simili su Operation Octo. Nessuno è riuscito a ottenere nuovamente il nome “Vantage Tripod” o altri dettagli inediti comparabili .
Nemmeno il giocatore che aveva ricevuto la risposta iniziale è riuscito a replicare l’esperimento, secondo quanto riferito dallo stesso sviluppatore . Inoltre, non è stato pubblicato alcun audit tecnico, test controllato o registro completo dei prompt capace di dimostrare in modo indipendente che Gemini abbia avuto accesso al documento privato .
Per questo, alcune testate, tra cui Numerama e The Hook, hanno ipotizzato che si sia trattato di un’allucinazione non riproducibile: un nome plausibile generato casualmente dalle capacità di riconoscimento dei pattern dell’IA, non il risultato del recupero di dati dal file dello sviluppatore .
Il fatto che la risposta sia comparsa una sola volta alimenta i dubbi, ma al momento non esiste una spiegazione definitiva.
Che si sia trattato di una fuga di dati o di una coincidenza statistica, il caso mette in evidenza diversi problemi che riguardano chiunque utilizzi strumenti cloud per lavorare su informazioni sensibili.
La smentita di Google non elimina l’incertezza percepita dagli utenti: spesso è difficile verificare in modo indipendente quali dati un sistema di IA possa utilizzare durante l’addestramento o mentre genera una risposta . Questa mancanza di visibilità può ridurre la fiducia nei servizi cloud impiegati per progetti riservati.
Gli strumenti di ricerca basati sull’IA possono combinare pagine indicizzate, contenuti memorizzati nella cache, link condivisi dagli utenti e altre informazioni provenienti dall’ecosistema del servizio. Senza una descrizione completa dei meccanismi di recupero, sviluppatori e aziende faticano a capire se piani preliminari o segreti commerciali siano davvero al sicuro in un documento online .
Una risposta inventata ma formulata con sicurezza può essere dannosa quasi quanto una fuga di dati autentica. Se un chatbot presenta come reale un presunto segreto, può far nascere l’impressione che un documento privato sia stato violato, anche quando non è successo. E dimostrare il contrario può essere tutt’altro che semplice .
Per mantenere la protezione legale di un segreto commerciale, la riservatezza dell’informazione è essenziale. Se un dettaglio può comparire plausibilmente nella risposta di un chatbot, l’azienda o lo sviluppatore potrebbe trovarsi in una posizione più difficile, indipendentemente dal modo in cui l’IA avrebbe ottenuto quel dato .
Il caso “Vantage Tripod” resta irrisolto. L’accusa dello sviluppatore non è stata verificata né riprodotta, Google nega di utilizzare i documenti privati di Workspace per addestrare Gemini e l’ipotesi di un’allucinazione plausibile rimane una delle spiegazioni possibili.
La lezione più concreta, però, riguarda il rapporto di fiducia con i sistemi opachi. Quando un’IA sembra conoscere un segreto, il problema non è soltanto capire se ci sia stata davvero una fuga di dati: è anche il fatto che, senza log completi e verifiche indipendenti, gli utenti spesso non hanno gli strumenti per stabilirlo.