Di fronte ai nuovi allarmi sui rischi catastrofici dell’intelligenza artificiale, la risposta che emerge dal settore a Singapore non è scegliere tra sviluppo senza freni e blocco totale. È chiedere verifiche indipendenti, pratiche di sicurezza trasparenti e limiti concreti a ciò che i sistemi possono fare una volta utilizzati.
7
32
Dagli allarmi alle verifiche
A settembre 2026 Jacob Coxon ha lasciato Anthropic, dopo aver lavorato anche in OpenAI, accusando le due aziende di correre verso una superintelligenza capace di migliorarsi da sola senza agire responsabilmente. Il ricercatore di Anthropic Evan Hubinger ha condiviso pubblicamente la preoccupazione e ha indicato una propria stima superiore al 10% del rischio che l’IA provochi l’estinzione umana entro il prossimo decennio. È una valutazione personale, non una probabilità misurata né una prova che un simile esito sia imminente.
3
4
Il 12 settembre l’amministratore delegato di Anthropic, Dario Amodei, ha chiesto di rallentare lo sviluppo. La sua proposta comprendeva anche l’accesso per valutatori esterni, affinché potessero verificare le pratiche e le comunicazioni sulla sicurezza e segnalare incidenti. La domanda, così, non è soltanto quanto temere gli scenari futuri, ma che cosa sia possibile controllare dall’esterno oggi.
13
32
Che cosa può dimostrare un audit
Le verifiche possono individuare limiti e problemi nei sistemi esistenti; non possono certificare in anticipo la sicurezza di ogni sistema futuro. A Singapore, lo strumento AI Verify, lanciato nel 2022, consente valutazioni tecniche sull’equità, la robustezza e la spiegabilità dei risultati. Un programma di accreditamento per chi svolge i test, l’AI Tester Accreditation Programme, punta inoltre a rafforzare questa capacità di verifica.
19
33
Perché un controllo sia davvero indipendente, non basta che il fornitore dichiari di aver superato i propri test interni. I valutatori devono poter esaminare le pratiche dichiarate e far emergere eventuali incidenti. Prima di collegare un modello ai propri dati e processi, anche le organizzazioni che lo utilizzano hanno bisogno di trasparenza e strumenti di controllo da parte del fornitore. Disporre dei pesi di un modello, da solo, non equivale a conoscere tutte le scelte di addestramento, i malfunzionamenti o le misure di sicurezza.
32
34
Questo approccio non esclude gli stop. Un esperto citato nel dibattito a Singapore sostiene che una specifica attività dovrebbe essere sospesa se chi sviluppa il sistema non riesce a contenerlo adeguatamente o a spiegare come gestisce rischi gravi. È diverso dal fermare indistintamente tutte le applicazioni dell’IA.
32
Agenti IA: fissare i confini prima di concedere accesso
La questione diventa immediata con gli agenti IA, sistemi in grado di usare strumenti e compiere azioni in più passaggi: quali dati possono leggere, quali operazioni possono eseguire e chi ne risponde? Nel gennaio 2026 l’Infocomm Media Development Authority (IMDA), l’autorità di Singapore per il digitale e i media, ha lanciato un quadro di riferimento per la governance dell’IA agentica. Il documento invita a valutare i rischi in anticipo e a limitare autonomia e accesso degli agenti a strumenti e dati. La versione aggiornata specifica il principio del privilegio minimo: concedere solo i permessi necessari al compito. Si tratta di linee guida, non di un divieto generale di impiegare agenti.
50
48
52
Per un’organizzazione, questo significa assegnare a ogni agente un responsabile umano, restringerne i permessi, monitorarne il funzionamento e rendere le azioni tracciabili e, quando possibile, reversibili. Sono controlli più utili di una generica promessa di sicurezza.
34 La ministra Josephine Teo ha paragonato il ruolo delle salvaguardie e degli standard per conquistare fiducia nell’IA alle pratiche di sicurezza dell’aviazione civile.
17
Il punto è rendere l’IA responsabile anche nell’incertezza: verificare ciò che è verificabile, consentire controlli esterni e non concedere poteri che non si è in grado di governare. Questo non chiude il dibattito sui rischi di lungo periodo, ma definisce obblighi concreti per chi sviluppa e utilizza i sistemi adesso.
32
48