Il rischio non è necessariamente quello di un’unica macchina capace, da sola, di provocare una catastrofe. È che modelli avanzati e agenti AI — sistemi che possono usare strumenti e svolgere più passaggi di un compito — rendano più facile sfruttare conoscenze pericolose, automatizzino parti di un’operazione e lascino meno tempo per intervenire. I casi segnalati meritano attenzione, senza confondere assistenza, tentativo di abuso e danno dimostrato.
18
22
58
Biologia: una risposta non è un’arma
Un chatbot può aiutare a orientarsi nella letteratura scientifica; gli strumenti specializzati possono sostenere la ricerca e la pianificazione degli esperimenti. OpenAI presenta GPT-Rosalind come un supporto al ragionamento biologico e ai flussi di lavoro sperimentali. Nature descrive i benefici, ma anche i possibili usi dannosi, di strumenti per la biologia come AlphaFold.
10
19
Il problema non è solo teorico. Il New York Times ha riferito di conversazioni in cui chatbot fornivano indicazioni sulle armi biologiche e discutevano come evitare di essere scoperti.
21 Anthropic ha dichiarato di aver interrotto cinque potenziali casi in cui l’uso di Claude avrebbe potuto favorire lo sviluppo di armi biologiche; secondo Axios, due riguardavano richieste legate a ricerche rischiose volte a modificare le proprietà di agenti patogeni.
25 Nessuno dei due resoconti dimostra che sia stata prodotta un’arma funzionante.
Tra ottenere informazioni e produrre un’arma restano competenze specialistiche, materiali e lavoro di laboratorio. Sono ostacoli concreti, anche se strumenti migliori potrebbero ridurne alcuni.
19
26 OpenAI ha classificato per precauzione la capacità biologica di GPT-5 come «alta» nel proprio quadro di valutazione dei rischi, precisando però di non avere prove definitive che il modello possa aiutare in modo significativo una persona inesperta a causare gravi danni biologici.
31
Cyberattacchi: più velocità, risultati da verificare
Se hanno accesso a strumenti informatici, gli agenti AI possono assistere un aggressore in più fasi di un’intrusione. Nei resoconti sugli abusi rilevati da Anthropic compaiono operazioni cyber e furti di dati.
50
53
Un caso riportato riguarda un aggressore che ha usato strumenti AI contro nove agenzie governative messicane.
54 Alcune ricostruzioni secondarie parlano di circa 400 milioni di record esposti, ma le prove qui disponibili non consentono di verificare indipendentemente quel totale.
56
57 Sono troppo poco documentate, in questo materiale, anche le affermazioni su sciami coordinati di agenti hacker contro una cinquantina di organizzazioni.
La stessa capacità di individuare una vulnerabilità può servire ad attaccare un sistema oppure a correggerlo. Non è invece sufficientemente documentata, nelle fonti disponibili, l’affermazione specifica secondo cui GPT-5.6-Cyber avrebbe trovato falle poi risolte in Chrome.
Disinformazione e armi autonome: quando i rischi si sommano
Tra gli abusi segnalati da Anthropic figurano anche operazioni di influenza.
22
50 Durante un cyberattacco o un conflitto, messaggi falsi e impersonificazioni potrebbero rendere più difficile capire cosa stia accadendo e decidere come reagire. I casi citati, però, non dimostrano che una campagna di disinformazione abbia prodotto conseguenze di portata esistenziale.
Sul fronte militare, Anthropic ha dichiarato che sviluppatori basati in Russia hanno usato Claude per lavorare al software di uno sciame di droni d’attacco, con funzioni di guida, coordinamento e selezione dei bersagli.
51
60 Sviluppare un software non significa averne verificato l’impiego sul campo. Né la presenza di AI in un drone chiarisce, da sola, quanto controllo umano rimanga sulle decisioni letali. Il Comitato internazionale della Croce Rossa avverte che armi autonome il cui comportamento non può essere adeguatamente compreso, previsto o controllato dagli esseri umani aumentano i rischi per i civili e di escalation del conflitto.
58
La difesa non può fermarsi al chatbot
Il rifiuto di una richiesta pericolosa è utile, ma non basta. La letteratura sulla biotecnologia propone anche restrizioni sulle funzioni ad alto rischio; RAND sostiene che servano misure a più livelli, perché nessuna singola protezione può fermare un attore determinato.
17
29 Anthropic afferma di aver individuato e interrotto abusi e di aver rafforzato le salvaguardie per la ricerca biologica sensibile.
22
23
La priorità è valutare i sistemi su compiti che richiedono più passaggi, limitare strumenti e autorizzazioni concessi agli agenti, monitorare gli abusi e mantenere la possibilità di interrompere un’operazione. Per le armi autonome, il controllo umano deve riguardare davvero le decisioni sull’uso della forza letale, non ridursi alla presenza nominale di una persona. ONU e Croce Rossa chiedono regole internazionali più forti: è un appello, non la prova che esista già un divieto universale.
55
58
Le prove giustificano la prevenzione, non l’idea che la catastrofe sia inevitabile. Sono stati segnalati consigli pericolosi e tentativi di usare l’AI in attività biologiche, cyber e legate alle armi. Affermare che questi casi dimostrino un esito catastrofico o esistenziale richiederebbe prove di un danno effettivo, non soltanto di un modello capace o di un piano allarmante.
21
22
46