Quando pensiamo ai rischi legati all’intelligenza artificiale, spesso immaginiamo scenari futuristici o problemi legati alla disinformazione. Ma un report pubblicato da Anthropic ci riporta bruscamente alla realtà, documentando casi concreti in cui il modello Claude sarebbe stato utilizzato per attività che spaziano dallo sviluppo di armamenti allo spionaggio, fino alla sorveglianza di massa su interi paesi. Vale la pena fermarsi ad analizzare cosa è successo, perché racconta molto su quanto sia complicato, oggi, proteggere un’IA generativa da usi malevoli.
Il documento è un vero e proprio report di threat intelligence, un’analisi tecnica delle minacce rilevate sulla propria piattaforma. Anthropic descrive nel dettaglio diversi episodi, specificando anche le contromisure adottate, come il ban degli account coinvolti. Vediamo i casi più significativi.
Sviluppo di armamenti: dal radar jamming ai missili balistici

Uno dei casi più delicati riguarda un attore con base in Cina che avrebbe usato Claude per sviluppare un software di guerra elettronica pensato per la soppressione delle difese aeree. Secondo Anthropic, durante il progetto la simulazione è stata modificata per includere dodici obiettivi specifici a Taiwan: radar di allerta precoce, batterie missilistiche Patriot e Tien Kung, basi aeree e persino un bunker di comando. Le informazioni sull’account avrebbero collegato l’attività a istituti di ricerca militare cinesi, incluso quello legato all’Accademia delle Scienze Militari dell’Esercito Popolare di Liberazione. Il ministero degli Esteri cinese ha dichiarato di non essere a conoscenza del report, ribadendo che l’IA dovrebbe essere sviluppata “per il bene” e respingendo accuse ritenute infondate.
Un secondo caso, sempre di origine cinese, riguarda lo sviluppo di specifiche tecniche per un sistema anti-siluro destinato alla marina militare. In questo caso Claude sarebbe stato usato per produrre una proposta tecnica di oltre 200 pagine, confrontarla con tecnologie della marina statunitense e persino simulare revisioni tecniche “ostili” per migliorarne la qualità.
Il caso yemenita: missili guidati e ostacoli parzialmente efficaci
Ancora più preoccupante, forse, è il caso relativo a una cellula operativa nello Yemen settentrionale, che secondo Anthropic avrebbe usato Claude per sviluppare software legato a un razzo guidato e a un progetto di missile balistico con un raggio dichiarato superiore ai 2.000 chilometri, oltre a una variante con veicolo ipersonico plananteé. Il modello sarebbe stato impiegato per coding, simulazioni e risoluzione di problemi tecnici, anche dopo il fallimento di un test. Anthropic ammette candidamente che “i nostri sistemi di sicurezza hanno bloccato molte delle loro richieste, ma non tutte”: una frase che, da sola, dice molto sulla difficoltà di costruire barriere davvero impenetrabili in un modello linguistico generativo.
Spionaggio digitale: operazioni cyber su scala globale

Il report descrive anche diverse operazioni di cyberspionaggio condotte con il supporto di Claude. Un gruppo di lingua cinese, probabilmente con base a Changsha, avrebbe utilizzato il modello per colpire circa 50 organizzazioni, comprese reti governative straniere, sfruttando flussi di lavoro automatizzati per individuare vulnerabilità software sconosciute e sviluppare exploit con supervisione umana limitata. Secondo Anthropic, il gruppo includeva anche due studenti universitari.
Sul fronte russo, un gruppo di hacker con caratteristiche compatibili con il noto Midnight Blizzard (già collegato dal governo statunitense al servizio di intelligence estera SVR) avrebbe usato l’IA quasi in ogni fase di operazioni di phishing, dirottamento di reti Wi-Fi negli hotel e takeover di account WhatsApp, prendendo di mira settori governativi, militari e diplomatici ucraini.
Un episodio distinto riguarda invece un presunto operatore legato all’Iran, che avrebbe sfruttato Claude per raccogliere e analizzare dati pubblicamente accessibili al fine di sviluppare raccomandazioni di targeting contro forze navali statunitensi nella regione, incluse liste di personale ricavate da didascalie di foto militari pubbliche e identificativi di navi e aerei.
Sorveglianza di massa: dal Mali all’Iran

Forse la parte più inquietante del report riguarda l’uso di Claude per costruire veri e propri sistemi di sorveglianza. Anthropic racconta il caso di “Lakana 360”, una piattaforma di sorveglianza domestica realizzata per il servizio di intelligence statale del Mali, capace di monitorare dati associati a circa 25 milioni di schede SIM distribuite sui tre principali operatori mobili del paese. Secondo l’azienda, il sistema sarebbe stato sviluppato in gran parte da un singolo consulente che lavorava con l’Agenzia Nazionale di Sicurezza dello Stato maliana.
Il caso iraniano e la sorveglianza dei dissidenti
Anthropic descrive anche il ban di 16 account collegati a due unità legate ad agenzie paramilitari e di sicurezza interna iraniane. Una di queste organizzazioni avrebbe dichiarato di mantenere un database identitario dei cittadini iraniani, mentre l’altra avrebbe usato Claude per sviluppare un’estensione browser malevola pensata per raccogliere in massa identità di utenti dai principali social network. Sempre in ambito iraniano, un altro operatore avrebbe costruito un sistema di profilazione basato su intelligence open-source rivolto a individui governativi israeliani e organizzazioni della diaspora ebraica.
Il report cita anche casi relativi alla sorveglianza di minoranze religiose ed etniche, come il tracciamento di comunità uigure in Siria o la compilazione di report automatizzati su cardinali cattolici, leader cristiani taiwanesi e attivisti tibetani, attribuiti ad attori collegati alla Cina, accuse che Pechino ha respinto in passato definendole prive di fondamento.
Una riflessione: proteggere l’IA è più difficile di quanto sembri
Quello che emerge da questo report non è tanto la sorpresa che l’IA possa essere usata in modo malevolo — lo sapevamo già — quanto la concretezza e la varietà dei casi documentati. Non parliamo di scenari ipotetici, ma di operazioni reali, alcune delle quali sventate solo grazie al monitoraggio attivo della piattaforma. È anche interessante notare come Anthropic stessa ammetta che le proprie misure di sicurezza abbiano bloccato “molte, ma non tutte” le richieste problematiche: un’ammissione di trasparenza che raramente si vede da parte di aziende del settore.
Questo tipo di report mi fa riflettere su quanto sia complesso progettare sistemi di sicurezza per modelli generativi che, per loro natura, sono strumenti general purpose: la stessa capacità che permette a Claude di aiutare uno studente a scrivere codice può, in mani diverse, essere piegata a scopi ben più problematici. La domanda che mi pongo, e che lascio anche a voi, è questa: quanto è realistico pensare che il filtro tecnico da solo possa bastare, o serve piuttosto un impianto normativo e di responsabilità condivisa tra aziende, governi e società civile? Non ho una risposta definitiva, ma credo che report come questo, per quanto scomodi, siano un passo necessario verso una maggiore trasparenza sul rapporto tra IA e sicurezza globale.
E qui mi viene un dubbio: siamo sicuri che questi report siano solo trasparenza?
Raccontare quanto il proprio modello sia efficace nel costruire malware, sviluppare armi o condurre attacchi sembra sia diventata una forma di vanto.
Una dimostrazione di quanto sia potente la propria AI.
Fonti:
https://www.anthropic.com/threat-intelligence-report-september-2026
