Allarme AI, Anthropic rivela di avere sventato diversi tentativi di costruire armi biologiche
Allarme AI, Anthropic rivela di avere sventato diversi tentativi di costruire armi biologiche
Il nuovo report della società guidata da Dario Amodei rivela 40 casi di uso illecito dei propri modelli AI, tra cui tentativi sofisticati di ottenere informazioni per costruire armi biologiche, neutralizzati tra dicembre 2025 e agosto 2026

di Marcello Bussi 11/09/2026 09:20

Ftse Mib
52.412,94 15.43.35

+1,17%

Dax 30
25.546,21 15.43.11

+0,73%

Dow Jones
52.565,77 15.48.23

+0,96%

Nasdaq
26.364,42 15.43.04

+1,08%

Euro/Dollaro
1,1607 15.28.28

-0,17%

Spread
86,55 15.49.04

-2,23

Anthropic ha pubblicato il Threat Intelligence Report. Si tratta del resoconto più dettagliato e completo mai diffuso dall'azienda riguardo all'uso illecito dei propri modelli di intelligenza artificiale, in particolare Claude. Il documento copre circa 40 casi reali di abuso neutralizzati tra dicembre 2025 e agosto 2026.

Particolarmente inquietante il tentativo, per fortuna sventato, di acquisire informazioni per costruire armi biologiche. Anthropic ha scelto deliberatamente di mantenere riservate le identità e i Paesi esatti di provenienza degli attaccanti, limitandosi a delineare il contesto generale dei cinque casi di studio principali legati al rischio biologico. 

I tentativi di ingannare Claude

Gli attori coinvolti non hanno chiesto direttamente a Claude «come creare un'arma biologica», ma hanno adottato tattiche sofisticate. I ricercatori hanno cercato di aggirare i filtri di sicurezza originari (safeguards) formulando domande tecniche altamente specifiche, frammentando le richieste e offuscando lo scopo finale dei loro studi per non far insospettire l'AI. In un caso specifico emerso dal report, Claude è stato utilizzato per ricevere assistenza nella stesura di una richiesta di finanziamento (grant application) per la ricerca su un virus trasmesso dalle zanzare.

L'obiettivo degli attori malevoli era usare l'AI per colmare il divario di competenze tecniche e superare passaggi critici e complessi nella sintesi, ottimizzazione e ingegnerizzazione di virus, veleni e tossine ad alto potenziale pandemico.

La reazione di Anthropic

Poiché la ricerca biologica legittima (come lo studio per la creazione di vaccini) condivide moltissimi passaggi tecnici con la creazione di armi batteriologiche, Anthropic si è trovata davanti a una forte ambiguità. Non potendo determinare con assoluta certezza se l'intento finale fosse accademico o distruttivo, l'azienda ha applicato una politica di tolleranza zero basata sul principio di precauzione.

Anthropic ha quindi immediatamente bannato ed eliminato gli account di tutti i ricercatori e delle istituzioni coinvolte in queste attività ambigue, interrompendo i loro progetti sul nascere. E sfruttando i dati raccolti durante queste minacce, gli ingegneri hanno introdotto classificatori in tempo reale molto più severi nei modelli Claude di ultima generazione, addestrandoli a riconoscere i tentativi di manipolazione del contesto legati alle scienze biologiche. 

La società guidata da Dario Amodei ha poi istituito un protocollo di red teaming (attacchi simulati) per testare l'intelligence tattica e militare dei modelli prima del rilascio pubblico, assicurandosi che non forniscano mai assistenza in ambito Cbrn (Chimico, Biologico, Radiologico e Nucleare). (riproduzione riservata)