Notizie sull’AI
Anthropic estende ai difensori cyber l’accesso ai modelli più potenti con tre livelli di verifica
Il Cyber Verification Program amplia l’accesso controllato a modelli capaci di assistere nella sicurezza informatica; i test pubblicati sono interni e non certificano una protezione generale.

Anthropic amplia il programma di verifica cyber con tre livelli di accesso ai modelli: criteri, opportunità per i team difensivi e limiti dei test dichiarati.
Anthropic ha ampliato il Cyber Verification Program, un percorso che concede a organizzazioni selezionate accesso a modelli AI per attività di sicurezza informatica. La novità può essere utile a team che cercano vulnerabilità e verificano sistemi prima degli attacchi, ma l’accesso richiede controlli e non viene aperto al pubblico. L’iniziativa riguarda modelli con capacità che possono essere utili tanto alla difesa quanto a un uso improprio.
Il programma prevede tre livelli, da Defense Access e Red Team Access fino a Specialized Access per gruppi con necessità e valutazioni più sensibili. Anthropic dichiara di includere modelli come Claude Opus 5.5, Sonnet 5.5 e Mythos 5.1, oltre a versioni future. La disponibilità dipende dal controllo del richiedente e dall’approvazione dell’azienda, quindi non è un’offerta generale per ogni impresa.
Che cosa è successo
Nel livello orientato alla difesa, il modello è proposto per attività quali analisi di codice, individuazione di vulnerabilità e rafforzamento dei sistemi. Gli altri livelli consentono verifiche più estese o accesso specializzato, secondo i requisiti e la valutazione di Anthropic. La società spiega che l’obiettivo è aumentare l’utilità per la sicurezza mantenendo limiti più stretti dove le capacità presentano rischi maggiori.
Anthropic pubblica un proprio confronto di prove: nella suite interna il livello Defense ha bloccato 46 tentativi su 50 di sfide considerate complesse, mentre il livello Red Team ne ha completati 34 su 50 senza blocchi. Sono risultati dichiarati dal fornitore su un test costruito e gestito dal fornitore. Non costituiscono una valutazione indipendente né dimostrano che gli stessi controlli funzionino su ogni richiesta reale.
L’azienda collega il programma anche ai risultati del progetto Glasswing e alle attività di scansione: riferisce 129.000 vulnerabilità verificate individuate dai partner tra aprile e luglio, e 5.500 rilevate dalle proprie scansioni entro ottobre, con oltre 33.000 classificate come critiche o ad alto rischio nel campione richiamato. Numeri e criteri sono quelli comunicati da Anthropic e vanno letti con le definizioni e i perimetri indicati dalla società.
Il punto che rischia di passare inosservato
L’accesso controllato non risolve da solo il rischio di doppio uso. Un sistema può aiutare un difensore a trovare una falla e, in un contesto diverso, facilitare la preparazione di un attacco. La verifica iniziale dell’organizzazione, i limiti per classe di attività e il monitoraggio nel tempo diventano quindi parti centrali della misura, non dettagli amministrativi separati dalla capacità tecnica.
Le condizioni sui dati meritano una lettura attenta: Anthropic indica obblighi di conservazione per le organizzazioni ammesse, salvo i modelli che dispongono già di zero data retention, e prevede un percorso EFS. Il trattamento dei prompt e dei risultati può incidere su segreti, codice proprietario e vulnerabilità non ancora corrette. I clienti devono controllare il contratto applicabile e non presumere che ogni accesso sia a conservazione zero.
Anthropic amplia l’accesso cyber con verifica e livelli distinti; efficacia dei controlli e risultati di sicurezza restano da convalidare in modo indipendente.
Che cosa cambia per imprese e professionisti
Per le imprese con un team di sicurezza, il programma offre una possibile strada per valutare capacità avanzate su codice e infrastruttura senza chiedere accesso indiscriminato. Prima di candidarsi, conviene definire casi d’uso, persone autorizzate, dati che possono essere caricati e un processo di revisione umana per i risultati. Una vulnerabilità suggerita dal modello va riprodotta e verificata prima di modifiche o comunicazioni.
I professionisti della sicurezza dovrebbero confrontare la proposta con strumenti e procedure già adottati: gestione delle patch, penetration test autorizzati, segnalazione responsabile e risposta agli incidenti. I risultati di un benchmark interno non sostituiscono test sul proprio ambiente, né un marchio di accesso dimostra che un’attività sia sicura o conforme. I limiti contrattuali devono essere chiari prima di trattare codice o dati sensibili.
Per i fornitori di AI, l’espansione rende più visibile la necessità di distinguere accessi per scopo e capacità. È un modello di governance da osservare, ma resta una policy del singolo fornitore: criteri di ammissione, trasparenza dei rifiuti e gestione dei dati dovranno essere confrontati con pratiche indipendenti. Le organizzazioni non ammesse devono comunque mantenere un programma difensivo ordinario, senza aspettare questo accesso.
Che cosa osservare adesso
Da seguire sono i criteri di ammissione aggiornati, le condizioni di conservazione applicabili ai diversi modelli e la disponibilità effettiva del percorso EFS. Sarà importante che valutatori esterni possano misurare falsi positivi, capacità d’attacco e qualità delle verifiche difensive usando metodi riproducibili e non soltanto dati del fornitore.
Le imprese interessate dovrebbero chiedere quali modelli sono inclusi, quali azioni sono consentite e come si revoca l’accesso quando cambia il team. La misura avrà valore se aumenta la scoperta e la correzione di vulnerabilità senza ampliare l’esposizione di codice e credenziali. Al momento l’annuncio descrive un programma selettivo e risultati preliminari, non una garanzia generale di sicurezza informatica.
Per approfondire
Per il contesto ANPAI: Il ruolo dei valutatori indipendenti nella sicurezza AI
Le fonti
Anthropic — Cyber Verification Program, 6 ottobre 2026 · Reuters — copertura indipendente, 6 ottobre 2026
Questa analisi della redazione ANPAI aiuta a leggere fatti e conseguenze operative. Non sostituisce una valutazione tecnica o legale riferita a un caso specifico.