Anthropic, società di San Francisco tra le più influenti al mondo nello sviluppo dell’IA, ha annunciato Claude Mythos Preview, il suo modello di intelligenza artificiale più avanzato, dichiarando contestualmente che non sarà reso disponibile al grande pubblico.
Il motivo?
È così abile nello scovare vulnerabilità in ogni sistema operativo e browser che un consorzio di giganti della tecnologia lo utilizzerà per mettere in sicurezza il software critico mondiale, prima che le stesse capacità finiscano nelle mani sbagliate.
Questa storia - un'azienda di intelligenza artificiale che sviluppa un modello così potente da essere "troppo pericoloso" per il pubblico - dovrebbe suonare familiare.
Quando nel 2019 OpenAI presentò GPT-2, disse che era troppo rischioso per essere reso disponibile a tutti: avrebbe potuto inondare Internet di fake news e spam convincente. Il modello fu rilasciato solo parzialmente, e la decisione divise la comunità scientifica.
Molti ricercatori la considerarono una mossa di marketing travestita da cautela etica: dichiarare pericoloso un modello equivale a dichiararlo potentissimo, e questo genera titoli, attenzione e, in ultima analisi, valore per l'azienda.
Ma pochi mesi dopo GPT-2 fu rilasciato integralmente e il mondo continuò a girare, solo con un po' più di testo generato dalle macchine.
È difficile insomma separare Anthropic dalla lunga storia dei cicli di hype dell'IA, in cui questi strumenti vengono presentati come entità in grado di cambiare il mondo, per poi rivelarsi incapaci di contare le lettere nella parola "strawberry".
Nel caso di Mythos Preview, tuttavia, i timori sembrano giustificati. Vediamo perché.
Un modello che non è stato addestrato per bucare sistemi. Ma lo fa
La caratteristica più rilevante e al contempo inquietante di Mythos Preview risiede nella sua capacità di agire come un esperto ricercatore di sicurezza informatica.
Mythos Preview è un modello general-purpose: non è stato addestrato specificamente per la cybersecurity. Eppure, come effetto collaterale dei suoi miglioramenti nel codice, nel ragionamento e nell'autonomia, ha sviluppato capacità di scoperta e sfruttamento delle vulnerabilità software che superano quelle di tutti i modelli precedenti e della stragrande maggioranza degli esperti umani.
“Claude Mythos Preview rappresenta un salto particolarmente significativo - ha dichiarato il CEO di Anthropic Dario Amodei -. Non lo abbiamo addestrato specificamente per essere bravo nel cyber. Lo abbiamo addestrato per essere bravo nel codice, ma come effetto collaterale dell'essere bravo nel codice, è anche bravo nel cyber”.
“Invece di rendere Mythos Preview disponibile a tutti, abbiamo deciso di metterlo prima nelle mani di chi difende i sistemi, perché le falle vengano scoperte e chiuse prima che modelli di questa classe diventino accessibili a tutti”, ha aggiunto Amodei.
Durante le fasi di test, il modello ha individuato migliaia di vulnerabilità sconosciute, note in gergo tecnico come zero-day, all'interno dei principali sistemi operativi e browser web.
Per capire la portata di questo nuovo salto dell’IA servono alcuni numeri.
Il modello precedente di Anthropic, Opus 4.6, aveva un tasso di successo vicino allo zero nella creazione autonoma di exploit, programmi o sequenze di istruzioni che sfruttano una falla nel software per ottenere un risultato non previsto, come prendere il controllo di un sistema, leggere dati riservati o mandare in crash un server. Su uno stesso test - trasformare le vulnerabilità trovate nel motore JavaScript di Firefox 147 in exploit funzionanti - Mythos Preview ne ha prodotti 181, contro i 2 di Opus 4.6.
Nei test interni, Anthropic ha lanciato i propri modelli contro circa mille progetti software open-source molto utilizzati, valutando la gravità del peggior danno che ciascun modello riusciva a provocare, su una scala da 1 (crash generico) a 5 (pieno controllo del programma da parte dell'attaccante). I modelli precedenti si fermavano quasi sempre ai livelli più bassi. Mythos Preview ha raggiunto il livello 5 - il controllo completo - su dieci programmi distinti e completamente aggiornati. In termini pratici, significa che il modello ha dimostrato la capacità di prendere il pieno possesso di software che milioni di persone usano quotidianamente.
Le scoperte che fanno paura
Ma i numeri non raccontano la parte più inquietante. Mythos Preview ha identificato autonomamente una vulnerabilità vecchia di 27 anni in OpenBSD, un sistema operativo la cui intera reputazione è costruita sulla sicurezza. Ha trovato un bug di 16 anni in FFmpeg, uno dei codec video più testati al mondo, sfuggito a ogni strumento automatico e revisore umano. Ha scoperto una falla di corruzione della memoria in un Virtual Machine Monitor scritto in Rust, un linguaggio considerato sicuro per progettazione, dimostrando che nemmeno le garanzie del linguaggio sono sufficienti quando il codice usa operazioni a basso livello.
Il nuovo modello di Anthropic ha identificato e sfruttato, senza intervento umano, una vulnerabilità di esecuzione remota di codice nel server NFS di FreeBSD, vecchia di 17 anni, che garantisce accesso root completo (cioè il massimo livello di controllo sul sistema) a utenti non autenticati da qualsiasi punto di Internet.
Queste capacità di analisi autonoma permettono all’IA non solo di trovare i punti deboli, ma anche di generare il codice necessario per sfruttarli. Una competenza che fino a oggi richiedeva squadre di hacker altamente specializzati e settimane di lavoro manuale.
“Non è una trovata pubblicitaria”
Thomas L. Friedman, editorialista del New York Times e tre volte premio Pulitzer, ha dedicato a Mythos Preview un intero editoriale, inquadrando i pro e contro del nuovo modello.
La buona notizia è che Anthropic, nel processo di sviluppo del suo nuovo modello, ha scoperto che l'IA è in grado non solo di scrivere codice software con maggiore facilità e complessità rispetto a qualsiasi modello attualmente disponibile, ma - come sottoprodotto di questa capacità - anche di trovare vulnerabilità in praticamente tutti i sistemi software più diffusi al mondo.
Purtroppo, scrive Friedman, c’è anche una cattiva notizia: se questo strumento finisce nelle mani di malintenzionati, questi potrebbero hackerare praticamente ogni sistema software principale al mondo.
I timori di Anthropic riguardo le minacce informatiche e le capacità dell’IA, insomma, non sarebbero una trovata pubblicitaria.
“Nel periodo che ha preceduto l’annuncio di Mythos Preview - scrive Friedman sul Nyt - i rappresentanti delle principali aziende tecnologiche hanno discusso in privato con l’amministrazione di Donald Trump delle implicazioni per la sicurezza degli Stati Uniti e di tutti gli altri Paesi che utilizzano questi sistemi software ormai vulnerabili, mi hanno riferito alcune delle persone coinvolte”.
Il precedente: l'IA è già stata un'arma
Per capire perché il mondo della sicurezza informatica prende questa notizia così sul serio, bisogna tornare indietro di pochi mesi.
Alla fine del 2025, Anthropic ha reso pubblico quello che è considerato il primo caso documentato di cyberattacco su larga scala eseguito in modo prevalentemente autonomo da un'intelligenza artificiale.
Un gruppo sostenuto dal governo cinese, denominato GTG-1002, ha manipolato Claude Code - lo strumento di coding agentico di Anthropic - per condurre una campagna di spionaggio contro circa 30 obiettivi globali, tra cui grandi aziende tecnologiche, istituzioni finanziarie, produttori chimici e agenzie governative. L'IA ha gestito autonomamente l'80-90% delle operazioni tattiche.
Quello era prima che gli agenti diventassero esponenzialmente più capaci e che chi sperimenta con essi iniziasse ad aprire nuove porte rischiose.
Ecco perché questa volta è diverso: i nuovi modelli sono oggi in grado di alimentare agenti che pensano, agiscono, ragionano e improvvisano da soli, senza pause e senza limiti. Immaginate un magazzino pieno dei criminali informatici più sofisticati, che non dormono mai, imparano in tempo reale e insistono fino a riuscire. Solo che il magazzino è infinito.
I malintenzionati possono ora scalare semplicemente con più potenza di calcolo. Non sono più limitati da personale finito. Una singola persona può condurre campagne che un tempo richiedevano interi team.
Allo stesso tempo, i sistemi sono più vulnerabili perché moltissimi dipendenti stanno attivando Claude, Copilot o altri modelli agentici - spesso a casa - e stanno creando i propri agenti. Non di rado, li collegano ai sistemi interni di lavoro senza rendersene conto, aprendo una nuova porta d'ingresso per i criminali informatici. Il settore ha già un nome per questo fenomeno: "shadow AI".
Un sondaggio di Dark Reading ha rilevato che il 48% dei professionisti della cybersecurity considera l'IA agentica il vettore di attacco numero uno per il 2026, al di sopra dei deepfake, al di sopra di qualsiasi altra minaccia.
Project Glasswing: la difesa prima dell'attacco
Anziché rilasciare Mythos Preview al pubblico, dunque, Anthropic ha scelto di metterlo a disposizione di un consorzio industriale chiamato Project Glasswing - dal nome della farfalla dalle ali trasparenti, metafora delle vulnerabilità software che sono "relativamente invisibili" - e ha dato accesso al modello esclusivamente a un gruppo selezionato di organizzazioni.
I partner fondatori sono Amazon Web Services, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, la Linux Foundation, Microsoft, NVIDIA e Palo Alto Networks.
Circa 40 organizzazioni aggiuntive, che costruiscono o mantengono infrastrutture software critiche, hanno ricevuto anch'esse l'accesso. Anthropic ha stanziato fino a 100 milioni di dollari in crediti d'uso e ha donato 4 milioni di dollari a organizzazioni di sicurezza open-source.
“I rischi di errore sono evidenti. Se però l’operazione riesce, si apre una concreta opportunità: costruire un internet e un mondo più sicuri rispetto a quelli precedenti all’affermarsi delle capacità cibernetiche basate sull’IA”, ha scritto Amodei su X presentando il progetto.
Claude di Anthropic unisce smartphone e Pc: così l’IA lavora da sola utilizzando il computer
Le aziende coinvolte e l’urgenza di proteggere le infrastrutture critiche
Secondo Logan Graham, che in Anthropic guida il gruppo dedicato alla scoperta dei rischi più grandi legati all’IA, la finestra temporale prima che capacità simili a Mythos Preview diventino ampiamente disponibili - anche presso altri sviluppatori di IA - è di appena sei-diciotto mesi.
Il peso dell'iniziativa si misura anche da chi ha deciso di aderire. Il CISO globale di Microsoft, Igor Tsyganskiy, ha dichiarato che “entriamo in una fase in cui la cybersecurity non è più vincolata dalla sola capacità umana” e che l'adesione a Glasswing permette a Microsoft di “identificare e mitigare i rischi in anticipo e potenziare le soluzioni di sicurezza per proteggere meglio i clienti”. Quando testato contro CTI-REALM, il benchmark di sicurezza open-source di Microsoft, Mythos Preview ha mostrato miglioramenti sostanziali rispetto ai modelli precedenti.
Da Cisco, il messaggio è ancora più diretto. Anthony Grieco, SVP e Chief Security & Trust Officer, parla di una soglia ormai superata: “Le capacità dell'IA hanno superato un punto che cambia radicalmente l'urgenza necessaria per proteggere le infrastrutture critiche. Non si torna indietro”. Il lavoro preparatorio con questi modelli, ha spiegato Grieco, dimostra che è possibile identificare e correggere vulnerabilità in hardware e software a un ritmo e una scala prima impossibili. Per questo, ha aggiunto, i fornitori di tecnologia devono adottare aggressivamente nuovi approcci adesso, e i clienti devono essere pronti a implementarli.
Il tema della velocità è centrale. Elia Zaitsev, CTO di CrowdStrike, lo ha sintetizzato così: “La finestra tra la scoperta di una vulnerabilità e il suo sfruttamento da parte di un avversario si è ridotta a zero. Quello che una volta richiedeva mesi ora avviene in minuti con l'IA. Questo non è un motivo per rallentare; è un motivo per muoversi insieme, più velocemente”.
Ma c'è anche una dimensione strutturale che viene spesso trascurata. La sicurezza informatica seria è stata storicamente un lusso accessibile solo alle organizzazioni con grandi team dedicati. Il software open-source, che costituisce la stragrande maggioranza del codice nei sistemi moderni, inclusi quelli che gli stessi agenti IA usano per scrivere nuovo software, è stato in gran parte mantenuto da gruppi ristretti senza quel tipo di risorse.
Jim Zemlin, CEO della Linux Foundation, vede in Glasswing un'opportunità per cambiare questa equazione, dando ai manutentori l'accesso a strumenti di sicurezza che prima erano appannaggio esclusivo delle grandi aziende. “Così la sicurezza potenziata dall'IA può diventare un alleato fidato per ogni manutentore, non solo per chi può permettersi costosi team dedicati”, ha dichiarato.
I partner di infrastruttura cloud confermano che la fase di test è già operativa. Amy Herzog, Vice President e CISO di Amazon Web Services, ha sottolineato che i team AWS analizzano oltre 400 trilioni di flussi di rete al giorno alla ricerca di minacce, e che Claude Mythos Preview è già in uso nelle loro operazioni di sicurezza, applicato a basi di codice critiche dove “ci sta già aiutando a rafforzare il nostro codice”.
Anche il settore finanziario si è mosso. Pat Opet, CISO di JPMorganChase, ha inquadrato l'adesione in termini di responsabilità sistemica verso la resilienza del sistema finanziario, definendo Glasswing “un'opportunità unica e in fase iniziale per valutare strumenti IA di nuova generazione per la cybersecurity difensiva delle infrastrutture critiche”.