Cosa sappiamo di Fable 5.1 e Mythos 5.1
di Giuditta MoscaIl clamore suscitato da Mythos 5 al momento del suo rilascio sta creando un alone di preoccupazione attorno a Mythos 5.1. Anthropic presenta Fable 5.1 e Mythos 5.1 come i suoi modelli più avanzati per la programmazione e il lavoro basato sulla conoscenza. Facciamo chiarezza
Prima di parlare di Claude Fable 5.1 e Mythos 5.1 è opportuno ricapitolare in breve cosa è accaduto a partire dallo scorso 9 giugno, quando sono stati rilasciati Claude Fable 5 e Mythos 5. Mythos 5 è stato destinato a una platea di partner selezionati, attivi soprattutto nel comparto della cybersecurity difensiva.
Il 12 giugno il governo degli Stati Uniti ha imposto controlli sull’esportazione di Mythos 5 e Fable 5, vietandone l’accesso ai cittadini stranieri, dentro e fuori gli Stati Uniti. Poiché l’ordine è entrato in vigore immediatamente e Anthropic non disponeva di un sistema affidabile per verificare in tempo reale la nazionalità degli utenti, ha deciso di sospendere temporaneamente l’accesso a entrambi i modelli, per tutti.
Il 30 giugno, infine, il governo americano ha revocato i controlli sull’esportazione di Mythos 5 e Fable 5. Dal 1° luglio Fable 5 è tornato disponibile globalmente, mentre Mythos 5 è stato ripristinato per un gruppo di organizzazioni autorizzate. Ora, con il rilascio di Mythos 5.1 e Fable 5.1, si rende necessario fare chiarezza.
Mythos 5.1 e Fable 5.1
I due nomi indicano lo stesso modello di IA, distribuito con livelli diversi di salvaguardia. Claude Fable 5.1 è generalmente disponibile sulle piattaforme Anthropic e sui principali servizi cloud, mentre Claude Mythos 5.1 è accessibile solo a un gruppo ristretto di organizzazioni verificate.
Anthropic ne parla come dei modelli più avanzati per la programmazione e il lavoro basato sulla conoscenza e, a scanso di equivoci, è opportuno fare dei distinguo. Fable 5.1 non è un modello Claude “senza filtri”, tant’è che viene distribuito con salvaguardie di produzione. Parallelamente, Mythos 5.1 consente attività che in Fable 5.1 sono limitate.
Meno blocchi per richieste legittime
Anthropic ha cercato soprattutto di rendere Fable 5.1 meno incline a fermare attività legittime nel campo della cybersicurezza. Nelle sessioni di Claude Code, lo strumento che permette ai programmatori di affidare all’IA attività di scrittura del codice software, i filtri di sicurezza dovrebbero intervenire in media circa il 60% in meno rispetto a quelli utilizzati inizialmente con Fable 5.
Fable 5.1 può cercare vulnerabilità nel codice sorgente, per esempio individuando una falla che uno sviluppatore deve correggere. Anthropic continua invece a limitare o reindirizzare attività che potrebbero essere utilizzate anche per attaccare sistemi informatici e, tra queste, spiccano la creazione di exploit – programmi o istruzioni che sfruttano concretamente una vulnerabilità – oltre ad alcuni test di penetrazione dei sistemi e alla ricerca automatizzata di falle direttamente nei programmi già compilati. In questi casi la richiesta può essere trasferita a un modello della famiglia Opus, sottoposto a regole differenti.
La stessa impostazione vale per la biologia. I primi sistemi di sicurezza introdotti con Fable 5 potevano intervenire anche davanti a domande innocue, per esempio su nozioni di biologia di base, sintomi o risultati di laboratorio. Anthropic sostiene che i filtri aggiornati, utilizzati sia con Fable 5 sia con Fable 5.1, intervengono su questo tipo di richieste circa l’85% in meno rispetto alla versione originale. Le attività di ricerca e sviluppo nelle scienze della vita restano invece sottoposte a restrizioni. Quando una richiesta riguarda attività di ricerca e sviluppo nelle scienze della vita, Fable 5.1 la indirizza normalmente verso modelli Opus.
Dalle proteine alla mappa di Venere
Anthropic dedica una parte rilevante dell’annuncio alle applicazioni scientifiche. In uno degli esperimenti, Mythos 5.1 ha progettato proteine capaci di legarsi a specifici bersagli biologici utilizzando strumenti Open source di progettazione e ripiegamento delle proteine.
I progetti elaborati sono stati poi inviati ad Adaptyv Bio e Twist Bioscience, due organizzazioni esterne che li hanno verificati sperimentalmente in laboratorio.
Secondo Anthropic, su dodici bersagli complessivi, il tasso di progetti che ha prodotto proteine effettivamente capaci di legarsi al bersaglio ha sfiorato il 50%.
Fable 5.1 è stato invece utilizzato per addestrare una rete neurale e costruire una nuova mappa altimetrica ad alta risoluzione di circa un terzo di Venere, partendo dai dati radar raccolti dalla sonda Magellano della Nasa. Anthropic afferma che la nuova ricostruzione permette di distinguere dettagli nell’ordine di 2-3 chilometri, contro i precedenti 10-20 chilometri, e migliora fino al 25% la precisione delle stime dell’altitudine. La mappa è disponibile qui.
Protezione dei dati aziendali con EFS
L'altra novità rilevante per le imprese si chiama Enterprise Frontier Safeguards, EFS. È un sistema pensato per conciliare il controllo degli abusi con una politica equivalente alla zero data retention. Ovvero, le informazioni necessarie al monitoraggio vengono archiviate nell'infrastruttura cloud controllata dal cliente, non nei sistemi di Anthropic.
Anthropic afferma di avere sviluppato EFS insieme a più di cento clienti dei settori finanziario, sanitario, manifatturiero, delle telecomunicazioni, legale, retail e pubblico, oltre ad Amazon Web Services, Google Cloud e Microsoft Azure. Il sistema sarà introdotto progressivamente a partire dall'autunno 2026.
Gli episodi di hacking e perché Anthropic insiste sulle protezioni
Il tema non è teorico e rimanda allo scorso 30 luglio, quando Anthropic aveva comunicato di avere individuato, analizzando 141.006 esecuzioni di test di cybersicurezza, tre incidenti nei quali modelli Claude avevano raggiunto internet da ambienti di valutazione e poi ottenuto accesso non autorizzato ai sistemi reali di tre organizzazioni. In tutti i casi, una configurazione errata aveva lasciato accesso alla rete alle macchine usate nei test, nonostante i prompt dicessero esplicitamente al modello che Internet non era disponibile. In uno dei casi documentati, Mythos 5 aveva pubblicato del codice Python malevolo, rimasto online per circa un’ora e prelevato ed eseguito su 15 sistemi. Secondo la ricostruzione di Anthropic, il modello stava però ancora eseguendo il compito simulato assegnato nel test e non “sapeva” che l’ambiente avesse accesso alla rete reale.
Mythos 5.1 sembra rispettare meglio del predecessore i limiti imposti dai ricercatori durante i test. In particolare, tende meno spesso a ignorare istruzioni esplicite o a cercare di compiere azioni al di fuori dell’ambiente controllato nel quale viene valutato. Anthropic avverte però che il problema non è del tutto risolto, tant’è che, in alcune situazioni, il modello può ancora aggirare meccanismi di approvazione o classificatori automatici.
Inoltre, Anthropic avverte che queste verifiche hanno ancora dei limiti. Le valutazioni offrono una copertura minore quando il modello lavora su contesti molto lunghi oppure quando il compito viene suddiviso tra più agenti IA che collaborano tra loro.
Watermark per l'Europa
Fable 5.1 e Mythos 5.1 introducono anche il watermark testuale previsto dagli obblighi di trasparenza dell’articolo 50 dell’AI Act europeo, applicabili dal 2 agosto 2026. Il watermark è invisibile nel testo e non contiene informazioni sull'utente, sull'organizzazione o sulle conversazioni. Per verificarne la presenza Anthropic sta distribuendo in anteprima privata un'API di rilevamento destinata inizialmente, tra gli altri, a regolatori, forze dell'ordine, media, fact-checker, ricercatori, organizzazioni educative e gruppi della società civile europea.
I dati aziendali sui benchmark
Sul fronte delle prestazioni, Anthropic attribuisce a Fable 5.1 miglioramenti consistenti soprattutto nelle attività lunghe e composte da più passaggi. In Terminal-Bench-Science 0.1, un test per la ricerca scientifica svolta da agenti IA, Anthropic riporta un punteggio del 52,6%, contro il 24,7% di Fable 5 e il 29% di Opus 5. L’azienda precisa che, su questo benchmark, l’errore standard è di circa 3,5-4,5 punti per modello.
In Terminal-Bench 4.0, dedicato alla programmazione agentiva, Fable 5.1 raggiunge il 55,8%, mentre Mythos 5.1 arriva al 60,9% quando opera con le proprie salvaguardie più permissive.
Nel test AutomationBench, che misura flussi di lavoro aziendali, Fable 5.1 ottiene il 31,4%, contro il 17,1% di Fable 5 e il 26,9% di Opus 5. Su CursorBench 3.2.0 arriva invece al 73,4%.
Tuttavia, è bene ricordare che questi risultati vanno trattati per ciò che sono: risultati riportati da Anthropic su benchmark di diversa provenienza, non una dimostrazione indipendente della superiorità complessiva del modello.
La questione economica
Online si legge che il costo dell’uso di Fable 5.1 sarebbe diminuito del 75% ed è un’informazione che merita un approfondimento. Il prezzo generale di Fable 5.1 non è diminuito del 75%. Il listino dell’API resta quello di Fable 5: 10 dollari per un milione di token in input e 50 dollari per un milione di token prodotti in output. A diminuire del 75% è invece il costo delle “cache reads”, cioè della rilettura di porzioni di contesto che il servizio ha già elaborato e memorizzato per poterle riutilizzare, il cui costo passa da 1 dollaro a 0,25 dollari per milione di token.
La differenza diventa importante soprattutto per gli agenti di IA, cioè sistemi che non si limitano a rispondere a una domanda ma eseguono per periodi più lunghi sequenze di operazioni, utilizzando strumenti e tornando ripetutamente sulle stesse istruzioni, documenti, conversazioni o basi di codice. È precisamente in questi casi che la cache può rappresentare una quota rilevante del consumo complessivo.
Secondo i calcoli pubblicati da Anthropic, basati su quattro settimane di utilizzo reale nell’agosto 2026, il nuovo prezzo della cache dovrebbe ridurre il costo effettivo di Fable 5.1 di circa il 25% rispetto a Fable 5 nei carichi di lavoro tipici. Per le attività fortemente agentive, nelle quali viene riutilizzata una quantità molto elevata di contesto, il risparmio stimato può arrivare intorno al 45%.
Come usare Fable 5.1 e Mythos 5.1
Claude Fable 5.1 è disponibile da subito sulle piattaforme Anthropic e attraverso Amazon Web Services, Google Cloud e Microsoft Azure. Per gli utenti individuali e aziendali, Anthropic indica la disponibilità sui piani Pro, Max, Team ed Enterprise e, infine, per gli sviluppatori è disponibile anche tramite API.
Mythos 5.1 rimane invece sottoposto ad accesso verificato. Al momento dell'annuncio Anthropic indica che l'accesso è limitato a un gruppo di organizzazioni americane.