Italian Tech

Intelligenza Artificiale

Anthropic apre al pubblico la sua arma più potente: arriva Claude Fable 5, IA della famiglia Mythos

Anthropic apre al pubblico la sua arma più potente: arriva Claude Fable 5, IA della famiglia Mythos

L’azienda di San Francisco rende disponibile per la prima volta un modello di classe Mythos, finora riservato a una ristretta cerchia di esperti di cybersicurezza. Lo fa addomesticando le capacità più pericolose con un sistema di filtri che devia le richieste sensibili verso un modello più prudente. In parallelo aggiorna Mythos, il gemello senza freni, per i partner di Project Glasswing

5 minuti di lettura

Anthropic, azienda IA del valore di quasi mille miliardi di dollari, ha presentato Claude Fable 5.

È il primo modello di classe Mythos che l'azienda mette a disposizione di chiunque, dopo settimane in cui questa famiglia di sistemi era rimasta accessibile solo a un gruppo selezionato di aziende e governi, per la preoccupazione legata alle capacità di questa IA di individuare e superare vulnerabilità informatiche invisibili all’occhio umano.

C'è un cortocircuito difficile da ignorare.

Appena pochi giorni fa la stessa Anthropic aveva pubblicato un documento in cui invitava i grandi laboratori a valutare un rallentamento coordinato dello sviluppo dell'intelligenza artificiale, sostenendo che la possibilità di “rallentare o mettere temporaneamente in pausa” il progresso a livello globale sarebbe “probabilmente una cosa positiva”. L'allarme riguardava il rischio che i modelli di frontiera arrivino presto a migliorarsi da soli, senza supervisione umana.

Oggi, invece, l'azienda mette in commercio il sistema più potente che abbia mai reso accessibile.

Il modello più capace mai aperto al grande pubblico

I numeri che accompagnano il lancio di Claude Fable 5 raccontano un salto in avanti che appare importante. Fable 5 si colloca al vertice di quasi tutti i benchmark di capacità testati, dall'ingegneria del software al lavoro di conoscenza, fino alla ricerca scientifica.

Sul test SWE-Bench Pro, che misura la programmazione autonoma, tocca l'80,3% contro il 69,2% di Claude Opus 4.8 - il modello di Anthropic finora più avanzato disponibile a tutti - e percentuali sensibilmente più basse dei modelli concorrenti di OpenAI e Google. E più il compito è lungo e complesso, più il distacco si allarga.

L'azienda non nasconde il rovescio della medaglia. “Lanciare un modello così potente comporta dei rischi”, scrive nel comunicato che accompagna il modello, ricordando che senza protezioni le abilità di Fable 5 in campi come la cybersicurezza “potrebbero essere usate in modo improprio per causare danni gravi”.

Lo stesso modello, due nomi

La distinzione tra Fable e Mythos non riguarda l'intelligenza di base, che è identica. Riguarda i freni. Fable 5 esce con una serie di filtri che intercettano le richieste su un insieme ristretto di temi ad alto rischio - cybersicurezza offensiva, biologia e chimica, tentativi di copiare il modello - e le deviano automaticamente verso Claude Opus 4.8, il modello immediatamente precedente. L'utente viene avvisato ogni volta che questo accade.

La scelta è conservativa. Anthropic ammette di aver tarato i classificatori in modo cauto, al punto che “a volte richieste innocue faranno scattare i filtri”, e promette di ridurre i falsi positivi con gli aggiornamenti successivi al lancio.

Secondo i primi dati raccolti, però, oltre il 95% delle sessioni su Fable 5 si svolge interamente sul modello principale, senza alcun rimbalzo. Per quelle conversazioni, sostiene l'azienda, l'esperienza è di fatto quella di Mythos 5.

Cosa sa fare Fable 5

Le prime aziende che hanno provato Fable 5 raccontano - nel comunicato di Anthropic - risultati che fino a poco tempo fa avrebbero richiesto interi team umani.

Stripe riferisce di aver compresso mesi di lavoro in giorni: su una base di codice Ruby da cinquanta milioni di righe, il modello ha completato in una giornata una migrazione che a mano avrebbe impegnato una squadra per oltre due mesi.

La società di analisi dati Hex parla del “primo modello a superare il 90% sul nostro benchmark di compiti analitici complessi e a lunga esecuzione: dieci punti in più di Opus”, aggiungendo che “sulle domande più difficili mostra giudizio solido e attenzione alle sfumature”.

C'è poi tutto il versante scientifico, che Anthropic affida soprattutto a Mythos 5. Nel design dei farmaci, i ricercatori interni dicono di aver accelerato alcune fasi del processo di circa dieci volte. In uno studio su quattordici bersagli proteici, nove hanno prodotto candidati promettenti ora in fase di studio.

Sul fronte della biologia molecolare il modello ha generato ipotesi che gli scienziati dell'azienda hanno preferito a quelle dei sistemi precedenti circa otto volte su dieci, e una di queste - un meccanismo inedito per una proteina di E. coli - è stata poi confermata da un laboratorio che lavorava in parallelo sullo stesso problema.

In genomica, lavorando per oltre una settimana in autonomia quasi totale, Mythos 5 ha assemblato dati su milioni di cellule da 138 specie animali e ha addestrato un modello capace di battere un sistema pubblicato sulla rivista Science, pur essendo cento volte più piccolo.

I freni e la prova del jailbreak

Anthropic ha lavorato alle protezioni del modello con operazioni di "red-teaming", cioè di attacco simulato per trovarne le falle. L'azienda ha avviato un programma di ricompense per chi riuscisse a bucare il sistema: oltre mille ore di tentativi non hanno prodotto alcun jailbreak universale, cioè nessun trucco capace di aggirare in modo generalizzato i filtri. Anche i gruppi esterni incaricati di forzare il modello sono usciti a mani vuote.

"È probabilmente impossibile prevenire del tutto i jailbreak universali", scrive Anthropic, spiegando che l'obiettivo è renderli abbastanza lenti e costosi da poterli individuare prima che vengano sfruttati su larga scala. Quando i filtri sono attivi in modalità di blocco, Fable 5 segna zero progressi sui test di cyberattacco offensivo, contro punteggi ben più alti del modello senza protezioni.

A completare il quadro c'è una nuova politica sui dati. Per Fable 5, Mythos 5 e i futuri modelli di pari livello, Anthropic introduce una conservazione obbligatoria di trenta giorni del traffico, sia sui propri canali sia su quelli di terze parti.

Quei dati, assicura, non serviranno ad addestrare nuovi modelli ma solo a difendersi da attacchi e a ridurre i falsi allarmi, con accesso umano tracciato e cancellazione al termine del periodo.

Da Glasswing a Fable: la rincorsa delle ultime settimane

L'esistenza di Mythos è emersa a fine marzo da una falla di configurazione che aveva esposto alcune bozze interne, costringendo l'azienda ad anticipare i tempi dell’annuncio del modello.

Il 7 aprile scorso Anthropic ha presentato ufficialmente Claude Mythos Preview, scegliendo di non distribuirlo al pubblico e di affidarlo invece a Project Glasswing, un'iniziativa per mettere in sicurezza il software critico del mondo. Tra i partner della prima ora figuravano Amazon, Apple, Google, Microsoft, CrowdStrike, NVIDIA, JPMorgan Chase e Palo Alto Networks. E nessuna azienda europea,

L'annuncio ha scatenato una reazione inquieta. Il segretario al Tesoro statunitense Scott Bessent e il presidente della Federal Reserve Jerome Powell hanno convocato d'urgenza i vertici delle grandi banche per discutere i rischi del modello.

La Commissione europea ha chiesto e ottenuto l'accesso dopo mesi di pressioni. In India diverse agenzie governative sono state coinvolte nei test.

Secondo il Financial Times, perfino la NSA avrebbe iniziato a usare Mythos per operazioni cyber offensive, nonostante il Dipartimento della Difesa abbia etichettato Anthropic come "rischio per la catena di approvvigionamento", in seguito allo scontro del suo amministratore delegato, Dario Amodei, con il Dipartimento della Difesa USA, che intende utilizzare Claude per “tutti gli scopi leciti” senza cedere alle eccezioni richieste dall’azienda di San Francisco: no alle armi autonome, no alla sorveglianza di massa.

Non tutti, però, hanno gridato all'apocalisse: diversi esperti di sicurezza hanno osservato che molte delle vulnerabilità trovate da Mythos erano replicabili anche con modelli pubblici, parlando più di un'accelerazione che di una rottura.

Nelle settimane successive Project Glasswing è cresciuto da una cinquantina di organizzazioni a circa duecento, distribuite in più di quindici Paesi e in settori come energia, sanità, acqua e telecomunicazioni.

Lungo questo percorso i partner hanno usato Mythos Preview per individuare oltre diecimila vulnerabilità di gravità alta o critica. È il banco di prova da cui nasce la scommessa di oggi: estendere quelle capacità al pubblico, ma sotto controllo.

Prezzi e disponibilità

Sul piano commerciale, Anthropic ha dimezzato i costi rispetto a Mythos Preview.

Fable 5 e Mythos 5 costano dieci dollari per milione di token in ingresso e cinquanta per milione in uscita.

Gli sviluppatori possono già usare Fable 5 tramite API, mentre Mythos 5 - il gemello senza freni sulla cybersicurezza - resta riservato ai partner di Glasswing e a un gruppo selezionato di ricercatori in biologia, in attesa che parta un programma di accesso più strutturato, sviluppato insieme al governo statunitense.

Per gli abbonati, il debutto è scaglionato. Da oggi al 22 giugno Fable 5 è incluso senza costi aggiuntivi nei piani Pro, Max, Team ed Enterprise a postazione. Dal 23 giugno verrà rimosso e il suo utilizzo richiederà crediti dedicati, in attesa di un reintegro che l'azienda promette il più rapido possibile. Una cautela che si basa su una previsione piuttosto logico: la domanda sarà altissima e probabilmente difficile da soddisfare.