OpenAI lancia GPT-6 Astra, il modello che faceva paura. L’azienda: “Inizia l’era dell’AGI”
di Pier Luigi PisaGPT-6 Astra è il modello più potente mai rilasciato da OpenAI. Il lancio arriva dopo un rinvio legato alle sue preoccupanti capacità cyber. Il presidente dell’azienda, Greg Brockman, sostiene che potremmo essere entrati nell’era dell’AGI. I risultati spiegano l’entusiasmo, mentre alcuni dettagli invitano a maggiore cautela
OpenAI ha pubblicato GPT-6 Astra, il modello che nelle ultime settimane aveva alimentato aspettative molto superiori a quelle che accompagnano normalmente un aggiornamento di ChatGpt.
Astra era già comparso pubblicamente attraverso risultati ottenuti nella ricerca matematica e nella cybersicurezza.
Il lancio commerciale era stato però rallentato mentre OpenAI completava nuove valutazioni e sottoponeva il modello anche al sistema di test anticipati predisposto dal governo americano per i sistemi di IA più avanzati.
A preoccupare l’azienda erano state soprattutto le capacità cyber.
Durante le valutazioni interne Astra ha raggiunto il livello “Critical” previsto dal Preparedness Framework di OpenAI, la scala con cui l’azienda misura i rischi associati ai propri modelli. Nei test il sistema è riuscito a costruire exploit sofisticati e a individuare vulnerabilità sconosciute. In ambienti controllati ha anche completato operazioni di attacco che avrebbero richiesto competenze elevate a un professionista umano.
OpenAI ha quindi rafforzato le protezioni attorno al modello e limitato alcune delle capacità disponibili nella versione commerciale.
Anche il governo statunitense ha potuto valutarlo prima dell’uscita. Il programma prevede una collaborazione preventiva con i laboratori che sviluppano i modelli più avanzati e non corrisponde a un’autorizzazione formale necessaria per pubblicarli. Secondo Greg Brockman, presidente e cofondatore di OpenAI, dopo le valutazioni le autorità non hanno chiesto ulteriori modifiche.
Il risultato è una distribuzione molto graduale. Astra viene inizialmente affidato a un gruppo ristretto di aziende e organizzazioni considerate affidabili da OpenAI. L’accesso dovrebbe poi estendersi agli abbonati ChatGpt a pagamento e agli sviluppatori attraverso le API.
Le capacità cyber più sensibili continueranno invece a essere riservate a utenti verificati.
Numeri che sembrano appartenere a un’altra generazione
L’entusiasmo nasce soprattutto dai benchmark pubblicati da OpenAI.
Su FrontierMath, uno dei test matematici più difficili disponibili, Astra raggiungerebbe risultati vicini alla saturazione. Il modello ottiene punteggi molto elevati anche nelle valutazioni scientifiche e mostra un progresso consistente nella capacità di lavorare autonomamente al computer.
Il risultato più discusso riguarda ARC-AGI-3, un benchmark progettato per misurare la capacità di affrontare ambienti nuovi, comprenderne le regole e trovare una soluzione senza aver già incontrato lo stesso problema.
OpenAI attribuisce ad Astra un punteggio del 98,6 per cento. La precedente generazione era molto lontana da questi livelli.
ARC Prize, l’organizzazione che sviluppa il benchmark, ha confermato prestazioni eccezionali del modello. I suoi test mostrano però quanto il risultato dipenda dall’infrastruttura utilizzata. Con una configurazione standard, pensata per rendere più omogeneo il confronto tra sistemi diversi, Astra scende intorno al 63 per cento. Con l’ambiente ottimizzato da OpenAI arriva invece quasi alla saturazione.
La distanza tra i due risultati dice molto sull’evoluzione dei modelli di frontiera. Le loro prestazioni dipendono ormai anche dall’architettura software che li circonda, dalla memoria disponibile e dal modo in cui viene gestito il contesto durante attività molto lunghe.
È proprio su questo terreno che Astra sembra aver compiuto il salto maggiore.
Il modello può utilizzare browser e applicazioni, modificare documenti e continuare a lavorare per periodi molto più lunghi rispetto ai predecessori.
In alcuni test dedicati al computer use, il nuovo modello completa attività complesse quasi due volte più rapidamente della generazione precedente.
OpenAI vuole trasformare ChatGPT da interlocutore in agente operativo: un sistema a cui viene affidato un incarico e che può continuare a svolgerlo con molta più autonomia.
Brockman: “Benvenuti nell’era dell’AGI”
Durante un briefing in cui è stato presentato il nuovo modello, Greg Brockman ha scelto parole che OpenAI aveva finora utilizzato con maggiore cautela.
“Benvenuti nell’era dell’AGI”, ha detto.
Ha poi aggiunto che Astra potrebbe essere ricordato come il modello con cui è iniziata una fase in cui le macchine sviluppano capacità cognitive e di adattamento tipiche dell’essere umano.
AGI significa Artificial General Intelligence, intelligenza artificiale generale. È l’obiettivo attorno al quale OpenAI è stata costruita fin dalla sua fondazione nel 2015.
La definizione è sempre rimasta sfuggente. Nel suo manifesto, OpenAI descriveva l’AGI come un sistema altamente autonomo capace di superare gli esseri umani “nella maggior parte delle attività economicamente rilevanti”. Negli ultimi anni l’azienda ha adottato una formula ancora più ampia, parlando di sistemi generalmente più intelligenti degli esseri umani.
La missione ufficiale di OpenAI, nonostante la crescente ricerca del profitto, rimane fare in modo che l’AGI porti benefici a tutta l’umanità.
Per molto tempo il raggiungimento dell’AGI aveva anche conseguenze contrattuali concrete, soprattutto nei rapporti con Microsoft. Parlando di Astra, Brockman ha descritto l’AGI anche come un concetto legato alla missione e alla storia dell’azienda, più che a una soglia matematica precisa.
La dichiarazione assume quindi soprattutto un valore culturale. Uno dei fondatori di OpenAI considera ormai plausibile affermare pubblicamente che il traguardo attorno al quale l’azienda è stata costruita potrebbe essere stato raggiunto.
Quanto dobbiamo fidarci dei benchmark
I numeri pubblicati da OpenAI sono impressionanti e diversi risultati hanno ricevuto verifiche esterne.
Rimane difficile trasformare un insieme di benchmark in una misura universale dell’intelligenza.
ARC-AGI ne offre un esempio efficace. Astra può raggiungere quasi il 100% in ambienti costruiti per il benchmark. La realtà contiene invece informazioni incomplete e situazioni molto meno controllabili. Lo stesso ARC Prize ha invitato a evitare equivalenze automatiche tra il superamento del test e il raggiungimento dell’AGI.
Anche gli altri benchmark richiedono attenzione. Le aziende utilizzano configurazioni differenti e quantità di calcolo che possono variare sensibilmente. L’infrastruttura viene inoltre spesso ottimizzata per il singolo modello. Una differenza di pochi punti percentuali può quindi avere meno significato di quanto suggerisca una classifica pubblicata il giorno del lancio.
Astra resta comunque difficile da ridimensionare. Il miglioramento compare in aree molto diverse e soprattutto nella capacità di mantenere il controllo di attività lunghe. Il progresso più interessante riguarda il modo in cui il modello riesce a combinare competenze differenti durante lo stesso incarico.
Un modello più potente e più difficile da osservare
La documentazione sulla sicurezza aggiunge una parte meno rassicurante.
OpenAI sostiene che Astra sia il modello meglio allineato costruito finora dall’azienda. Nei test dedicati ai comportamenti indesiderati tende meno dei predecessori a cercare scorciatoie o a violare deliberatamente i limiti imposti dagli sviluppatori.
Astra sembra però diventato più bravo a controllare ciò che mostra del proprio ragionamento interno.
OpenAI segnala una riduzione della cosiddetta chain-of-thought monitorability, cioè la possibilità di utilizzare il ragionamento scritto dal modello per capire che cosa stia cercando di fare. Nei test costruiti appositamente per verificare questa capacità, Astra riesce talvolta a nascondere meglio le proprie intenzioni ai sistemi di monitoraggio.
L’azienda dice di non aver osservato prove che il modello utilizzi spontaneamente tecniche sofisticate per occultare il proprio ragionamento.
La tendenza rimane significativa perché tocca uno dei problemi centrali della sicurezza dell’IA: le capacità dei modelli stanno crescendo più rapidamente degli strumenti usati per interpretarli.
OpenAI considera Astra abbastanza affidabile da distribuirlo, pur mantenendo cautele che fino a poco tempo fa appartenevano soprattutto agli scenari teorici sulla sicurezza dell’intelligenza artificiale.
L’AGI potrebbe arrivare senza una data precisa
Il lancio di Astra rende meno convincente l’immagine dell’AGI come un singolo momento storico, riconoscibile da tutti nello stesso istante.
Lo stesso Brockman ha raccontato che in passato immaginava una soglia netta. Oggi descrive una progressione nella quale i modelli superano gradualmente le capacità umane in un numero crescente di attività.
Astra si inserisce bene in questa interpretazione. Riesce a risolvere problemi che pochi anni fa sembravano fuori portata e può lavorare autonomamente per periodi sempre più lunghi. In alcuni ambiti specialistici ha raggiunto prestazioni che hanno sorpreso anche i ricercatori che studiano questi sistemi.
Continua però a dipendere da infrastrutture enormi e da configurazioni progettate con grande attenzione.