✕

L’imbarazzo di OpenAI per i problemi matematici che Gpt-5 non ha davvero risolto

OpenAI è finita al centro delle critiche dopo aver annunciato che Gpt-5 ha risolto dieci problemi di Erdos. In realtà il modello aveva solo recuperato soluzioni già note. Così il presunto trionfo si è trasformato in una figuraccia epica

2 minuti di lettura

“Gpt-5 ha appena trovato la soluzione a 10 (!) problemi irrisolti di Erdos e ha fatto progressi nella soluzione di altri 11 quesiti”

Con questo messaggio entusiasta, Kevin Weil - supervisore della ricerca scientifica di OpenAI - aveva annunciato, lo scorso 17 ottobre, quella che sembrava una scoperta straordinaria.

Laureato in fisica e matematica ad Harvard, Weil aveva rilanciato sul social X un post di Mark Sellke, uno dei ricercatori di OpenAI, secondo cui l’ultimo e più potente modello di intelligenza artificiale di dell’azienda, Gpt-5, era riuscito a risolvere dieci problemi matematici rimasti irrisolti del celebre Paul Erdos, autore simbolo di alcuni dei rompicapi più complessi della matematica moderna.

L’annuncio è stato accolto come un nuovo, miracoloso passo in avanti dell’intelligenza artificiale. Ma nel giro di poche ore l’entusiasmo si è trasformato in imbarazzo: ciò che appariva come una conquista scientifica senza precedenti si è rivelato una colossale “epic fail”, una clamorosa figuraccia tanto tecnologica quanto comunicativa.

A spengere l’entusiasmo è stato Thomas Bloom, matematico e curatore del sito erdosproblems.com, dedicato proprio alle congetture di Erdos.

Rispondendo sui social all’annuncio di Weil, Bloom ha accusato OpenAI di una “clamorosa distorsione” del risultato ottenuto da GPT-5. Secondo l’esperto, il modello non aveva risolto alcun problema, ma aveva semplicemente individuato riferimenti a soluzioni già pubblicate in articoli scientifici di cui lui stesso non era a conoscenza. I quesiti apparivano come “aperti” sul suo sito, infatti, non perché fossero realmente irrisolti, ma solo perché mancavano segnalazioni aggiornate di soluzioni già esistenti.

In pratica, GPT-5 non ha prodotto nuova conoscenza matematica: ha "solo” riconosciuto e recuperato ciò che era già noto, agendo più come un motore di ricerca estremamente sofisticato che come una mente in grado di elaborare nuove teorie.

Dopo le precisazioni di Bloom, anche all’interno di OpenAI sono arrivate le ammissioni.

Sebastien Bubeck, uno dei principali ricercatori dell’azienda, ha riconosciuto che il modello “ha trovato solo soluzioni già presenti”. Ciononostante, ha provato a salvare qualcosa dell’operato dell’IA, osservando: “So bene quanto sia difficile cercare nella letteratura scientifica”

Altri dipendenti di OpenAI, che avevano condiviso o amplificato l’annuncio, hanno poi rimosso i propri post e presentato pubbliche scuse. Lo stesso post originale di Weil è stato cancellato.

Una dura condanna di quanto accaduto è arrivata da Demis Hassabis, premio Nobel e leader di Google DeepMind, che ha definito l’intera vicenda “imbarazzante”.

In un periodo in cui le aspettative verso i modelli generativi sono alle stelle, con GPT-5 presentato inizialmente come un ulteriore passo verso una “intelligenza generale”, che in molti chiamano AGI, lo scivolone di OpenAI dimostra quanto fragile possa essere il confine tra innovazione autentica e marketing.

Gpt-5, in effetti, ha mostrato un’abilità notevole nel rintracciare informazioni sommerse, ma non ha portato un contributo originale al progresso matematico.

L’episodio è un monito per OpenAI - e per l’intero settore - su quanto facilmente l’hype possa trasformarsi in boomerang. Chi assiste da spettatore alla corsa all’IA in cui sono impegnate le principali big tech, invece, imparerà da questa storia che è sempre necessario maneggiare con attenzione e prudenza le promesse delle grandi aziende che sviluppano intelligenza artificiale.