Italian Tech

Intelligenza artificiale

ChatMinerva, arriva il primo assistente IA italiano

ChatMinerva, arriva il primo assistente IA italiano

Sviluppato alla Sapienza di Roma, è il primo modello italiano di IA generativa creato da un’università pubblica. Può dialogare con l'utente, scrivere testi, comprendere immagini. Ed è totalmente gratuito

3 minuti di lettura

Un modello di IA generativa al 100% italiano, sviluppata all'interno di una delle università più importanti del nostro Paese. Si chiama ChatMinerva, l'evoluzione del Large Language Model ideato e progettato dal gruppo di ricerca NLP della Sapienza di Roma, guidato dal professor Roberto Navigli. La risposta tricolore ai colossi americani come ChatGPT e Gemini? L'accostamento è corretto in termini di tecnologia di riferimento, ma improprio per capitali investiti e capacità di calcolo. Se negli Stati Uniti l'innovazione tecnologica passa principalmente nelle mani delle big tech, in Italia la ricerca si porta avanti – con non poche difficoltà correlate ai finanziamenti dei progetti- ancora nei laboratori accademici.

ChatMinerva, che è aperto a tutti e si può già testare gratuitamente (basta registrarsi con nome utente e password), è un assistente IA multimodale progettato per comprendere testi, immagini e documenti, accedere al Web in tempo reale e dialogare in italiano con maggiore affidabilità. Questo esempio eccellente, nato in un contesto pubblico, continua a rappresentare una delle principali iniziative italiane nel campo dei Large Language Model sviluppati con controllo diretto sulle fonti e sul training.

“Dobbiamo comprendere che il mondo sta cambiando molto rapidamente e non investire fortemente nell'IA significa mettere a rischio la nostra capacità di innovazione e competizione sul mercato globale”, ci spiega Roberto Navigli, responsabile del progetto che abbiamo raggiunto al telefono.

“Allo stesso tempo, possiamo e dobbiamo sfruttare il nostro ingegno e le nostre capacità scientifiche e tecnologiche per andare oltre e creare l'IA di prossima generazione. Su entrambi gli aspetti, ChatMinerva rappresenta il perfetto playground per lavorare alla tecnologia del futuro”.

Dietro le quinte di questa nuova release c'è un importante salto di qualità infrastrutturale e metodologico rispetto al precedente modello Minerva 7B. La nuova versione dell’LLM Minerva è stata infatti sottoposta a un ampio processo di fine-tuning attraverso milioni di esempi di istruzioni, sia testuali che multimodali. Un risultato reso possibile dalla potenza di calcolo del supercomputer Leonardo del CINECA, impiegato per tutti i processi di addestramento. Fondamentale, però, è stato anche il contributo diretto dell'ampia comunità di utenti: le interazioni raccolte durante l’utilizzo pubblico di Minerva 7B hanno permesso di migliorare le capacità conversazionali del sistema e la qualità delle risposte.

Un'evoluzione che sposta l'asse della ricerca universitaria verso l'impatto sociale, come sottolinea la rettrice della Sapienza, Antonella Polimeni: “L’evoluzione del progetto verso assistenti IA multimodali e interattivi conferma la capacità della Sapienza di trasformare la ricerca di frontiera in innovazione concreta, al servizio della conoscenza e della società. Questo risultato nasce dall’integrazione tra competenze scientifiche, infrastrutture avanzate e collaborazione con realtà innovative del territorio, rafforzando il ruolo di Sapienza come motore strategico della ricerca e dell’innovazione tecnologica nel Paese.”

Ma cosa cambia, all'atto pratico, per chi usa la piattaforma? Sulla carta ChatMinerva fa quello che qualsiasi modello AI evoluto è in grado di fare. Le novità principali si sviluppano attorno a quattro pilastri fondamentali, a partire da una rinnovata comprensione multimodale. Il modello è ora in grado di combinare informazioni visuali e testuali, effettuare il riconoscimento ottico dei caratteri (OCR) su testi scansionati e persino interagire vocalmente con l'utente.

A questa flessibilità si affianca l’accesso al Web in tempo reale: grazie a un sistema di Web RAG che interroga la rete sfruttando il motore di ricerca aperto DuckDuckGo, ChatMinerva supera il limite dei dati pregressi per rispondere con informazioni sempre aggiornate.

Anche la gestione di documenti complessi ha fatto un importante passo avanti, poiché un processo di continual training ha permesso di estendere la finestra di contesto del modello fino a 32.000 token, consentendo così di elaborare testi molto lunghi e conversazioni prolungate senza mai perdere il filo del discorso.

Infine, l'intera esperienza è supportata da una maggiore sicurezza e moderazione, garantita da un componente dedicato che controlla e valida in tempo reale sia gli input dell’utente sia le risposte dell’IA, moderando tempestivamente qualsiasi contenuto indesiderato, non affidabile o sensibile.

“Minerva è cresciuta insieme ai suoi utenti. Ogni prompt, interazione e feedback hanno contribuito a costruire un assistente IA più utile, più robusto e più vicino alle esigenze reali delle persone”, evidenzia ancora Navigli. Secondo il professore, questo traguardo è cruciale perché si muove in tre direzioni: “Potenzia l'approccio open e controllabile con un focus sulla lingua italiana; permette di creare un know-how e un ecosistema tutto nostrano per un'IA agentica; infine, servirà come trampolino di lancio per la prossima generazione di sistemi a cui stiamo lavorando”.

Il futuro, del resto, corre veloce. Il team dell'università romana rilascia già oggi aggiornamenti e nuove funzionalità su base settimanale, ma lo sguardo è già rivolto oltre. Da un lato si sta strutturando Agentic Minerva, una nuova generazione di sistemi AI capaci di pianificare azioni e utilizzare strumenti in totale autonomia; dall'altro, sempre grazie al supporto del CINECA, è già in fase di addestramento un modello Minerva ancora più grande e potente.

“Vogliamo dimostrare che è possibile costruire tecnologia AI di frontiera anche in Europa e in Italia, con un approccio aperto, scientificamente rigoroso e indipendente”, prosegue Navigli. Come accennavamo, ChatMinerva è stato costruito “con molta più passione che budget, grazie al lavoro incessante di decine di ricercatori, dottorandi, studenti e collaboratori. Scienziati che credono nella possibilità di creare una tecnologia AI italiana competitiva, pur nascendo in un contesto distante da quello dei Big Tech della Silicon Valley. La forza sta tutta nella collaborazione”. Non resta altro che provarla.