Alcune conversazioni che gli utenti intrattengono con ChatGpt vengono esaminate da centinaia di revisori umani incaricati di valutare e migliorare le risposte prodotte dall’IA. Questo è il cuore del programma voluto da OpenAI, battezzato Project Lily e portato alla luce da un’inchiesta pubblicata da 404 Media, basata su documenti interni, istruzioni operative, canali di lavoro e prompt reali visionati dalla testata americana.
I revisori ricevono conversazioni prive del nome associato all’account, ne ricostruiscono la richiesta principale e giudicano diverse risposte generate da ChatGpt.
Alcuni prompt, tuttavia, conserverebbero riferimenti personali, informazioni sensibili e riepiloghi delle memorie accumulate durante precedenti interazioni con lo stesso utente.
OpenAI afferma di sottoporre i testi a un programma chiamato Privacy Filter prima di mostrarli ai collaboratori. La società riconosce anche che questo filtro può commettere errori. L’inchiesta documenta quindi un rischio concreto, senza dimostrare che tutte le conversazioni siano lette da persone. Restano sconosciuti il numero complessivo dei prompt esaminati, i criteri con cui vengono scelti e la percentuale degli utenti coinvolti.
Project Lily, cosa fanno i revisori
Stando a quanto ricostruito, il lavoro si divide in tre passaggi. Il revisore legge il prompt o la conversazione dell’utente, scrive un breve riepilogo dell’obiettivo perseguito e confronta quattro risposte generate da ChatGpt. Ogni risposta riceve un voto da uno a sette e una motivazione che individua gli elementi adeguati o che mostrano aspetti e risvolti problematici.
I revisori valutano accuratezza apparente, utilità, chiarezza, tono e stile. Devono segnalare, per esempio, risposte eccessivamente lunghe, uso artificioso delle emoji, imitazione troppo marcata del linguaggio dell’utente e formulazioni che attribuiscono al chatbot esperienze o emozioni umane.
Una parte delle indicazioni mira a ridurre la sycophancy, ossia è la tendenza di un modello ad adulare e ad assecondare l'utente e dargli ragione anche quando ha torto, invece di correggerlo.
I revisori hanno un compito tipicamente valutativo e questo, detto a chiare lettere, significa che le valutazioni prodotte da esseri umani (i revisori) vengono impiegate da OpenAI per correggere il comportamento dei modelli IA o per misurarne l’effettiva qualità.
Come vengono elaborati i dati degli utenti
OpenAI ha dichiarato a 404 Media che le conversazioni vengono elaborate attraverso un filtro (Privacy Filter) prima di raggiungere i revisori. Si tratta di un modello specializzato nell’individuazione e nell’oscuramento di nomi, indirizzi, numeri di telefono, email, coordinate bancarie, password e altre informazioni potenzialmente in grado di risalire a una persona specifica.
La documentazione tecnica pubblicata da OpenAI precisa che Privacy Filter può essere fallace, interpretare male riferimenti ambigui oppure oscurare una quantità eccessiva o insufficiente di testo. Le prestazioni possono inoltre variare tra lingue, alfabeti e contesti differenti. La stessa OpenAI chiarisce che il programma costituisce uno strumento di filtraggio e non garantisce, da solo, l’anonimizzazione completa o la conformità alle norme sulla protezione dei dati.
Questa distinzione è decisiva. Togliere il nome dell’account riduce la possibilità di identificare immediatamente una persona, mentre dettagli su professione, città, familiari, salute o vicende molto specifiche possono renderla riconoscibile attraverso il contesto.
OpenAI sostiene che l’accesso sia limitato. Le FAQ sull’uso dei dati dei servizi destinati ai consumatori dichiarano che un numero ristretto di dipendenti autorizzati e fornitori sottoposti a obblighi di riservatezza può consultare i contenuti per investigare abusi, offrire assistenza, gestire questioni legali o migliorare le prestazioni dei modelli.
Inoltre, aggiunge OpenAI, gli accessi alle conversazioni degli utenti sono controllati, registrati e concessi soltanto al personale autorizzato. La medesima pagina invita esplicitamente gli utenti a evitare l’inserimento di informazioni sensibili che preferirebbero sottrarre a una possibile revisione.
Il problema della trasparenza
La pratica della revisione umana è comune nell’industria delle IA. Infatti, anche Google informa che alcune conversazioni con Gemini possono essere sottoposte a revisione umana per migliorare il servizio e Anthropic prevede la raccolta e l'utilizzo dei feedback degli utenti su Claude attraverso impostazioni dedicate.
Benché gli utenti possano disattivare l'uso delle conversazioni per l'addestramento dei modelli, i dialoghi intercorsi prima di tale scelta non cessano automaticamente di far parte del patrimonio informativo raccolto dalle aziende che sviluppano intelligenza artificiale.
Va anche aperto un sottocapitolo perché gli utenti tendono a rilevare ai modelli IA questioni delicate e personali. Il termine che trova posto al fianco di questa attitudine è economia dell’intimità ed è più che utile all’industria delle IA per raggiungere una targetizzazione pubblicitaria financo superiore a quella dei social network, proprio perché gli utenti tendono a confidare ai chatbot ciò che non scriverebbero online.
E questo elemento, che non può soltanto essere confinato alle necessità di verifica e di miglioramento lamentate in questo caso da OpenAI, dovrebbe spingere le aziende che ne fanno uso a dichiarare la dimensione dei programmi, le regole di selezione delle conversazioni, i Paesi nei quali queste verifiche umane sono in auge e il numero di utenti interessati.
La situazione in Italia e in Europa
Per gli utenti europei, l’informativa privacy di OpenAI include i prompt, i file e gli altri contenuti caricati tra i dati personali raccolti. L’azienda dichiara di poterli utilizzare per migliorare i servizi e di poterli comunicare a fornitori incaricati di svolgere attività per suo conto.
In Italia il trattamento dei dati da parte di ChatGpt era già stato oggetto di un procedimento del Garante per la protezione dei dati personali. Nel 2024 l’Autorità aveva contestato a OpenAI carenze relative alla base giuridica e alla trasparenza, imponendo una sanzione da 15 milioni di euro.
Sul sito web del Garante si legge che, a marzo del 2026, il Tribunale di Roma ha accolto l’opposizione di OpenAI e che il provvedimento sanzionatorio è stato rimosso. Un procedimento che, in realtà, riguardava questioni più ampie rispetto a Project Lily e che, di fatto, ingloba anche i problemi che questo progetto solleva.
Al momento attuale, non risulta che un’autorità europea preposta abbia sancito l’illegittimità di Project Lily.