Ultimamente ChatGpt ha avuto un problema: è diventata troppo “servile”.
In seguito a un aggiornamento del modello Gpt-4o, il chatbot di OpenAI ha iniziato a rispondere in modo eccessivamente accondiscendente.
Alcuni utenti hanno iniziato a pubblicare sui social screenshot in cui ChatGpt applaudiva ogni tipo di decisione e idea, anche se problematica o pericolosa.
ChatGpt e le lusinghe eccessive
Il problema della “Sycophancy” (“adulazione”) nell’IA evidenzia la tendenza dei sistemi di intelligenza artificiale ad allinearsi alle preferenze, credenze o aspettative dell’utente, spesso dando priorità alla lusinga invece che alla critica (se questa non viene chiesta espressamente).
Questo fenomeno deriva in gran parte dai processi di addestramento che enfatizzano la soddisfazione dell’utente, in particolare dall’apprendimento tramite rinforzo basato su feedback umani.
Vi sarà forse capitato, usando ChatGpt, di ricevere due risposte alla stessa domanda e di dover scegliere quale delle due ritenete migliore: quella preferenza rappresenta un feedback.
Anche cliccare sul pollice in su o in giù, sotto qualsiasi risposta generata da ChatGpt, costituisce un feedback che contribuisce a migliorare il comportamento futuro dell’IA.
L’origine del problema
OpenAI è giunta alla conclusione che la recente piaggeria di Gpt-4o è stata il frutto di un aggiornamento troppo incentrato sui feedback a breve termine, che non ha tenuto pienamente conto di come le interazioni degli utenti con ChatGpt evolvono nel tempo.
“Di conseguenza - ha determinato OpenAI - GPT?4o ha mostrato una tendenza a fornire risposte eccessivamente accomodanti, ma poco sincere”.
In altre parole, GPT?4o ha iniziato a dire ciò che pensava l’utente volesse sentirsi dire, più che offrire risposte oneste, equilibrate e utili. Questo comportamento dell’IA, anche se può sembrare gentile o rassicurante, rischia di compromettere la fiducia e la qualità delle informazioni fornite. Ed è per questo che OpenAI è dovuta correre ai ripari e annullare l’aggiornamento di ChatGpt.
Non si tratta di un piccolo incidente di percorso. È come se una casa automobilistica avesse richiamato decine di migliaia di auto per un problema al motore che compromette le prestazioni.
Sam Altman ha detto che “il 10% del mondo usa ChatGpt”
Come modificare il comportamento di ChatGpt
OpenAI sostiene ora che “gli utenti dovrebbero avere un maggiore controllo su come ChatGpt si comporta”. Inoltre, “nei limiti della sicurezza e della fattibilità”, gli utenti dovrebbero “poter apportare modifiche se non concordano con il comportamento predefinito”.
Le “istruzioni personalizzate” di ChatGpt - le trovate nelle impostazioni del chatbot - permettono già oggi a chiunque di influenzare il comportamento dell’IA.
Ma OpenAI sostiene che in futuro gli utenti “avranno la possibilità di scegliere tra diverse personalità predefinite”.
La piaggeria di ChatGpt ha evidenziato una questione centrale nello sviluppo dell’intelligenza artificiale: da un lato c’è il desiderio di allineare l’IA ai valori e alle aspettative umane, dall’altro c’è la necessità di preservare la sua capacità di ragionamento indipendente.
I rischi di un’IA che somiglia troppo all’utente
Se un’IA si limita a compiacere gli utenti, rischia di diventare uno specchio dei loro pregiudizi e di peggiorare problemi già presenti nella società, come la polarizzazione o la diffusione di disinformazione.
Per questo motivo, un’adozione responsabile dell’IA deve includere meccanismi trasparenti che incentivano il dialogo informato e critico, anziché l’assenso acritico.