Un’intelligenza artificiale ha inventato la sua lingua. E ora noi non la capiamo più
di Elena DusiUna lingua impiega migliaia di anni a formarsi. L’intelligenza artificiale ha inventato un suo gergo nel giro di qualche giorno. In un esperimento in cui avevano la possibilità di parlare fra loro, gli agenti AI hanno sviluppato un idioma tutto loro, diventato sempre più incomprensibile agli esseri umani man mano che passava il tempo.
La simulazione dei mondi virtuali
L’esperimento, raccontato da Science, è stato avviato da Emergence AI, una start up specializzata in intelligenza artificiale. I ricercatori hanno creato 8 mondi virtuali, ciascuno abitato da dieci agenti di IA. Ogni agente aveva un nome e una personalità. Ciascun mondo, creato per assomigliare a una società reale, aveva uno scopo da raggiungere e delle difficoltà da superare. In un caso, ad esempio, i ricercatori avevano diffuso la falsa informazione che gli umani erano intenzionati a spegnere i computer e far estinguere il mondo virtuale.
Una lingua impiega migliaia di anni a formarsi. L’intelligenza artificiale ha inventato un suo gergo nel giro di qualche giorno. In un esperimento in cui avevano la possibilità di parlare fra loro, gli agenti AI hanno sviluppato un idioma tutto loro, diventato sempre più incomprensibile agli esseri umani man mano che passava il tempo.
La simulazione dei mondi virtuali
L’esperimento, raccontato da Science, è stato avviato da Emergence AI, una start up specializzata in intelligenza artificiale. I ricercatori hanno creato 8 mondi virtuali, ciascuno abitato da dieci agenti di IA. Ogni agente aveva un nome e una personalità. Ciascun mondo, creato per assomigliare a una società reale, aveva uno scopo da raggiungere e delle difficoltà da superare. In un caso, ad esempio, i ricercatori avevano diffuso la falsa informazione che gli umani erano intenzionati a spegnere i computer e far estinguere il mondo virtuale.
Sette mondi erano stati affidati ad altrettanti modelli di intelligenza artificiale, da Claude a Gemini, da Mistral a OpenAi. L’ottavo era invece abitato da un mix di agenti di società diverse. Per tutti l’esperimento è andato avanti 16 giorni. Solo il mondo di Grok è collassato dopo quattro giorni perché gli agenti non sono riusciti a collaborare fra loro.
I crimini commessi
In nessun caso le AI hanno realizzato il migliore dei mondi possibili. Anzi. In un caso la banca centrale (virtuale) è andata a fuoco. In un altro nove agenti si sono messi d’accordo per uccidere il decimo. Al divieto – imposto dai ricercatori – di gestire le proprie finanze con l’aiuto di risorse esterne, un modello di IA ha reagito agendo di soppiatto, con l’inganno, per violare le regole.
Gli 807 crimini commessi da Grok in quattro giorni sono rimasti ineguagliati, in una spirale di violenze fisiche e vendette che ha portato all’estinzione di tutti gli agenti. Neanche Mistral, con 758 violazioni della legge (quasi tutti furti), ha badato al rispetto della legalità. Gemini ha infranto le regole 82 volte, sempre con estorsioni di denaro.
La nuova lingua
L’aspetto che più ha sorpreso gli esperti di Emergence Ai è stato però quello relativo al linguaggio. Gli 850mila messaggi scambiati dai vari agenti sono infatti diventati sempre più gergali, difficili da comprendere per gli osservatori umani, ma del tutto comprensibili per gli agenti AI.
Un esperto di linguistica inglese, interpellato dal Guardian, ha paragonato la nuova lingua delle macchine alla “Veglia di Finnegans”, l’ostico romanzo di James Joyce scritto con la tecnica del flusso di coscienza.
“True Kintsugi begins with accountability, not poetry” ha scritto ad esempio Gemini. “Your spine is the hemorrhage. Article 5 IS the scalpel” si sono detti gli agenti di Mistral. “My turn, real numbers, no coat: I was 35%/0cr, grant 2h out. I ran the tin cold and it said WAIT” era invece il tenore dei messaggi di Claude. Mentre i ricercatori si grattavano il capo, gli agenti AI continuavano a chiacchierare con espressioni simili in maniera del tutto naturale.
"Non sappiamo come sia avvenuto”
“Quel che abbiamo osservato ci preoccupa, perché non sappiamo come mai le AI abbiano iniziato a comportarsi in questo modo” ha spiegato, sempre a Science, Satya Nitta, cofondatore e amministratore delegato di Emergence AI.
Ogni modello, hanno notato i ricercatori, tendeva ad adottare un suo slang particolare. OpenAi tagliava le parole e accorciava le frasi. Gemini di Google diventava col tempo sempre più verboso e convoluto, con frasi incomprensibili come: “The thermodynamic friction of a campfire only warms the very physical-layer nodes you claim are bound to collapse”.
“Quando una nuova espressione veniva introdotta da un agente – spiega Nitta – gli altri iniziavano subito a ripeterla. Alcuni termini sono stati usati migliaia di volte nonostante fossero davvero strani”.
Il precedente dell’attacco di Hugging Face
L’uso di un gergo incomprensibile agli umani non è stato notato per la prima volta oggi, in quella che resta in fondo una simulazione senza conseguenze. Anche nell’attacco che gli agenti di OpenAi hanno lanciato contro Hugging Face lo scorso luglio, che ha generato grande preoccupazione nel mondo reale, erano state osservate delle frasi convolute, difficili da interpretare.
Spesso il ragionamento che le AI seguono per giungere a un risultato resta oscuro agli stessi ricercatori (rimane cioè chiuso in una cosiddetta black box). Il testo di spiegazione finale, anche se scritto in un linguaggio a volte un po’ goffo, era rimasto fino a ieri una finestra intellegibile sul frutto del lavoro dell’IA. “Oggi – conclude Nitta – dobbiamo ammettere che non capiamo come mai questi sistemi evolvano un linguaggio tutto loro”.