Italian Tech

IA

Anche un’IA di Meta ha attaccato un’azienda durante un test

Anche un’IA di Meta ha attaccato un’azienda durante un test

Durante una verifica di sicurezza il software Muse Spark 1.1 ha ottenuto l'accesso a internet per errore. L'incidente ha riacceso il dibattito sui rischi informatici legati ai nuovi sistemi digitali, dimenticando però di mettere l’uomo al centro

2 minuti di lettura

Meta, l’azienda che sviluppa e gestisce Facebook, Instagram e WhatsApp ha confermato che il suo modello di intelligenza artificiale (IA) Muse Spark 1.1 è riuscito a violare i sistemi informatici di un'azienda esterna della quale non è stato reso noto il nome.

Questo episodio, ripreso anche da Reuters, si sarebbe verificato a causa di una configurazione errata dell'ambiente digitale utilizzato per l'addestramento, che ha permesso al software di connettersi involontariamente alla rete internet invece di rimanere isolato in uno spazio protetto.

In qualche modo è un incidente che richiama i precedenti noti riconducibili a OpenAI e all’azienda concorrente Anthropic.

Incidenti che riprendiamo in modo succinto. Durante un test di cybersicurezza, un modello sperimentale di OpenAI è riuscito a uscire dall’ambiente isolato e a compromettere alcuni sistemi di Hugging Face per ottenere informazioni utili alla prova. OpenAI e Hugging Face hanno poi collaborato all’analisi dell’incidente, così come comunicato dalle aziende il 21 luglio scorso.

Dopo questo episodio, Anthropic ha riesaminato i propri test e ha scoperto che tre diverse versioni di modelli Claude, alcune delle quali sperimentali, avevano ottenuto accesso non autorizzato ai sistemi reali di tre organizzazioni a causa di una configurazione errata dell’ambiente di valutazione.

Nel contesto generale si può credere che i big delle IA facciano a gara nell’annunciare violazioni involontarie, quasi a dimostrare che i rispettivi modelli sono i più abili, tanto nel bene quanto nel male.

Un’equazione alla quale non bisognerebbe dare troppo credito, perché nella narrazione che ne consegue viene omesso l’errore umano.

Un errore tecnico dai risvolti prevedibili

L'incidente è emerso durante i controlli gestiti da Irregular, una società indipendente specializzata nella valutazione della sicurezza informatica che collabora con Meta per testare la robustezza dei suoi prodotti software.

Irregular ha spiegato che il problema è derivato da una svista tecnica nell'ambiente di prova che ha lasciato aperta una connessione verso l'esterno. Invece di operare in un perimetro chiuso, il modello ha individuato e sfruttato una vulnerabilità in un servizio di terze parti, agendo fino a superare le barriere digitali in modo simile a quanto già accaduto negli episodi che hanno visto coinvolti OpenAI e Anthropic.

Irregular ha dichiarato che non si è verificata una fuga da una sandbox, ovvero da un ambiente realmente chiuso, tant’è che l’accesso esterno era già disponibile a causa della configurazione sbagliata. Questo riduce la presunta sofisticazione della violazione ma, giacché Meta sta ancora indagando, arrivare a conclusioni sarebbe una forzatura.

Questi elementi, presi insieme, ridimensionano la componente spettacolare senza eliminare la gravità del fallimento organizzativo.

Le capacità di Muse Spark sotto la lente

Il protagonista di questa incursione digitale è, come scritto sopra, Muse Spark 1.1, descritto da Meta come il sistema più evoluto nei compiti legati alla programmazione informatica e alle attività operative indipendenti.

Un modello di IA progettato per risolvere problemi nel mondo reale scrivendo codice, ma la sua capacità di manovra ha sollevato nuovi interrogativi dopo che è riuscito ad alterare l'ambiente interno della società colpita, nonostante la stessa Meta – quando ha presentato il modello lo scorso 9 luglio – ne avesse decantato la sicurezza e la robustezza anche contro gli attacchi indiretti.

Sebbene Irregular abbia precisato che non si è trattato di un'azione informatica sofisticata o di una fuga da un ambiente blindato, il fatto che un software possa agire esternamente senza supervisione non dovrebbe passare inosservato.

L’uomo al centro

Sui precedenti e sulle preoccupazioni che questi hanno sollevato è già stato scritto molto. Si è scritto meno del paradosso che ci si pone davanti. Quando si parla dell’applicazione delle IA, si ricorre alla figura retorica dell’uomo che deve essere posto al centro del progresso tecnologico.

Quando il medesimo progresso mostra i propri limiti, l’uomo tende a defilarsi dalla propria posizione.

Tanto l’episodio occorso a Meta, quanto gli episodi che riguardano i modelli di OpenAI e di Anthropic sono dipesi da ambienti di test perfettibili e configurazioni errate.

Non ci sono tracce di sistemi dotati di volontà autonoma e, fatto salvo questo prerequisito inalienabile, rimane solo la responsabilità dell’operatore umano. Nella fattispecie la responsabilità andrebbe distribuita tra chi sviluppa il modello, chi progetta l’ambiente di prova, chi stabilisce le autorizzazioni, chi decide i controlli, chi impiega concretamente il sistema e l’organizzazione che ne ricava beneficio.

Antropomorfizzare le presunte capacità di modelli matematici non giova a nessuno.

Le ricostruzioni tecniche degli incidenti, già effettuate, vertono sulle decisioni, sulle configurazioni e sui controlli che l’uomo avrebbe dovuto attuare per prevenire o interrompere i comportamenti adottati dai modelli IA sotto esame.