Meta ha presentato Muse Image, il primo modello per la generazione di immagini sviluppato dal Meta Superintelligence Labs (MSL), la divisione che raccoglie gli sforzi più avanzati dell'azienda nel settore dell'AI.
Parallelamente ha mostrato anche Muse Video, il modello dedicato alla generazione di video, ancora in fase di anteprima ma destinato a diventare il naturale complemento di Muse Image.
L'obiettivo dichiarato è trasformare Meta AI in una piattaforma creativa multimodale capace di comprendere il linguaggio naturale e produrre immagini e, in futuro, video di qualità elevata direttamente all'interno delle applicazioni che sviluppa, ossia Facebook, Instagram, WhatsApp e Threads.
Muse Image non è un semplice generatore di immagini da prompt testuali. Il modello è stato progettato per comprendere istruzioni articolate e combinare differenti tipi di input. Oltre alla descrizione testuale, può utilizzare fotografie già esistenti come punto di partenza, modificare immagini attraverso schizzi o annotazioni disegnate dall'utente e trasformare fotografie reali in nuove composizioni.
Cosa sa fare Muse Image
Tra le funzioni dimostrate da Meta figurano la creazione di illustrazioni personalizzate, cartoline, inviti, concept grafici e il restyling di ambienti domestici partendo da fotografie reali.
L'editing avviene direttamente sull'immagine: è sufficiente tracciare una zona con il dito o con il mouse e descrivere la modifica desiderata perché il modello la applichi mantenendo il resto della scena coerente.
In altre parole, Muse Image elabora prompt testuali (text-to-image), immagini esistenti (image-to-image), offre maschere per modificare solo parti di un’immagine (inpainting) e consente le combinazioni di testo e immagini per effettuare modifiche.
Dal punto di vista tecnico, Muse Image rappresenta anche un cambio di strategia. Mentre negli ultimi anni Meta aveva costruito gran parte della propria reputazione sull'ecosistema open source Llama, Muse è un modello a sé e viene distribuito come servizio integrato nelle applicazioni dell'azienda.
Chi può usare Muse Image
Muse Image è stato lanciato in una selezione di mercati in cui Meta AI è già disponibile, tra cui l’Italia.
Al momento nell'Unione europea sembra essere disponibile unicamente sulla piattaforma meta.ai, raggiungibile via web, e nell’app dedicata Meta AI.
L'integrazione di Muse Image gradualmente riguarderà anche Instagram e WhatsApp, dove alimenterà la generazione di immagini nelle conversazioni e oltre trenta nuovi effetti basati su IA per le Storie di Instagram.
Facebook e Messenger riceveranno il nuovo modello successivamente, con una distribuzione progressiva che varierà da Paese a Paese.
La disponibilità geografica rappresenta uno dei principali limiti. Infatti, in Europa il rilascio dipenderà dall'evoluzione del quadro normativo e dalle verifiche sulla conformità ai requisiti previsti dalla legislazione europea in materia di protezione dei dati e di intelligenza artificiale.
I limiti normativi e la privacy
Nel caso di Muse Image, il tema più rilevante riguarda il GDPR, il regolamento europeo sulla privacy.
Infatti, Muse Image può utilizzare fotografie pubbliche di Instagram come riferimento creativo quando un utente ne tagga un altro (inserendo nel prompt un nome utente preceduto dal simbolo "@", per esempio @sergioxy).
Questa funzionalità implica il trattamento di dati personali (le immagini pubblicate dagli utenti) e deve quindi rispettare il Regolamento generale sulla protezione dei dati (GDPR), che impone requisiti stringenti sulla base giuridica del trattamento, sulla trasparenza, sui diritti degli interessati e sulle modalità con cui i dati vengono utilizzati per addestrare o alimentare sistemi di intelligenza artificiale.
L’AI Act, il regolamento Ue che disciplina lo sviluppo, la commercializzazione e l’uso di sistemi IA, entra invece in gioco sotto un profilo diverso. Il regolamento europeo non vieta strumenti come Muse Image, ma impone obblighi di trasparenza per i sistemi di intelligenza artificiale generativa. In particolare, i fornitori devono informare chiaramente gli utenti quando un contenuto è stato generato artificialmente, rispettare gli obblighi sul copyright previsti dalla direttiva europea.
Come evitare che Muse Image sfrutti le nostre immagini
Chi ha un account Instagram pubblico può impedire che altri usino le sue foto con Muse Image. Per farlo occorre modificare la voce ‘Condivisione e riutilizzo’ (Sharing and reuse) all’interno del profilo Instagram, cercando poi la sezione ‘Consenti alle persone di usare i tuoi contenuti su Instagram e con le funzionalità AI di Meta’ e disattivare gli interruttori relativi a Post e Reel.
Vanno tenuti presenti tre aspetti di rilievo: questa opzione è in via di distribuzione e potrebbe non essere disponibile in tutti gli account e, non di meno, non si applica agli account privati e, elemento da tenere in debita considerazione, come riporta Wired, gli utenti le cui foto sono state usate non riceverebbero alcuna notifica.
Cosa sapere su Muse Video
Accanto a Muse Image, Meta ha mostrato anche Muse Video. Al momento non si tratta di un prodotto disponibile al pubblico, ma di un'anticipazione della prossima fase dello sviluppo. Secondo l'azienda il modello è stato progettato per generare video con maggiore fedeltà alle richieste dell'utente, migliore qualità visiva e una più elevata coerenza temporale tra i fotogrammi, uno degli aspetti più complessi per i moderni generatori video.
Meta non ha ancora annunciato una data di rilascio né le modalità di accesso a Muse Video. L'azienda si è limitata a confermare che entrerà a far parte della stessa famiglia di modelli Muse e verrà integrato progressivamente nell'ecosistema Meta AI.
Quello che sappiamo è che Muse Video è un modello generativo text-to-video, ossia in grado di creare clip video a partire da istruzioni in linguaggio naturale.
Dal punto di vista tecnico, Meta sostiene che il modello è stato progettato per affrontare tre dei problemi più difficili della generazione video: la comprensione di prompt (istruzioni) complessi e articolati, mantenere la coerenza temporale tra i fotogrammi e produrre movimenti più fluidi e realistici.
È probabile che Muse Video condivida buona parte dell'architettura di ragionamento con Muse Spark, il modello capostipite della famiglia Muse. In pratica, il modello interpreta prima la richiesta dell'utente e successivamente genera una sequenza di fotogrammi coerenti, anziché produrre ogni immagine in modo indipendente.
Questo approccio riduce molti degli artefatti tipici dei primi generatori video, come cambi improvvisi di volto, variazioni dell'illuminazione o deformazioni degli oggetti. Meta, tuttavia, non ha ancora pubblicato un paper tecnico che descriva l'architettura o il numero di parametri del modello.
Il cambio di strategia di Meta
Il lancio di Muse Image e l'anteprima di Muse Video segnano una svolta nella strategia di Meta.
L'obiettivo non è soltanto competere con strumenti come ChatGpt, Gemini o Midjourney nella generazione di contenuti, ma rendere l'intelligenza artificiale una funzione nativa delle piattaforme social utilizzate ogni giorno da miliardi di persone.
Un altro aspetto è il ruolo che Muse Video avrà nell'ecosistema Meta. Oggi molte funzionalità video AI di Meta sono basate su tecnologie sviluppate in collaborazione con partner esterni. Stando al Financial Times, l'obiettivo dell'azienda è sostituire progressivamente questi strumenti con Muse Video, così da avere una tecnologia interamente proprietaria sia per la generazione di immagini sia per quella di video.
Per quanto riguarda il rilascio di Muse Video, Meta non ha ancora annunciato una data precisa, i Paesi nei quali sarà disponibile, la durata massima dei video e l’eventuale costo applicato a chi ne farà uso. È invece plausibile che, una volta rilasciato, venga integrato nello stesso ecosistema di Muse Image: Meta AI, Instagram, WhatsApp e, successivamente, Facebook e Messenger. Meta ha anche lasciato intendere che il modello potrà essere utilizzato per la creazione di contenuti social e pubblicitari direttamente all'interno delle proprie piattaforme.
Il pubblico di riferimento
Muse Image e Muse Video sono pensati per un pubblico molto ampio, che va dagli utenti comuni ai professionisti della comunicazione digitale.
Per gli utenti privati, i due modelli permettono di creare immagini e contenuti video personalizzati, di realizzare effetti creativi per i social e trasformare idee in contenuti visivi senza possedere competenze grafiche avanzate.
Per creator, influencer e professionisti del marketing digitale rappresentano strumenti per produrre rapidamente immagini promozionali, campagne social, copertine, animazioni e materiali destinati alla pubblicazione online.
Per aziende e sviluppatori, invece, la tecnologia può essere utilizzata per automatizzare parte dei processi creativi, dalla realizzazione di contenuti pubblicitari alla prototipazione visiva di prodotti e servizi.
Un processo di democratizzazione nell’uso delle IA generative multimodali trasversale, considerando che le piattaforme sviluppate da Meta sono usate da miliardi di persone.
Il problema dei deepfake e il watermarking
Identificare e tracciare i contenuti generati dalle IA è un tema attuale, sia perché la diffusione di deepfake favorisce la disinformazione e le truffe, sia perché in Italia è reato.
Meta ha creato Content Seal, un sistema di watermaking - tecnica che inserisce un segno (visibile o invisibile) in un contenuto digitale per identificarne l’origine – per rendere riconoscibili i contenuti creati mediante i propri sistemi IA, Muse Image incluso.
Content Seal è una firma digitale nascosta che può essere letta da strumenti automatici di rilevazione e non è, dunque, un logo visibile applicato sulle immagini. Il suo scopo principale è l’identificazione della provenienza del contenuto. Quando un'immagine generata da un’IA viene condivisa online, Meta vuole poter stabilire se quella foto è stata prodotta da un modello generativo invece che da una fotocamera o da un processo creativo tradizionale.
Il motivo per cui il watermark è invisibile è pratico. Infatti, un marchio visibile renderebbe i contenuti generati dall'IA meno utilizzabili per creator, aziende e utenti comuni che fanno volentieri a meno di vedere simboli sovrapposti ai risultati del loro lavoro. Non di meno, un watermark invisibile è più difficile (ma non impossibile) da rimuovere e rende più facili le verifiche successive del file.
Tuttavia, Content Seal non garantisce che un'immagine diventi impossibile da falsificare o che la sua origine sia sempre certa. È uno strumento di autenticazione, non un sistema antifrode assoluto. Un contenuto può essere modificato, ricreato con un altro modello o manipolato in modi che rendano più difficile il riconoscimento. In quanto strumento, può essere danneggiato da forti compressioni, ritagli, ridimensionamenti, screenshot o manipolazioni pesanti. Inoltre, se un contenuto viene fotografato dallo schermo e rielaborato o ricreato da zero, il watermark può andare completamente perso.