C'è un momento, nella fiaba di Andersen, in cui la Sirenetta accetta il patto: la strega del mare le prende la voce e in cambio le dà ciò che desidera. Oggi quell'immagine suona come un avvertimento per attori e attrici. L'incantesimo che le grandi piattaforme di intelligenza artificiale possono mettere a segno le somiglia molto: un compenso, a volte anche generoso, in cambio di una voce che rischia di non essere più tua.
L'allarme lo lancia Unita, Unione nazionale interpreti teatro e audiovisivo, che ha fatto girare tra attori e attrici un avvertimento: sono sempre di più i casting per registrazioni audio e video che servono ad addestrare sistemi di intelligenza artificiale. Sono lavori veri, retribuiti, in alcuni casi anche molto bene. Ma dietro una giornata davanti a un microfono può esserci molto più della solita prestazione da doppiatore. “È un fenomeno che stiamo monitorando”, spiega Daniela Giordano, presidente di Unita. “La questione dell'intelligenza artificiale, del machine …
C'è un momento, nella fiaba di Andersen, in cui la Sirenetta accetta il patto: la strega del mare le prende la voce e in cambio le dà ciò che desidera. Oggi quell'immagine suona come un avvertimento per attori e attrici. L'incantesimo che le grandi piattaforme di intelligenza artificiale possono mettere a segno le somiglia molto: un compenso, a volte anche generoso, in cambio di una voce che rischia di non essere più tua.
L'allarme lo lancia Unita, Unione nazionale interpreti teatro e audiovisivo, che ha fatto girare tra attori e attrici un avvertimento: sono sempre di più i casting per registrazioni audio e video che servono ad addestrare sistemi di intelligenza artificiale. Sono lavori veri, retribuiti, in alcuni casi anche molto bene. Ma dietro una giornata davanti a un microfono può esserci molto più della solita prestazione da doppiatore. “È un fenomeno che stiamo monitorando”, spiega Daniela Giordano, presidente di Unita. “La questione dell'intelligenza artificiale, del machine learning e soprattutto dell'acquisizione dei dati biometrici degli attori è una delle questioni nodali. Quello che chiedono è di registrare le emozioni, di restituire attraverso la voce un'emotività, in modo che la macchina possa imparare a modularla. È una cosa pericolosissima”.
Gli annunci, in effetti, si moltiplicano, sui social e sulle piattaforme per la ricerca di lavoro. Babel Audio, per esempio, cerca doppiatori professionisti italiani per un progetto da remoto: “Italian Voice Actor/Actress - Doppiatore - Italiano Standard/RAI (Addestratore di IA)”, da 60 a 150 dollari per ora registrata. L'interprete riceve un copione e un linee guida e deve ricostruire il contesto emotivo di una scena: una sposa che saluta la famiglia, un padre che prende in braccio per la prima volta il figlio, un pastore che avvista un lupo, un medico che deve comunicare una morte. Quelle interpretazioni serviranno a insegnare all'IA a comprendere ed esprimere meglio le emozioni umane.
Babel non è un caso isolato. Alignerr offre tra 170 e 200 dollari l'ora ad attori professionisti italiani per registrare performance espressive e valutare le voci generate dall'IA, precisando che il lavoro non comporta il voice cloning. Un casting internazionale pubblicato su Backstage, aperto anche a madrelingua italiani, va oltre: 480 dollari per un'ora di registrazione e un utilizzo perpetuo per l'addestramento “con possibilità di sintesi vocale”. Non tutti questi lavori, però, sono uguali: addestrare un sistema vocale non significa necessariamente autorizzare la clonazione della propria voce. È quello che si firma a fare la differenza.
Una copia del Content Contribution Agreement di David AI Labs, la società indicata nel documento come Babel Audio, datata 2025, è reperibile online insieme ad altre copie dello stesso modello riferite a collaboratori diversi. Non possiamo affermare che sia il contratto oggi proposto agli attori italiani. Ma il documento mostra fin dove possono spingersi queste condizioni. Parla di dati biometrici come il “voiceprint”, l'impronta vocale, e prevede la possibilità di concedere a società terze voce, video e “Audio Clones”. La licenza è definita “unlimited, irrevocable, worldwide, royalty-free, perpetual”: illimitata, irrevocabile, mondiale, senza ulteriori royalties e perpetua.
È su clausole di questo genere che il timore di Unita diventa concreto. Un attore che accetta una cessione così ampia rischia davvero di perdere il controllo futuro della propria voce? “Sì. La risposta è sì”, dice Giordano. E se quella voce sintetica venisse poi utilizzata senza richiamare l'interprete? “Senza nuovi compensi, senza chiamare l'attore e potendo mettergli in bocca qualsiasi tipo di battuta”.
“Ci chiamano e ci dicono: mi è arrivato questo contratto, c'è questa clausola, la posso firmare?”, racconta Giordano. Unita si confronta allora con i propri legali. “Bisogna essere consapevoli che firmando si può cedere in modo perpetuo la propria voce, la propria immagine. E domani può accadere che, invece di esserci tu nella seconda stagione di una serie, ci sia la tua ricostruzione virtuale fatta dall'intelligenza artificiale”.
Il problema non nasce oggi. Una delle principali piattaforme, ricorda Giordano, aveva già tentato di introdurre nei contratti clausole di cessione globale e perpetua: “Sostanzialmente questa cosa è stata scongiurata”. Nei contratti nazionali di attori e doppiatori sono arrivate tutele specifiche. Quello degli attori, in vigore dal 2024, vieta in assenza di accordi espliciti l'estrazione, il campionamento e la rielaborazione di voce e immagine dell'interprete per addestrare algoritmi di intelligenza artificiale.
E le leggi? Si muovono, ma lentamente. L'Italia ha dal 2025 una legge nazionale sull'intelligenza artificiale, accanto all'AI Act europeo. Per Giordano, però, restano scoperte le questioni legate alle caratteristiche degli interpreti:“Ci sono Stati che si stanno adoperando e noi invece stiamo ancora cercando di capire”. Cita la Finlandia, che nel 2026 ha avviato uno studio governativo sulla protezione di voce, immagine, aspetto e movimento dalla riproduzione sintetica. “Ciò che manca è una regola nazionale che permetta, se non di eliminare il fenomeno, almeno di controllarlo”.
Intanto il mercato corre, “in questo momento c'è una ricerca forsennata di dati biometrici di buona qualità”, dice Giordano. Per questo si cercano professionisti capaci di dare alla voce intenzione, paura, desiderio, dolore, commozione. Il paradosso è evidente: gli attori vengono pagati oggi per insegnare alla macchina capacità che domani potrebbero permetterle di fare una parte del loro lavoro: “Esatto. È qualcosa di aberrante. Per questo abbiamo lanciato l'allarme”.
Unita non può impedire agli interpreti di accettare queste offerte, ma può metterli in guardia, “l’unica cosa che possiamo fare è informare e dire chiaramente alle persone che cosa significa”. Anche rispettando le necessità di chi vive di un mestiere discontinuo: “Bisogna essere consapevoli che la pagnotta di oggi può voler dire che domani non ci saranno più pagnotte”.