Gesù Cristo possedeva o no gli indumenti che indossava ? Ne Il Nome della Rosa di Umberto Eco questo è il tema centrale dibattuto dalle eminenze del clero; una vexata quaestio che ha pregiudicato l’unità della Chiesa e la cui risposta era attesa ansiosamente da tutta la cristianità. L’interesse in gioco era enorme: la legittimità della Chiesa a disporre di proprietà private.
I sistemi di intelligenza artificiale generativa imparano e sono creativi in modo simile ad una intelligenza umana? A discettarne non sono alti esponenti del clero ma filosofi, giuristi e informatici. Neurofisiologi e neurobiologi sono praticamente assenti nel dibattito.
Eppure dalla risposta a questa domanda discende la legittimazione in termini politici, prima ancora che giuridici, di una nuova possibilità di sfruttamento economico di tutti i libri e testi preesistenti.
I grandi modelli linguistici (Large Language Models – Llm) come Bard e ChatGPT sono costruiti distillando le correlazioni scovate all’interno dei testi scritti. Quando un Llm produce un output, sta generando un prodotto nuovo, frutto di creatività come farebbe un uomo, o sta generando un’opera derivata da questi testi?
Se la risposta fosse che la macchina non “impara” e non “crea”, il suo output sarebbe banalmente un’opera derivante da testi esistenti, anche se in una accezione non precisamente considerata dall’attuale dottrina giuridica, concepita quando i Llm non esistevano.
Anni fa ci fu un simile dibattito per stabilire se i link ed i brevi estratti sul web fossero o meno opere derivate. Dalla risposta dipendeva la possibilità per Google di offrire la ricerca senza dover corrispondere royalties ai siti indicizzati. La mia posizione fu che i link non erano un’opera derivata in quanto, conducendo visitatori ai siti interessati, erano un servizio nuovo per un pubblico diverso che non competeva nello sfruttamento economico con i titolari dei siti stessi e quindi non causava loro un danno, anzi. Questa, con alcune evoluzioni giuridiche successive, è stata la base di giganti economici quali Google e Facebook che non avrebbero potuto nascere se avessero dovuto pagare una “link tax” per i contenuti da loro indicizzati e collegati.
Gli strumenti come ChatGPT producono sul mercato effetti assai diversi dai link: la risposta che forniscono non conduce l’utente ai testi originali ma ne diviene sostitutiva; il pubblico è lo stesso e c’è una indubbia competizione economica. Un Llm, distillato a partire dalla quasi totalità di testi scritti sino ad oggi, è uno strato che li avvolge tutti e tende a divenire, nella pratica comune, l’unica interfaccia di accesso e sfruttamento economico delle informazioni ivi contenute.
Il professor Prosperetti ritiene prevedibile che questo diverrà presto un tema politico di confronto tra Usa, dove vige la disciplina del fair use - più permissiva rispetto di queste nuove forme di utilizzo - e l’Europa dove una simile disciplina non esiste.Non appare casuale il fatto che le aziende che producono questi modelli siano restie ad informare la comunità scientifica su quali siano i testi che hanno usato per costruire i modelli: la trasparenza potrebbe favorire possibili riscontri di violazioni di copyright.
Ma la trasparenza non basta: un problema nel problema è che le aziende che promuovono questi sistemi godono tipicamente di posizioni dominanti e non sono soggette a particolari obblighi di apertura: partendo da un mercato a monte aperto, che ne viene impattato economicamente, non abilitano parimenti un mercato a valle. Accadde così anche per il diritto di link che ha portato i giganti del web a divenire dei gatekeeper, esito non auspicabile che non fu previsto. Dovremmo imparare da quell’esperienza.
Per il futuro, non è detto a priori che la soluzione socialmente desiderabile sia restringere il copyright limitando in assoluto la possibilità di esistenza degli Llm. Nel pensare a quali misure applicare e come far evolvere il diritto d’autore nell’epoca dell’intelligenza artificiale generativa si potrebbe ragionare su regole e iniziative di supporto per aprire mercati a valle.
Quando grandi padri dell’IA parlano di “sistemi che sono generalmente più intelligenti degli esseri umani” e che “sarebbe bello se potessimo convincere la gente che questi non sono pappagalli stocastici” teniamo ben presente che non si tratta di affermazioni filosofiche ma che sullo sfondo ci sono aspetti assai più veniali, come lo sfruttamento futuro del patrimonio letterario prodotto sino ai giorni nostri. Gli interessi in gioco sono ciclopici, ben superiori alla proprietà privata della Chiesa di cui discusse Guglielmo Da Baskerville.