• 21 September 2026
AI e diritti d'autore Meta Communications.it

Indice

Ogni modello di AI che genera testi, immagini o musica ha imparato osservando montagne di opere create da esseri umani: romanzi, articoli, fotografie, canzoni, dipinti. E’ in questo modo che è nata la battaglia legale più importante dell’economia digitale del momento, uno scontro che non riguarda soltanto chi verrà pagato, ma cosa significhi essere autori quando una macchina produce in pochi secondi ciò che a una persona costa una vita di mestiere. La domanda sul rapporto tra copyright e intelligenza artificiale si sdoppia in due questioni distinte e ugualmente decisive. Da un lato, se addestrare un modello su opere protette senza permesso sia lecito. Dall’altro, se ciò che quel modello genera possa a sua volta appartenere a qualcuno ed essere tutelato dal diritto d’autore.

Il nodo dell’addestramento è il terreno su cui si combatte oggi nelle aule di tribunale, soprattutto negli Stati Uniti, dove la difesa delle aziende è la dottrina che consente in certi casi di riutilizzare materiale protetto senza autorizzazione. Le case dell’AI sostengono che addestrare un modello sia un uso trasformativo, perché il sistema non copia le opere ma ne estrae schemi statistici per generare qualcosa di nuovo. Gli autori replicano che il valore dei loro testi è stato incorporato senza consenso e senza compenso, e che i modelli finiscono per competere direttamente con le opere da cui hanno imparato. La giurisprudenza sul copyright applicata all’AI è tutt’altro che uniforme, ed è proprio la sua frammentazione a rendere il momento così incerto per chiunque costruisca o pubblichi contenuti online.

Il caso Anthropic: quando il fair use si separa dalla pirateria

La decisione più istruttiva riguarda proprio Anthropic, l’azienda che sviluppa il modello Claude, ed è utile richiamarla per la sua eleganza logica. Chiamato a giudicare la causa collettiva Bartz contro Anthropic, promossa da un gruppo di autori guidato dalla romanziera Andrea Bartz, il giudice federale della California ha scomposto la condotta dell’azienda in parti diverse invece di applicare un verdetto unico. Ha stabilito che usare libri acquistati legalmente per addestrare il modello è un uso trasformativo e quindi coperto dal fair use, e che lo è anche digitalizzare copie cartacee regolarmente comprate. Ma ha negato la stessa protezione al fatto di scaricare e conservare copie piratate da biblioteche ombra come Library Genesis e Pirate Library Mirror, giudicando quella condotta una violazione vera e propria. Il giudice ha rilevato che Anthropic aveva accumulato oltre sette milioni di copie pirata in una sorta di biblioteca centrale, un fatto che avrebbe potuto esporre l’azienda a risarcimenti enormi in caso di processo.

La causa si è poi chiusa con un accordo che è entrato nella storia come il più grande risarcimento in materia di copyright mai reso pubblico: un miliardo e mezzo di dollari a copertura di circa cinquecentomila libri, con una cifra dell’ordine dei tremila dollari per opera. L’accordo, approvato in via preliminare dal tribunale il mese successivo, ha spinto l’Authors Guild a parlare di un passaggio decisivo verso un mercato delle licenze per i dati di addestramento. Un punto va però sottolineato per non fraintendere la portata di tutto questo: l’accordo riguarda condotte passate legate alla pirateria, non autorizza gli addestramenti futuri e non risolve la questione degli output, cioè di cosa accade quando il modello produce qualcosa di troppo simile a un’opera esistente.

Perché tribunali diversi arrivano a conclusioni opposte

E qui la fotografia si complica ulteriormente, perché corti diverse ragionano in modo diverso persino sugli stessi fatti. Appena due giorni dopo la sentenza su Anthropic, un altro giudice della California ha dato ragione a Meta nella causa Kadrey contro Meta, intentata da tredici autori tra cui Sarah Silverman e Richard Kadrey. La vittoria dell’azienda, però, è arrivata su basi molto più strette: il giudice ha stabilito che gli autori non erano riusciti a dimostrare il danno di mercato, senza sposare affatto la tesi ampia del fair use. Anzi, nella motivazione ha spiegato che il rischio di una diluizione del mercato, con una valanga di contenuti generati che competono con le opere umane, avrebbe probabilmente fatto pendere la bilancia dalla parte degli autori, se solo questi avessero costruito un dossier probatorio più solido. È stata insomma una vittoria tecnica, non una benedizione al modello di business dell’addestramento gratuito.

In un caso ancora diverso, che riguardava lo strumento di ricerca giuridica Ross Intelligence addestrato su materiale editoriale protetto di Thomson Reuters, la corte ha invece escluso del tutto il fair use, considerando quell’uso non trasformativo e concorrente con un mercato già esistente delle licenze per l’addestramento. A questi precedenti si aggiungono le grandi cause ancora aperte tra editori giornalistici e sviluppatori, e soprattutto il fronte musicale, dove nell’ottobre dello scorso anno Universal Music ha raggiunto un accordo con la piattaforma Udio che ha fissato per la prima volta una tariffa per ogni brano generato dall’intelligenza artificiale, dell’ordine di frazioni di centesimo con rate più alte per gli output distribuiti commercialmente. Il messaggio che se ne ricava non è una regola, ma una direzione: la stagione dell’addestramento gratuito su qualunque contenuto sta lasciando il posto a un mercato delle licenze in cui i dati per addestrare i modelli avranno un prezzo.

Chi è l’autore di un’opera generata dall’AI?

La seconda questione è ancora più vertiginosa e tocca il cuore del lavoro creativo. Se un’immagine, un testo o una canzone nascono da un modello, chi ne è l’autore, e quell’opera è protetta dal copyright? La posizione consolidata delle autorità sul diritto d’autore, a partire dall’Ufficio statunitense per il copyright, ruota attorno a un principio antico: la paternità umana. Un’opera generata interamente da una macchina, senza un contributo creativo umano sufficiente, non è tutelabile, il che significa che chiunque potrebbe copiarla liberamente. La linea si fa sottile quando l’essere umano interviene con scelte, revisioni, montaggi e istruzioni che plasmano il risultato, perché è lì che il diritto prova a stabilire quanta creatività umana serva perché un’opera assistita dall’intelligenza artificiale abbia un autore riconosciuto. È una domanda che riguarda direttamente chi realizza contenuti per mestiere, perché ridefinisce cosa protegge il valore del proprio lavoro in un mondo in cui la produzione è diventata quasi gratuita.

La guerra del copyright non è dunque un tecnicismo per giuristi. È il luogo in cui una società decide quanto valga la creatività umana quando smette di essere l’unica fonte di contenuti, e come remunerarla perché continui a esistere. La tecnologia ha corso più veloce del diritto, come quasi sempre accade, ma stavolta la posta in gioco è la sopravvivenza economica di chi crea. Da come si chiuderà questa partita dipenderà se i modelli resteranno costruiti sul lavoro non pagato di milioni di autori, oppure se si affermerà un patto nuovo in cui chi fornisce la materia prima creativa ne riceve una quota. Ed è un patto che conviene a tutti, perché una macchina addestrata solo su ciò che altre macchine generano finisce, prima o poi, per non avere più nulla di umano da cui imparare.

Addestrare un’intelligenza artificiale su opere protette è legale? Dipende dalla giurisdizione e dal modo in cui il materiale è stato ottenuto. Negli Stati Uniti alcuni tribunali hanno riconosciuto l’addestramento su opere acquistate legalmente come uso trasformativo coperto dal fair use, ma hanno condannato l’uso di copie piratate. In Europa la disciplina è diversa e ruota attorno al diritto di opt-out previsto per l’estrazione di testo e dati.

Un’opera creata dall’intelligenza artificiale è protetta dal copyright? Un contenuto generato interamente da una macchina, senza un apporto creativo umano significativo, generalmente non è tutelabile e può essere copiato liberamente. La protezione diventa possibile quando l’intervento umano nella selezione, revisione e composizione è sufficiente a configurare una vera paternità.

Cosa cambia con l’accordo Anthropic da un miliardo e mezzo di dollari? È il più grande risarcimento in materia di copyright mai reso pubblico e stabilisce un precedente economico: usare materiale piratato per l’addestramento ha un costo. Non legittima però gli addestramenti futuri e apre la strada a un mercato delle licenze per i dati.