Il caso spiegato
Diritto d'Autore e Training AI: il punto sulla protezione dei contenuti nel 2025
6 min di lettura · Aggiornato a giugno 2026 · Supervisione editoriale: Avv. Federico Papa
La questione dell'utilizzo di contenuti protetti per l'addestramento dei modelli linguistici ha raggiunto un punto di svolta critico alla fine del 2025. Secondo quanto riportato dalla stampa nazionale e internazionale tra la fine del 2023 e la fine del 2025, la contrapposizione tra i giganti dell'editoria e i laboratori di AI si è trasformata in una complessa battaglia legale sulla legittimità dell'estrazione di dati. Questo articolo analizza l'evoluzione normativa e giurisprudenziale, partendo dai casi più noti per arrivare a una sintesi operativa per i professionisti. Attraverso la ricostruzione dei fatti e l'esame del quadro normativo aggiornato alla recente Legge 132/2025, vedremo come l'ordinamento italiano stia recependo le sfide della GenAI. Concluderemo con un caso gemello didattico per illustrare l'applicazione pratica delle tutele di opt-out e le possibili strategie di difesa per i titolari dei diritti d'autore.

In sintesi
L'articolo esamina il conflitto tra titolari di copyright e sviluppatori AI, focalizzandosi sul caso New York Times vs. OpenAI e sulle azioni intraprese da RTI e Medusa Film in Italia. Analizza la Direttiva UE 2019/790, l'AI Act e la Legge 132/2025, spiegando le eccezioni per il Text and Data Mining e il meccanismo dell'opt-out. Attraverso un caso gemello didattico, illustra l'onere della prova e le possibili sanzioni civili per violazione del diritto d'autore.
Il fatto
La cronaca giudiziaria recente è segnata dallo scontro tra i creatori di contenuti e le aziende tecnologiche. Secondo quanto riportato da Wired Italia e Il Messaggero, la vicenda cardine ha avuto inizio il 27 dicembre 2023, quando il New York Times ha citato in giudizio OpenAI e Microsoft davanti alla Federal District Court di Manhattan. L'accusa è di aver utilizzato milioni di articoli protetti per addestrare modelli come GPT-4 senza licenza.
Attualmente, il procedimento si trova nella fase di discovery (scambio probatorio), con il tribunale che ha già respinto alcuni tentativi di archiviazione precoce. In Italia, testate come Diritto.it hanno evidenziato azioni simili avviate nel dicembre 2025 da RTI (Mediaset) e Medusa Film contro sviluppatori di AI per l'uso non autorizzato di contenuti audiovisivi. Gli editori sostengono che l'AI non si limiti a imparare, ma riproduca frammenti testuali quasi identici (regurgitation), ponendosi in diretta concorrenza commerciale con le fonti originali.

Le norme in gioco
Il baricentro normativo si sposta tra la Direttiva (UE) 2019/790 e la Legge 633/1941 (Legge Diritto d'Autore - LDA). L'Art. 4 della Direttiva introduce l'eccezione per il Text and Data Mining (TDM) a fini commerciali, recepita in Italia dall'Art. 70-quater LDA. Tale norma permette l'estrazione di dati a meno che il titolare dei diritti non abbia espresso una riserva (opt-out) in modo leggibile dalla macchina.
Recentemente, la Legge 132/2025 ha introdotto l'Art. 70-septies LDA, che specifica gli obblighi per i modelli di AI, richiamando la trasparenza prevista dal Regolamento UE 2024/1689 (AI Act). La violazione di queste norme può comportare l'inibitoria dell'uso del dataset, il risarcimento del danno ai sensi dell'Art. 158 LDA e, potenzialmente, l'ordine di distruzione dei pesi del modello addestrati illecitamente.
Cosa dice la giurisprudenza
Secondo quanto analizzato da Diritto.it, la giurisprudenza di merito europea sta iniziando a tracciare i confini del TDM. Orientamenti recenti hanno chiarito che l'eccezione per scopi di ricerca scientifica non può essere invocata da soggetti che, pur essendo non-profit, creano dataset destinati a essere utilizzati da partner commerciali per sviluppare prodotti concorrenti.
È stato inoltre precisato che la riserva dei diritti deve essere rispettata non solo se inserita nei file di configurazione del server (come il robots.txt), ma anche se indicata nei termini e condizioni d'uso del sito, purché accessibili. I giudici hanno sottolineato che quando l'output di un sistema AI è in grado di sostituire la consultazione dell'opera originale, l'uso ricade pienamente nella violazione del diritto di riproduzione.
- Prova l'AI di edit.legal
Analisi redatta e verificata con edit.legal
Per verificare le norme citate nell'articolo abbiamo usato edit.legal. Metti alla prova la nostra AI giuridica su fonti ufficiali e applicala alle tue pratiche.
Cosa insegna ai professionisti
1. Implementazione tecnica: Per i legali non basta una clausola legale; è essenziale implementare protocolli di opt-out leggibili dalle macchine.
2. Trasparenza AI Act: Sfruttare i nuovi obblighi di trasparenza per richiedere l'accesso ai log di addestramento.
3. Analisi dell'output come prova: Monitorare l'output dei modelli concorrenti per identificare casi di memorizzazione o riproduzione di elementi distintivi, prove forti di violazione diretta.
Riferimenti: Direttiva (UE) 2019/790Regolamento (UE) 2024/1689 (AI Act)Legge 22 aprile 1941, n. 633 (LDA)Legge 132/2025
Casi correlati

Domande frequenti
Quali sanzioni rischia chi addestra AI su dati protetti?
Le sanzioni sono prevalentemente civili: risarcimento del danno, inibitoria dell'attività e, in alcuni casi, l'ordine giudiziale di cancellare il dataset o 'disimparare' i dati (machine unlearning).
È sufficiente scrivere 'vietato l'uso per AI' sul proprio sito?
Secondo la normativa UE, la riserva dei diritti deve essere espressa in modo leggibile dalla macchina per essere opponibile alle attività di data mining commerciale.
L'AI Act protegge i diritti d'autore italiani?
L'AI Act impone obblighi di trasparenza agli sviluppatori, che devono dichiarare quali dati hanno usato, facilitando i titolari dei diritti nell'esercitare le tutele previste dalla legge italiana.
Ricerca e redazione con fonti verificate su edit.legal
Ricerca giuridica e redazione con citazioni riscontrate sulle banche dati ufficiali. edit.legal si prova gratis, senza carta di credito.
Prova edit.legal gratis