Adobe sotto accusa per uso improprio di opere degli autori nella formazione dell’IA.

Pubblicato il da Ignazio Aragona - Tecnologia

Adobe sotto accusa per uso improprio di opere degli autori nella formazione dell’IA.

Adobe e l’Integrazione dell’IA

Come molte altre aziende tecnologiche, Adobe ha investito significativamente nell’intelligenza artificiale negli ultimi anni. Dal 2023, la compagnia ha introdotto diversi servizi di IA, tra cui Firefly, una suite per la generazione di contenuti multimediali. Recentemente, però, l’adozione spinta di questa tecnologia ha portato a problemi legali, con un nuovo contenzioso che accusa Adobe di aver utilizzato libri piratati per addestrare uno dei suoi modelli di IA.

Un’azione legale collettiva è stata proposta a favore di Elizabeth Lyon, un’autrice dell’Oregon, che afferma che Adobe ha impiegato versioni non autorizzate di vari libri, inclusa la sua opera, per addestrare il programma SlimLM dell’azienda.

Cosa è SlimLM?

Adobe definisce SlimLM come una serie di modelli linguistici leggeri ottimizzati per compiti di assistenza alla documentazione su dispositivi mobili. Secondo l’azienda, SlimLM è stato pre-addestrato usando il dataset SlimPajama-627B, un insieme di dati open-source rilasciato da Cerebras nel giugno 2023. Lyon, che ha redatto diverse guide per la scrittura non-fiction, sostiene che alcune delle sue opere siano state incluse in questo dataset di pre-addestramento utilizzato da Adobe.

La causa di Lyon, riportata da Reuters, segnala che il suo lavoro è stato inserito in un sottoinsieme elaborato di un dataset manipolato, alla base del programma di Adobe: “Il dataset SlimPajama è stato creato copiando e manipolando il dataset RedPajama (incluso il copia della collezione Books3)”, si legge nel documento legale. “Pertanto, essendo una copia derivata del dataset RedPajama, SlimPajama contiene il dataset Books3, incluse le opere protette dell’attrice e dei membri della Classe.”

Il Problema Legale dei Materiali Piratati

Il dataset “Books3”, una vasta collezione di 191.000 libri utilizzata per addestrare i sistemi di IA generativa, ha suscitato numerosi problemi legali nel settore tecnologico. Anche il dataset RedPajama è stato menzionato in diverse cause legali. A settembre, è stata intentata una causa contro Apple, accusando la compagnia di aver utilizzato materiali protetti da copyright per addestrare il suo modello di intelligenza artificiale. Tale causa ha citato il dataset e ha accusato l’azienda di copiare opere protette “senza consenso e senza riconoscimento o compenso.” Ad ottobre, una causa simile contro Salesforce ha affermato, anch’essa, che la compagnia aveva utilizzato RedPajama per scopi di addestramento.

Sfortunatamente, questo tipo di controversie legali è diventato piuttosto comune nel panorama tecnologico. Gli algoritmi di IA sono addestrati su enormi dataset e, in alcuni casi, si sospetta che tali dataset includano materiali piratati. A settembre, Anthropic ha accettato di pagare 1,5 miliardi di dollari a vari autori che l’avevano denunciata, accusandola di aver utilizzato versioni piratate delle loro opere per addestrare il suo chatbot, Claude. Questo caso potrebbe rappresentare un potenziale punto di svolta nelle battaglie legali in corso riguardanti il materiale coperto da copyright nei dati di addestramento dell’IA.

Implicazioni per il Settore Tecnologico

Le conseguenze di queste cause vanno al di là di Adobe e colpiscono l’intero settore tecnologico, in particolare le aziende che sviluppano sistemi di intelligenza artificiale. L’adozione crescente della IA porta anche a una maggiore responsabilità nell’utilizzo dei dati. Diversi esperti del settore sottolineano l’importanza di stabilire linee guida chiare per garantire un uso etico e legale delle opere protette da copyright nella formazione di modelli di intelligenza artificiale.

Il tema dell’uso di materiali protetti è destinato a rimanere al centro delle discussioni, dato il rapido sviluppo della tecnologia e la crescente preoccupazione per i diritti degli autori. È fondamentale che le aziende si impegnino per una maggiore trasparenza e collaborazione con i creatori di contenuti, al fine di evitare situazioni problematiche come quelle che coinvolgono Adobe e altri colossi tecnologici.

Con un numero crescente di cause legali che emergono in questo ambito, le aziende devono essere pronte ad affrontare le sfide legali mentre continuano a innovare nel campo dell’IA. La creazione di modelli di intelligenza artificiale responsabili non è solo una questione di tecnologia, ma anche di rispetto per il lavoro altrui.

Fonti: Reuters, Cerebras.

Non perderti tutte le notizie di tecnologia su Blog.it

Adobe sotto accusa per uso improprio di opere degli autori nella formazione dell’IA. - Blog.it - Notizie, Lifestyle, Gossip, Viaggi, Tech e molto altro