Come può un giornale online impedire a Google di utilizzare i propri contenuti nelle AI overview?

Pubblicato il da Redazione - aggiornato il - Tecnologia

Come può un giornale online impedire a Google di utilizzare i propri contenuti nelle AI overview?

Abbiamo chiesto a Gemini di darci qualche informazione in piu sul come gli ediori dei giornali online possano limitare o totalmente escludere i proprio contenuti dalle AI Overview di Google e ci ha risposto così:

Questa è una questione complessa e molto dibattuta tra editori e Google. L’introduzione delle “AI Overviews” (o “Riepiloghi AI”) ha sollevato preoccupazioni significative sul fatto che i contenuti dei siti web, in particolare quelli giornalistici, vengano utilizzati per generare risposte dirette agli utenti, riducendo di conseguenza il traffico verso le fonti originali.

Ecco una panoramica delle strategie che un editore può adottare per cercare di impedire a Google di utilizzare i propri contenuti per le AI Overview, con le relative limitazioni.

1. Utilizzo di direttive per i crawler



Questo è il metodo tecnico principale per controllare come i motori di ricerca indicizzano e visualizzano i contenuti:

2. Differenziare i crawler



Google utilizza diversi “crawler” (o “bot”) per scopi diversi.

Un editore può utilizzare il robots.txt per bloccare selettivamente Google-Extended, ad esempio:

User-agent: Google-Extended Disallow: /

Questa direttiva impedisce a Google di usare il contenuto del sito per addestrare i suoi modelli IA, ma non garantisce che i contenuti non vengano comunque utilizzati per le AI Overview, poiché Google potrebbe attingere le informazioni tramite Googlebot, che rimane autorizzato.

3. Soluzioni legali e dibattito



La questione è tutt’altro che risolta e si sta spostando sempre più sul piano legale. Numerosi editori, tra cui The New York Times e, più recentemente, Penske Media, hanno intrapreso azioni legali contro Google e OpenAI. Le principali argomentazioni sono:

Il problema principale per gli editori è che, per rimanere visibili su Google (che rimane la fonte di traffico più importante), non possono semplicemente bloccare tutti i crawler di Google. La dipendenza dal motore di ricerca crea una posizione di svantaggio negoziale.

L’amara cnclusione è che in definitiva, al momento, un editore non ha un metodo semplice e univoco per impedire a Google di usare i propri contenuti specificamente per le AI Overview, mantenendo al contempo la piena visibilità nei risultati di ricerca. Le opzioni tecniche disponibili sono limitate e spesso comportano un compromesso tra controllo dei contenuti e visibilità. La soluzione definitiva potrebbe arrivare solo attraverso accordi di licenza tra Google e i grandi gruppi editoriali o, come sperano molti, tramite interventi normativi e sentenze giudiziarie che ridefiniscano i confini del “fair use” e del diritto d’autore nell’era dell’intelligenza artificiale generativa.

Non perderti tutte le notizie di tecnologia su Blog.it

Come può un giornale online impedire a Google di utilizzare i propri contenuti nelle AI overview? - Blog.it - Notizie, Lifestyle, Gossip, Viaggi, Tech e molto altro