Anthropic rivela i dettagli del funzionamento dei nuovi watermark di Claude.

Pubblicato il da Ignazio Aragona - Tecnologia

Anthropic rivela i dettagli del funzionamento dei nuovi watermark di Claude.

Come Funziona il Watermarking di Claude di Anthropic

Anthropic ha recentemente pubblicato un articolo sul proprio blog per chiarire alcune questioni chiave riguardanti il watermarking dei testi generati dal suo chatbot, Claude. Questa tecnologia mira a garantire la trasparenza nel rispetto del Codice di Trasparenza previsto dall’AI Act dell’Unione Europea. Molti utenti si stanno interrogando su come funzionerà concretamente il watermarking, se potrà essere rimosso attraverso modifiche e come questo possa influenzare il codice generato.

La Discussione tra Gli Utenti di Claude

Dopo l’annuncio dell’introduzione del watermarking, gli utenti di Claude hanno iniziato un acceso dibattito. Un post su Reddit ha persino descritto questa novità come una cospirazione contro gli utenti innocenti, mentre un altro commento affermava: “L’unico motivo per cui non vorresti questo è per ingannare le persone.” Secondo Business Insider, “dozzine” di utenti su X hanno dichiarato di voler annullare i loro abbonamenti a Claude a causa di queste nuove misure.

Comprendere il Watermarking

L’articolo di Anthropic inizia con una panoramica sul concetto di watermarking. Spiega che quando Claude deve fare “scelte a basso rischio” — come scegliere tra “nuvoloso” e “grigio” per descrivere il tempo — può generare un pattern nelle sue risposte che è “indetectable per il lettore, ma rilevabile da chi possiede una chiave che lo codifica”.

Secondo l’azienda, “il watermarking non influisce sulla qualità delle risposte di Claude”. Infatti, “per il lettore, una risposta con watermark è indistinguibile da una senza”.

Sintesi della Tecnologia Utilizzata

Anthropic ha affermato di utilizzare il metodo SynthID-Text delineato dal team Google DeepMind nel 2024 e prevede di rilasciare un’API per la rilevazione del watermark. Hanno anche chiarito che il watermarking è differente dagli approcci di rilevazione dell’AI utilizzati da aziende come Pangram, che cercano “segnali” nel testo per rivelare l’uso di AI: “Identificare questi pattern è fondamentalmente diverso dal controllare un watermark.”

Possibilità di Rimuovere il Watermark

Gli utenti si stanno chiedendo se sia possibile riscrivere un testo per nascondere il watermark. Anthropic ha confermato che è una possibilità. Tuttavia, il semplice “editing leggero probabilmente non rimuoverà completamente il watermark”, mentre una “riscrittura completa, in cui ogni parola è sostituita, lo farà”. In questo secondo scenario, l’azienda ha aggiunto che è discutibile se il testo possa ancora essere considerato generato dall’AI.

Per quanto riguarda i testi solo revisionati o editati da Claude, Anthropic ha chiarito che la possibilità di rilevare il watermark dipenderà “dalla lunghezza del testo e da quanto Claude lo ha modificato”. Se l’editing è stato leggero, “quasi tutte le parole” saranno state scritte dall’autore umano, e ci sarà “ben poco (se non nulla) a cui il watermark possa attaccarsi”.

Implicazioni per il Codice Generato

È interessante notare che il watermark del codice generato dovrebbe essere meno evidente rispetto ad altri tipi di testo. Questo avviene perché il modello deve creare codici funzionanti e non ha la libertà di scegliere tra varie opzioni valide. Anthropic ha specificato: “In aree dove c’è una scelta arbitraria tra termini particolari all’interno del codice, il watermark potrà essere utilizzato, come nei commenti nel codice”. Tuttavia, esso avrà un effetto trascurabile sul codice effettivamente prodotto.

Il Futuro del Watermarking nelle AI

Infine, Anthropic ha sottolineato che Claude non sarà l’unico chatbot AI a generare testi watermarkati. “Altri grandi sviluppatori di modelli hanno firmato lo stesso Codice di Pratica e implementeranno i propri watermark”. Questo suggerisce che il watermarking diventerà una prassi comune nel campo dell’AI, mirando a creare un ambiente più trasparente per gli utenti.

Per chi desidera ulteriori dettagli sui watermarking e sulle tecnologie AI, è possibile consultare le fonti ufficiali come il blog di Anthropic e Google DeepMind.

Le informazioni qui presentate offrono una panoramica utile per comprendere come il watermarking influenzerà l’uso dei chatbot e la generazione di contenuti in generale.

Non perderti tutte le notizie di tecnologia su Blog.it

Anthropic rivela i dettagli del funzionamento dei nuovi watermark di Claude. - Blog.it - Notizie, Lifestyle, Gossip, Viaggi, Tech e molto altro