Anthropic rivela i dettagli del funzionamento dei nuovi watermark di Claude.

Anthropic rivela i dettagli del funzionamento dei nuovi watermark di Claude.

Comprendere il Watermarking

L’articolo di Anthropic inizia con una panoramica sul concetto di watermarking. Spiega che quando Claude deve fare “scelte a basso rischio” — come scegliere tra “nuvoloso” e “grigio” per descrivere il tempo — può generare un pattern nelle sue risposte che è “indetectable per il lettore, ma rilevabile da chi possiede una chiave che lo codifica”.

Secondo l’azienda, “il watermarking non influisce sulla qualità delle risposte di Claude”. Infatti, “per il lettore, una risposta con watermark è indistinguibile da una senza”.

Sintesi della Tecnologia Utilizzata

Anthropic ha affermato di utilizzare il metodo SynthID-Text delineato dal team Google DeepMind nel 2024 e prevede di rilasciare un’API per la rilevazione del watermark. Hanno anche chiarito che il watermarking è differente dagli approcci di rilevazione dell’AI utilizzati da aziende come Pangram, che cercano “segnali” nel testo per rivelare l’uso di AI: “Identificare questi pattern è fondamentalmente diverso dal controllare un watermark.”


Lascia un commento

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *