
Anthropic sta aggiungendo un watermark invisibile a tutto il testo generato dai futuri modelli Claude. Se il tuo team usa l’AI per l’editoria, l’istruzione o i registri regolamentati, questo cambiamento influisce sul modo in cui tracci e dimostri l’uso dell’AI ai sensi dell’European Union AI Act.
Il 14 agosto 2026, l’azienda ha pubblicato una guida tecnica in Anthropic — How Claude’s text watermark works. Anthropic sta distribuendo questa funzionalità a livello globale perché non può ancora limitarla facilmente per regione.
Come funziona il pattern nascosto
Anthropic ha sviluppato il suo sistema utilizzando il metodo SynthID-Text di Google DeepMind. Il segnale è completamente invisibile. Non aggiunge lettere speciali, token extra o tag visibili al tuo output.
Al contrario, il modello modifica leggermente i calcoli matematici che usa per scegliere le parole quando diverse opzioni hanno lo stesso senso. Uno strumento di verifica utilizza una chiave segreta per analizzare queste scelte sottili. Calcola quindi la probabilità che Claude abbia contribuito a scrivere il testo.
Ecco cosa si ottiene:
– Nessun costo extra. Anthropic afferma che il watermarking non aggiunge token extra e non aumenterà i prezzi del servizio.
– Nessun dato personale. Il watermark non contiene informazioni su account utente, organizzazioni o chat.
– Detection API in arrivo. Anthropic prevede di lanciare presto una API di rilevamento, anche se i dettagli finali sono ancora in sospeso.
Cosa dichiara il fornitore — e cosa nessuno ha ancora verificato
Anthropic afferma che i test interni non hanno mostrato alcun calo reale nella qualità di scrittura, citando uno studio separato su SynthID-Text. Tieni presente: queste affermazioni provengono direttamente dai test interni di Anthropic e dalle ricerche citate. Nessuno all’esterno dell’azienda ha ancora verificato ogni modello Claude, lingua o impostazione di temperatura.
Dove il rilevamento fallisce
Una verifica positiva significa solo che Claude è stato probabilmente coinvolto a un certo punto. Non può dimostrare la paternità umana. Inoltre non può distinguere Claude da un’altra AI, né mostrare se Claude ha redatto o modificato il testo.
Il rilevamento diventa molto più debole su:
– Brevi frammenti di testo
– Attività di programmazione
– Testi strettamente fattuali con poche scelte di parole alternative
– Correzione di bozze leggera e riscritture complete
Inoltre, il text watermarking è completamente separato dai metadati C2PA di Anthropic per i file immagine.
Cosa dovresti fare ora
Non fare affidamento solo sui punteggi. Non considerare mai questo watermark come una prova unica di plagio o di violazione delle policy.
Quando Anthropic rilascerà la sua detector API, testala sui tuoi flussi di lavoro. Genera testi lunghi con Claude, modificali, traducili e verifica dove il segnale si interrompe. Fino ad allora, conserva registri interni chiari di prompt, file sorgente e revisioni umane.
