Il 14 agosto 2026 Anthropic ha pubblicato i dettagli su un nuovo sistema di watermarking del testo integrato in Claude. È già attivo su tutti i modelli Claude rilasciati dopo il 2 agosto 2026 e verrà distribuito sui modelli precedenti nei prossimi mesi. Progettato per soddisfare i requisiti di trasparenza previsti dall'Articolo 50 dell'AI Act dell'UE, il sistema è abilitato a livello globale.
Il dettaglio più rilevante dell'annuncio riguarda ciò che questo watermark non è: Anthropic non inserisce spazi a larghezza zero, tag Unicode nascosti o metadati invisibili nella stringa di output. (Gli output di immagini e file si basano sui metadati standard C2PA, gestiti tramite una pipeline separata.) Al contrario, il watermark del testo di Claude è puramente statistico.
Ecco l'aspetto centrale di questo meccanismo: il watermark del testo di Anthropic non aggiunge nulla al testo, ma modifica il modo in cui Claude seleziona la parola successiva. L'unico modo affidabile per rimuoverlo è affidarsi a un sistema indipendente che ricostruisca la bozza mantenendo l'esatto significato originale, in modo che ogni singola parola venga selezionata nuovamente. Questa ricostruzione semantica è alla base della progettazione di Pro Text Watermark Remover.
Per comprendere perché i normali strumenti di pulizia falliscono con i testi più recenti di Claude, occorre distinguere tra residui di formattazione e campionamento statistico.
Due fenomeni completamente diversi definiti "watermark"
Quando si parla di "watermark dell'IA", spesso si confondono due aspetti tecnici privi di correlazione.
| Categoria | Meccanismo | Rilevabilità | Metodo di rimozione |
|---|---|---|---|
| Residui di formattazione e Unicode | Caratteri effettivi incollati dalle interfacce web degli LLM (ad es. lo spazio unificatore sottile U+202F di ChatGPT, caratteri a larghezza zero, spaziature anomale). | Completamente rilevabile in locale tramite la scansione dei codici dei caratteri. | Sanitizzazione Unicode ed espressioni regolari eseguite nel browser. |
| Watermark da campionamento statistico | Deviazione matematica applicata durante la generazione dei token (sistema 2026 di Claude; ricerca di Google DeepMind su Nature). | Invisibile in locale; richiede la chiave segreta di verifica del fornitore del modello. | Ricostruzione a parità di significato che ricampiona ogni singola parola. |
La prima categoria è costituita da elementi residui di formattazione. Quando copi del testo da determinate interfacce web, spesso trascini caratteri Unicode nascosti, interruzioni di riga non uniformi o spazi specifici come U+202F. Si tratta di caratteri fisicamente presenti nel buffer degli appunti. È possibile individuarli, evidenziarli ed eliminarli con una semplice sostituzione di stringhe.
La seconda categoria corrisponde al nuovo sistema di Claude. Non ci sono caratteri anomali da eliminare. Il testo è composto interamente da normali parole leggibili. Il watermark risiede esclusivamente nella relazione statistica che lega tali parole.
Come funziona il watermarking statistico di Claude
Sebbene Anthropic mantenga riservate le proprie chiavi di attribuzione del punteggio, l'architettura di base si fonda sulle ricerche relative all'orientamento pseudo-casuale dei token (come il modello descritto nello studio sul watermarking pubblicato su Nature nel 2024).
Quando Claude genera una risposta, calcola una distribuzione di probabilità per il token successivo. Prima di selezionare una parola, l'algoritmo impiega i token precedenti e la chiave crittografica segreta di Anthropic per suddividere in modo deterministico il vocabolario in gruppi pseudo-casuali (spesso definiti elenchi "verdi" e "rossi"). Quindi, incrementa leggermente le probabilità di selezione a favore del gruppo "verde".
Per un lettore umano, il testo risulta del tutto naturale. Tuttavia, nell'arco di alcune centinaia di parole, una percentuale statisticamente anomala di token ricade nell'elenco verde.
Anthropic non ha ancora reso disponibile la propria API di verifica pubblica, ma quando lo farà, il rilevamento richiederà la chiave privata di Anthropic per analizzare tale inclinazione statistica. Esistono importanti limiti operativi:
- Il servizio di rilevamento può unicamente stimare se Claude è intervenuto nella generazione del brano.
- Non può dimostrare la paternità umana del testo.
- Non può rilevare testi generati da altri fornitori di IA.
- È profondamente diverso dai rilevatori di "stile IA" basati su classificatori come Pangram o GPTZero, che ipotizzano schemi stilistici generali invece di verificare una sequenza crittografica di token.
Perché l'eliminazione dei caratteri e le modifiche superficiali non funzionano
Poiché il watermark di Claude non lascia alcuna traccia fisica nel testo, le procedure di pulizia tradizionali risultano inefficaci:
- Gli strumenti di pulizia Unicode non rilevano nulla da rimuovere. Non è possibile eliminare un carattere nascosto inesistente.
- La semplice sostituzione dei sinonimi preserva la distribuzione. Sostituire tre aggettivi o eliminare una frase introduttiva lascia inalterate le sequenze di token circostanti. La stessa documentazione di Anthropic segnala che modifiche superficiali lasciano spesso un segnale statistico sufficiente per il rilevamento.
- Le modifiche alla punteggiatura o alle maiuscole non cambiano nulla. Sostituire virgole con punti e virgola o modificare le maiuscole non altera la scelta delle parole che costituisce l'impronta statistica.
Se Claude ha redatto il testo da zero o lo ha tradotto in un'altra lingua, ha scelto personalmente ogni singola parola. Quella sequenza di token conserva il watermark finché tali specifiche scelte lessicali non vengono modificate.
Ricostruire il testo con l'IA
La documentazione di supporto di Anthropic conferma espressamente il principio opposto alla persistenza del watermark: una riscrittura completa che modifichi ogni parola elimina la traccia statistica.
È proprio qui che interviene Text Watermark Remover:
[Claude Watermarked Draft]
│
▼
[Semantic Extraction] ── (Isolates logic, facts, arguments, structure)
│
▼
[Independent Re-sampling] ── (Generates brand-new token sequence via distinct model)
│
▼
[Clean Reconstructed Output]Invece di eseguire sostituzioni superficiali di stringhe, il motore Pro estrae il contenuto semantico essenziale — tesi principali, fatti, struttura logica e dettagli tecnici — e rigenera l'intera bozza da zero attraverso una pipeline di IA indipendente. Poiché un modello del tutto diverso seleziona ciascun token in base a una distribuzione non orientata, l'alterazione statistica iniziale viene eliminata.
Come è strutturata la nostra suite di strumenti
- Scansione gratuita (nel browser): individua e ripulisce circa 60 codepoint Unicode invisibili (incluso
U+202F), rimuovendo residui di copia da web e anomalie Markdown. Funziona interamente nel browser. - AI Text Watermark Detector: dedicato esclusivamente all'individuazione di caratteri Unicode e residui di formattazione. Non è un classificatore statistico e non rileva il watermark da campionamento di Anthropic.
- Pro Text Watermark Remover: la soluzione principale per i watermark statistici. Esegue una ricostruzione completa a parità di significato, selezionando da capo ogni singolo token.
- AI Humanizer: uno strumento complementare progettato per adattare tono, ritmo e naturalezza espressiva. Modifica lo stile del testo, ma la ricostruzione semantica completa resta la soluzione diretta per i watermark statistici a livello di token.
Limitazioni chiare e trasparenti
Privilegiamo la trasparenza tecnica rispetto alle promesse promozionali:
- La scansione gratuita non può rimuovere il watermark statistico ufficiale di Claude.
- La ricostruzione a parità di significato soddisfa la soglia di riscrittura completa indicata dai ricercatori, ma una parafrasi parziale potrebbe comunque lasciare deboli tracce statistiche in casi limite.
- Non disponiamo della chiave privata di Anthropic e non rilasciamo certificati ufficiali di superamento della verifica.
- Non garantiamo la rimozione assoluta né l'elusione certa di rilevatori di IA di terze parti (quali Turnitin, GPTZero o Pangram).
- Il testo ricostruito è una generazione ex novo; non costituisce una prova legale o empirica di redazione umana.
Quando non è necessario riscrivere
Non tutti i testi generati da Claude richiedono una ricostruzione. In molti scenari pratici, il watermark risulta inesistente o del tutto ininfluente:
- Testi brevi (< 100–200 parole): i watermark statistici richiedono un campione di dimensioni adeguate per calcolare un'affidabilità statistica. Gli output molto brevi non presentano la densità matematica necessaria per un rilevamento attendibile.
- Elenchi ricchi di dati, tabelle e codice: quando genera funzioni Python, query SQL o dati tabulari, il vocabolario del modello è fortemente vincolato dalla sintassi e dalla logica. In contesti a bassa entropia, il watermarking è fisiologicamente debole o disattivato.
- Revisione leggera di bozze umane: se scrivi una bozza e chiedi a Claude di correggere i refusi o adattare la grammatica, il modello interviene su frasi già esistenti anziché scegliere ogni singola parola. Il watermark non si fissa in modo significativo sulle revisioni guidate dall'utente. (La traduzione, al contrario, include il watermark, poiché Claude genera l'intero vocabolario di arrivo.)
- Bozze di lavoro interne: se un documento è destinato ad appunti personali, brainstorming o revisione interna, tentare di rimuovere le tracce matematiche rappresenta un'attività superflua.
Riepilogo e passaggi successivi
Il watermark del testo di Anthropic è una tecnica matematica avanzata, ma il suo confine operativo è lineare: risiede nella specifica sequenza di parole selezionata da Claude. Modificando tale sequenza e conservando il significato originale, il watermark cessa di esistere.
Se devi gestire residui di appunti e caratteri invisibili, puoi usare i nostri strumenti gratuiti via browser. Se hai l'esigenza di eliminare le tracce di campionamento statistico dai contenuti generati con Claude, affidati alla nostra procedura di ricostruzione Pro.
- Consulta la guida dedicata a Claude Watermark Remover.
- Verifica i dettagli dei piani sulla nostra Pagina dei prezzi.
- Analizza le tue bozze alla ricerca di caratteri nascosti con l'AI Text Watermark Detector.
Dichiarazione di non responsabilità: AI Text Watermark Remover è un'utilità indipendente di terze parti e non è affiliata, approvata o sponsorizzata da Anthropic, OpenAI o Google.
Fonti ufficiali e riferimenti tecnici
- Annuncio ufficiale di Anthropic (14/08/2026): https://www.anthropic.com/news/claude-text-watermark
- Centro assistenza di Claude — Come Claude contrassegna i contenuti: https://support.claude.com/en/articles/16266773-how-claude-marks-ai-generated-content
- Studio di ricerca su Nature sul watermarking dei modelli linguistici: https://www.nature.com/articles/s41586-024-08025-4



