2. Metadati di provenienza C2PA — Per i tipi di file supportati (come .svg, .png e .jpg), Anthropic allega tag di metadati C2PA firmati digitalmente che certificano crittograficamente che il contenuto è stato generato da Claude .
Anthropic ha firmato il Codice di Condotta dell'AI Act europeo ai sensi dell'Articolo 50(2) per conformarsi alle nuove norme di trasparenza sull'etichettatura dei contenuti sintetici e ha dichiarato che rilascerà a breve strumenti di rilevamento .
Le critiche sono state feroci e articolate su diversi fronti:
Nessuna possibilità di rinuncia e nessun interruttore — La filigrana è parte integrante del processo di inferenza del modello. Non esiste un interruttore per l'utente, nessun parametro API e nessun accordo aziendale che la disattivi . Gli sviluppatori, in particolare quelli che usano Claude Code, si sono opposti all'idea che metadati invisibili vengano iniettati nei loro output senza consenso
.
Attribuzione errata della paternità — La filigrana persiste dopo la revisione o modifiche leggere. I critici sostengono che un testo successivamente rivisto da un autore umano potrebbe comunque essere segnalato come "generato dall'IA", portando a falsi positivi in contesti accademici o professionali .
False accuse in contesti delicati — Studenti e professionisti hanno invaso i social media definendo la mossa una "farsa", temendo che gli strumenti di rilevamento automatico penalizzino ingiustamente il lavoro umano legittimo .
Perdita di controllo per gli sviluppatori — Sviluppatori di spicco, tra cui Nick Dobos di The Browser Company, si sono opposti per principio: "Non voglio informazioni invisibili nel mio output di codice" .
Accuratezza di rilevamento non provata — Anthropic non ha ancora rilasciato il suo rilevatore, quindi è impossibile verificare in modo indipendente i tassi di falsi positivi o l'affidabilità complessiva .
In pochi giorni dall'annuncio è apparsa un'ondata di strumenti per la rimozione della filigrana. La loro efficacia è molto limitata.
claude-watermark-cleaner (GitHub) — Pubblicato entro 24 ore dallo sviluppatore mikiane. Esegue uno o due passaggi di riscrittura sull'output di Claude utilizzando un altro modello fino a quando circa il 70% della filigrana statistica non viene indebolita. Il repository ha superato le 4.500 stelle .
Strumenti generali di riscrittura/parafrasi — Servizi come Haimaker e Rephrasey raccomandano un processo in tre fasi: rimuovere i caratteri Unicode nascosti, riscrivere la prosa con un modello non Claude e rimuovere i metadati C2PA/EXIF dai file .
Il problema dell'"olio di serpente" — I ricercatori di sicurezza di BleepingComputer e daily.dev sottolineano che quasi tutti gli attuali strumenti di rimozione possono eliminare solo gli artefatti di superficie (caratteri Unicode nascosti, metadati dei file), non la profonda filigrana statistica incorporata nella scelta delle parole. Solo riscritture complete che preservano il significato hanno qualche possibilità di indebolirla, e nessuno può dimostrare in modo affidabile che la filigrana sia stata rimossa fino a quando Anthropic non rilascerà il suo strumento di rilevamento .
Servizi di elusione già affermati — Almeno un servizio di elusione del rilevamento IA preesistente si è riconvertito per rivendicare la rimozione della filigrana di Claude, ma la verifica indipendente rimane impossibile senza un rilevatore ufficiale .
La tensione di fondo rimane: senza un rilevatore pubblico di Anthropic, nessuno strumento può dimostrare in modo credibile di aver rimosso la filigrana. Il segnale statistico è intessuto nella scelta delle parole stesse, non aggiunto come metadati rimovibili—ed è questa distinzione che fa la differenza.