Anthropic utilizza approcci tecnici diversi per il testo e per i file generati .
Watermarking (filigrana) del testo. Quando un modello Claude supportato genera del testo, intreccia un segnale impercettibile direttamente nella sequenza dei token . La filigrana è invisibile all'occhio umano durante la lettura normale e non altera il significato, la qualità o la leggibilità della risposta . Il marchio segue le parole quando l'utente copia e incolla il testo altrove, ed è progettato per essere rilevabile dalle macchine tramite uno strumento di rilevamento specializzato .
Metadati di provenienza per i file. Per i tipi di file generati, in particolare .svg, .png e .jpg, Claude allega metadati di provenienza C2PA (Coalition for Content Provenance and Authenticity) firmati . Questa firma crittografica è incorporata nei metadati del file e può segnalare se il file è stato elaborato da Claude e se è stato manomesso .
Sebbene l'iniziativa sui watermark sia una risposta diretta ai requisiti dell'UE, Anthropic la sta applicando in tutto il mondo. "La marcatura si applicherà all'output dei modelli supportati ovunque Claude sia disponibile, a livello globale", ha dichiarato l'azienda .
Anthropic ha dichiarato esplicitamente che queste marcature non sono una prova conclusiva dell'origine artificiale . Diversi limiti fondamentali ne riducono l'affidabilità:
Il lancio è una risposta diretta di conformità all'articolo 50 dell'AI Act UE, i cui obblighi di trasparenza sono diventati esecutivi il 2 agosto 2026 .
Cosa richiede l'articolo 50:
I fornitori di sistemi di IA generativa devono garantire che i loro output siano contrassegnati con "marchi leggibili dalle macchine efficaci, affidabili, robusti e interoperabili" che consentano di rilevare gli output come generati o manipolati dall'IA . Alcuni contenuti generati o manipolati dall'IA devono anche riportare etichette chiare e visibili per gli utenti finali .
Le regole si applicano a qualsiasi sistema di IA immesso sul mercato o messo in servizio nell'UE, indipendentemente da dove abbia sede il fornitore, conferendo alla legge un effetto extraterritoriale . La non conformità può comportare multe fino a 15 milioni di euro o al 3% del fatturato annuo mondiale .
La Commissione Europea ha pubblicato le linee guida ufficiali il 20 luglio 2026 e ha confermato il Codice di condotta sulla trasparenza dei contenuti generati dall'IA come mezzo adeguato per dimostrare la conformità . Sebbene l'adesione al codice sia volontaria, i requisiti di trasparenza dell'articolo 50 sono obblighi di legge .
L'approccio di Anthropic alla conformità:
L'implementazione globale di Anthropic significa che gli utenti di Claude in tutto il mondo, non solo in Europa, vedranno queste marcature . L'azienda ha firmato il Codice di condotta UE sulla trasparenza, che funge da percorso di conformità volontaria ai sensi dell'articolo 56 . I nuovi modelli Claude supportano la marcatura al momento del lancio e i modelli più vecchi vengono aggiornati .
Per chiunque utilizzi Claude o incontri i suoi risultati, questi watermark aggiungono un livello di tracciabilità, ma non di certezza. La realtà pratica è che un utente determinato può rimuovere la filigrana del testo o i metadati del file con semplici operazioni di post-elaborazione. Le marcature sono più utili come deterrente e come misura di conformità di base: rendono più facile identificare i contenuti generati casualmente dall'IA senza disturbare l'esperienza di lettura normale.
Il significato più ampio per il settore è che la mossa di Anthropic rappresenta una delle prime implementazioni su larga scala di trasparenza obbligatoria dei contenuti IA ai sensi dell'AI Act UE. Altri fornitori dovranno implementare misure simili, e i limiti tecnici e pratici riconosciuti da Anthropic diventeranno probabilmente centrali nel dibattito in corso su quanto queste norme di trasparenza siano realmente applicabili e utili.