La peur d'être détecté au travail ou à l'école. La plainte la plus personnelle : les utilisateurs craignent que leurs employeurs, professeurs ou clients n'utilisent ce filigrane pour détecter un usage non divulgué de l'IA dans des écrits professionnels, des livrables clients ou des devoirs scolaires . Beaucoup ont décrit publiquement le sentiment de se faire « prendre à tricher » à leur travail ou en cours
. L'influenceur en mathématiques John Ennis a posté la capture d'écran de l'annulation de son abonnement Claude Max, citant « l'idée ridicule du filigrane »
.
Un système trop large qui marque même l'humain. Charles Hoskinson lui-même a démontré le problème avant de publier son outil de riposte. Il a testé le système sur un texte qu'il avait lui-même écrit en 2016 — un contenu purement humain — et Claude l'a marqué comme généré par IA après un simple passage de correction . Si un utilisateur télécharge son propre texte et demande à Claude de le corriger, le résultat est re-marqué comme provenant de l'IA
.
Des questions de propriété et de droit. Les conditions d'utilisation d'Anthropic lient la propriété des productions à la conformité avec les politiques de l'entreprise . Une nouvelle ligne de métadonnées « Co-Authored-By: Claude » dans les fichiers Git et autres productions crée une incertitude juridique sur l'identité du véritable auteur
. Les critiques estiment que le filigrane confond travail assisté par IA et travail généré par IA, soulevant des questions de droits d'auteur
.
SynthID-Text de Google DeepMind est un système de filigrane textuel pour grands modèles de langages (LLM) prêt pour la production, décrit dans un article évalué par des pairs dans Nature et rendu open source en octobre 2024 . Ce n'est pas la même technologie qu'Anthropic utilise, mais c'est l'exemple le mieux documenté du type de filigrane qu'Anthropic déploie.
Le « tournament sampling » (échantillonnage par tournoi) est le mécanisme clé. Pendant la génération de texte, une clé secrète biaise le processus de sélection des tokens (unités de texte) par le modèle. Lorsque plusieurs tokens sont statistiquement aussi plausibles, la clé détermine de manière déterministe le « gagnant » parmi les choix, créant ainsi un motif subtil et reproductible . Le filigrane est une empreinte statistique intégrée dans la distribution des choix de mots eux-mêmes — il n'y a pas de chaîne de caractères cachée, de caractère invisible ou de code ajouté
.
La détection nécessite la clé correspondante. Un détecteur utilisant la même clé secrète évalue la distribution des tokens du texte pour déterminer la probabilité qu'il ait été généré par le modèle filigrané . Le système utilise soit un détecteur à moyenne pondérée (qui ne nécessite pas d'apprentissage), soit un détecteur bayésien plus puissant
.
Conçu pour survivre aux manipulations. Le filigrane est conçu pour persister après des copier-coller, des modifications légères ou un reformatage . Mais il n'est pas indestructible — une réécriture intensive, un mélange avec du texte humain ou un retraitement par une autre IA peut le diluer ou le supprimer
.
Charles Hoskinson, fondateur de Cardano, a publié un outil open source nommé « Anthropies » — un mot-valise délibéré entre Anthropic et herpes — le 16 août 2026 .
Une attaque en trois couches. L'outil, publié sous licence Apache 2.0 sur GitHub, traite trois types de marqueurs :
Un argumentaire juridique, pas seulement du code. Environ la moitié du dépôt ne serait pas du code, mais un argumentaire juridique attaquant les conditions d'utilisation d'Anthropic — en particulier la clause qui lie la propriété des productions à la conformité avec les politiques de l'entreprise . Hoskinson a présenté sa publication sur X comme un avertissement sur ce qu'il considère comme un abus de pouvoir, et pas seulement comme un outil utilitaire
.
Des limites honnêtes. Le projet note qu'il ne peut garantir un contournement complet des systèmes de détection non divulgués d'Anthropic . Comme le README d'Hoskinson le reconnaît efficacement : « La marque, c'est le texte lui-même. Il n'y a pas de charge utile séparée à supprimer. La supprimer signifie changer les mots qui sont là »
.
Le filigrane d'Anthropic est l'une des premières mises en œuvre à grande échelle des exigences de transparence de l'AI Act européen, et la controverse révèle une tension profonde. La même technologie qui rend la provenance de l'IA vérifiable la rend aussi inéluctable — et pour des millions de professionnels, d'étudiants et de créateurs qui utilisent Claude comme outil de productivité, c'est une fonctionnalité dont ils ne veulent pas.
La question de savoir si des outils comme Anthropies résisteront aux futures améliorations du filigrane, et si les régulateurs considéreront le retrait du filigrane comme une infraction plutôt qu'un droit de l'utilisateur, sont des questions auxquelles seuls le temps et les tribunaux apporteront une réponse.