Le filigrane résiste au copier-coller et aux modifications légères, mais se dégrade lors de réécritures lourdes . Le blog officiel d'Anthropic décrit la méthode comme un motif statistique qui n'affecte pas la qualité du résultat et résiste aux falsifications simples
.
L'annonce a déclenché un débat houleux sur Reddit. Les utilisateurs se sont divisés en deux camps, et plusieurs médias ont couvert les arguments échangés .
La peur des étudiants et des professionnels d'être pris en flagrant délit de « triche ». De nombreux utilisateurs ont exprimé la crainte que les enseignants, les employeurs ou les détecteurs de plagiat ne repèrent les textes watermarkés de Claude, exposant ainsi les étudiants qui l'utilisent pour leurs devoirs ou les professionnels qui s'en servent pour rédiger des e-mails, des rapports ou du code . Les critiques estiment que cela crée un effet dissuasif : même un travail légitimement assisté par IA – comme un brainstorming, une édition ou une première ébauche – pourrait être considéré comme une faute
.
Le watermark s'attribue indûment le crédit du travail de l'utilisateur. Un sentiment largement partagé sur Reddit est qu'en marquant définitivement le résultat comme « généré par IA », Anthropic s'attribue de facto la paternité d'un texte que l'utilisateur a conçu, sélectionné et souvent substantiellement édité . Dan Fitzpatrick, chroniqueur chez Forbes, a résumé cette position avec une formule choc : « Le watermark prouve que Claude a été utilisé, pas qui a écrit le texte » – une distinction que les critiques jugent perdue en pratique
.
L'hypocrisie de watermarker un résultat IA quand le modèle a été entraîné sur du travail humain « scrapé ». Plusieurs commentateurs Reddit ont souligné l'ironie : Anthropic exige une traçabilité pour les sorties de l'IA, alors que Claude lui-même a été entraîné sur des milliards de mots extraits du web ouvert – dont une grande partie de contenus créés par des humains, utilisés sans consentement ni rémunération explicites . Les critiques y voient un deux poids, deux mesures : les entreprises exigent de la traçabilité pour ce que l'IA produit, mais refusent la même traçabilité ou le même crédit aux créateurs humains dont les données ont bâti leurs modèles
.
Pas de désactivation possible et une imposition mondiale. Les utilisateurs de Reddit ont critiqué l'absence de bouton ou de mécanisme de désactivation, surtout pour ceux qui se trouvent hors de l'UE et n'ont aucun mot à dire sur la réglementation qui motive ce changement . Certains ont qualifié la mesure de « complot draconien » ou de « conspiration sévère » visant des utilisateurs innocents dans le monde entier
.
Inquiétudes sur la fiabilité et les faux positifs. Des sceptiques ont mis en doute la fiabilité de la détection du filigrane, prévenant que de faux positifs pourraient injustement impliquer des personnes n'ayant jamais utilisé Claude .
La transparence et la lutte contre le « slop » sont des objectifs légitimes. Les partisans ont fait valoir que le watermarking est une réponse proportionnée à la marée montante de contenus IA indétectables qui polluent les résultats de recherche, les actualités et les soumissions académiques . Certains utilisateurs de Reddit ont noté que la méthode d'Anthropic est conçue pour être statistiquement détectable uniquement à grande échelle, et non pour identifier des utilisateurs individuels, ce qu'ils considèrent comme une conception respectueuse de la vie privée
.
Cela prouve l'utilisation, pas la culpabilité – et une réécriture poussée le neutralise. Les défenseurs ont souligné que le watermark se dégrade en cas de réécriture importante, de sorte que les utilisateurs qui éditent et adaptent réellement le résultat de Claude n'ont que peu à craindre . Le watermark prouve que Claude a été impliqué, mais ne peut à lui seul prouver une triche ou un plagiat sans contexte
.
La conformité à la loi n'est pas une option. Certains ont argumenté qu'il est déplacé de critiquer Anthropic pour avoir suivi la loi européenne : l'entreprise n'avait guère le choix si elle voulait opérer en Europe . Une partie des commentateurs Reddit a estimé que la levée de boucliers révélait que de nombreux utilisateurs comptaient sur Claude précisément parce qu'ils ne voulaient pas que leur usage de l'IA soit détectable – ce qui, en soi, est un aveu préoccupant
.
L'argument du « crédit » va dans les deux sens. Les contre-critiques ont observé que si les utilisateurs revendiquent la paternité du résultat de l'IA, le watermark n'est qu'une étiquette honnête – comme un crédit photo ou une citation . Le malaise, suggèrent-ils, vient d'utilisateurs qui veulent les bénéfices de l'IA sans transparence sur son rôle.
Les deux camps s'accordent largement sur un point : la politique de watermarking change fondamentalement la relation entre les utilisateurs et les outils d'IA, passant d'un modèle de confiance implicite à une attribution permanente et lisible par machine. Reste à savoir si ce virage est un pas nécessaire vers la responsabilité ou un mécanisme de surveillance qui punit l'utilisateur moyen tandis que les plus avertis trouveront toujours un moyen de le contourner.