2. C2PA Provenance Metadata — Voor ondersteunde bestandstypen (zoals .svg, .png en .jpg) voegt Anthropic digitaal ondertekende C2PA-metadatatags toe die cryptografisch certificeren dat de inhoud door Claude is gegenereerd .
Anthropic heeft de EU AI Act-gedragscode ondertekend op grond van artikel 50(2) om te voldoen aan de nieuwe transparantieregels voor het labelen van synthetische inhoud. Het bedrijf heeft aangekondigd binnenkort detectietools uit te brengen .
De tegenreactie is hevig en valt uiteen in verschillende categorieën:
Geen opt-out en geen uitschakeling — Het watermerk zit verweven in de inferentiepijplijn van het model. Er is geen schakelaar voor gebruikers, geen API-parameter en geen enterprise-overeenkomst die het uitschakelt . Ontwikkelaars, met name degenen die Claude Code gebruiken, maakten bezwaar tegen het ongevraagd injecteren van onzichtbare metadata in hun uitvoer
.
Verkeerde toeschrijving van auteurschap — Het watermerk blijft bestaan na proeflezen of lichte bewerkingen. Critici betogen dat tekst die later door een menselijke auteur is herzien, nog steeds als 'AI-gegenereerd' kan worden gemarkeerd, wat kan leiden tot valse positieven in academische of professionele omgevingen .
Onterechte beschuldigingen in situaties met hoge inzet — Studenten en professionals overspoelden sociale media met de kreet dat dit een 'grote ramp' is, uit angst dat automatische detectietools ten onrechte legitiem menselijk werk zullen bestraffen .
Verlies van controle voor ontwikkelaars — Vooraanstaande ontwikkelaars, waaronder Nick Dobos van The Browser Company, maakten principieel bezwaar: 'Ik wil geen onzichtbare informatie in mijn code-uitvoer' .
Onbewezen detectienauwkeurigheid — Anthropic heeft zijn detector nog niet vrijgegeven, dus het is onmogelijk om de fout-positieve percentages of de algehele betrouwbaarheid onafhankelijk te verifiëren .
Binnen enkele dagen na de aankondiging verscheen er een golf van tools om het watermerk te verwijderen. Hun effectiviteit is echter sterk beperkt.
claude-watermark-cleaner (GitHub) — Binnen 24 uur uitgebracht door ontwikkelaar mikiane. Het voert een of twee herschrijfrondes uit op de Claude-uitvoer met een ander model totdat ongeveer 70% van het statistische watermerk is verzwakt. De repository heeft inmiddels meer dan 4.500 sterren .
Algemene herschrijf-/parafraseertools — Diensten zoals Haimaker en Rephrasey bevelen een driefasenproces aan: verborgen Unicode-tekens verwijderen, de tekst herschrijven met een niet-Claude-model en C2PA/EXIF-metadata uit bestanden verwijderen .
Het 'slangenolie'-probleem — Beveiligingsonderzoekers bij BleepingComputer en daily.dev benadrukken dat bijna alle huidige verwijderprogramma's alleen oppervlakkige artefacten kunnen verwijderen (verborgen Unicode-tekens, bestandsmetadata), niet het diepe statistische watermerk dat in de woordkeuze is ingebed. Alleen volledige, betekenisbehoudende herschrijvingen hebben een kans om het te verzwakken, en geen enkele tool kan betrouwbaar bewijzen dat het watermerk is verwijderd zolang Anthropic zijn detectietool niet heeft uitgebracht .
Gevestigde ontwijkingsdiensten — Ten minste één reeds bestaande dienst voor het ontwijken van AI-detectie is ook overgestapt op het claimen van Claude-watermerkverwijdering, maar onafhankelijke verificatie blijft onmogelijk zonder een officiële detector .
De kernspanning blijft bestaan: zonder een openbare detector van Anthropic kan geen enkel tool geloofwaardig bewijzen dat het het watermerk heeft verwijderd. Het statistische signaal is verweven in de woordkeuze zelf, niet toegevoegd als verwijderbare metadata – en dat onderscheid is het hele verhaal.