Allt fler verktyg hävdar nu att de kan ta bort AI-vattenstämplar från text och filer. Nästan inget av dem kan dock visa att de faktiskt lyckas kringgå Anthropics nya osynliga vattenstämpel för Claude.
Marknaden växte fram kort efter att Anthropic införde innehållsmärkning i sina senaste Claude-modeller. Den omfattar projekt med öppen källkod, nyregistrerade webbplatser och kommersiella tjänster som hjälper användare att undvika AI-detektering.
Användarna kan dock inte själva verifiera de flesta påståenden. Anthropic har inte offentliggjort tekniska detaljer om textvattenstämpeln eller något publikt detekteringsverktyg som kan bekräfta om ett dokument fortfarande innehåller märkningen.
Nya verktyg lovar att ta bort vattenstämplar
Ett av de största projekten är watermarks-remover, ett verktyg med öppen källkod som skapats av Memo-grundaren Guillaume Meyer. Projektet har fått fler än 4 500 stjärnor på GitHub och uppger att det stöder flera typer av information om AI-innehållets ursprung.
Andra kodarkiv och webbplatser har dykt upp med liknande löften, inklusive verktyg som specifikt riktar sig mot innehåll genererat av Claude. Vissa kommersiella tjänster hävdar också att de kan ta bort Claude-vattenstämplar eller skapa AI-text som inte går att upptäcka.
Dessa påståenden bygger dock ofta på tester med vanliga AI-detektorer snarare än Anthropics eget system för vattenmärkning.
Skillnaden är viktig. En text kan få ett lågt resultat hos en generell AI-detektor och samtidigt behålla en vattenstämpel som ett framtida verktyg för ursprungsdetektering kan identifiera.
Flera tjänster varnar också användarna för att inget verktyg kan garantera en fullständig kringgång eftersom detekteringsmodeller och metoder förändras över tid.
Att ta bort metadata är inte samma sak som att ta bort vattenstämplar
Många verktyg för borttagning av AI-vattenstämplar kan utföra uppgifter som är enkla att verifiera. De kan rensa bort dolda Unicode-tecken, blanksteg med noll bredd, dubbelriktade kontrolltecken och liknande osynligt innehåll från text.
De kan även ta bort C2PA-, EXIF- och XMP-metadata från filer som bilder, dokument och PDF-filer.
Det kan radera signerad information om en fils ursprung. Metadata kan dock försvinna genom en enkel omsparning, formatkonvertering eller skärmdump. Att metadata har tagits bort bevisar därför inte att en djupare AI-vattenstämpel i texten har besegrats.
Anthropics vattenstämpel för Claude fungerar på ett annat sätt. Den lagras inte i dolda tecken eller filmetadata. I stället bäddas den in i modellens ordval och strukturen i det genererade språket.
För att ta bort den skulle texten därför sannolikt behöva skrivas om eller parafraseras i stor omfattning, exempelvis genom en annan modell. Då har den ursprungliga formuleringen förändrats, vilket gör påståenden om enkel borttagning med ett enda klick missvisande.
Publik verifiering är ännu inte möjlig
Meyer har uppgett att hans projekt för närvarande tar bort metadata snarare än Anthropics underliggande textmärkning. Andra tjänster har gjort mer långtgående påståenden trots att det saknas ett publikt verktyg för att upptäcka Claudes vattenstämpel.
Oberoende granskningar har redan hittat brister i vissa verktyg för textrensning. I ett fall undersökte forskare koden bakom ett populärt verktyg och upptäckte att det inte lyckades ta bort en vanlig typ av dolt textinnehåll.
Det visar skillnaden mellan marknadsföringspåståenden och verifierbara resultat. Utan ett publikt detekteringsverktyg kan användarna inte bekräfta om ett verktyg faktiskt har tagit bort vattenstämpeln eller bara ändrat dokumentets metadata och formatering.
EU:s AI-förordning driver på innehållsmärkning
Anthropic införde osynliga vattenstämplar för text som genereras av Claude-modeller lanserade den 2 augusti 2026 eller senare. Företaget lägger även till signerad C2PA-metadata om innehållets ursprung i filtyper som stöds.
Åtgärderna är ett svar på transparenskraven i artikel 50 i EU:s AI-förordning. Kraven började gälla den 2 augusti och överträdelser kan leda till böter på upp till 15 miljoner euro eller 3 procent av den globala årsomsättningen.
Anthropic uppger att en upptäckt märkning visar att Claude har bearbetat innehållet, inte nödvändigtvis att modellen har skrivit varje ord. En grammatikkontroll, översättning, sammanfattning eller omskrivning kan därför resultera i märkt innehåll.
Företaget medger också att omfattande redigering, parafrasering och översättning kan ta bort märkningen. Anthropic har uppgett att företaget ska stödja detektering från tredje part och publicera ytterligare dokumentation.
Ogranskade verktyg kan innebära risker för leveranskedjan
Den snabba ökningen av verktyg för borttagning av AI-vattenstämplar skapar ytterligare en risk utöver frågor om innehållets ursprung och akademiskt missbruk.
Vissa projekt distribueras som agentfunktioner eller verktyg som användare lägger till direkt i lokala AI-arbetsflöden. De kan kräva att användaren kör kod, installerar beroenden eller laddar ner stora filer från tredje part.
Det gör dem till en potentiell risk för mjukvaruleveranskedjan. Även projekt med öppen källkod bör granskas noggrant innan de installeras eller får åtkomst till känsliga dokument.
De nuvarande verktygen kan vara öppna och möjliga att granska offentligt. En växande efterfrågan på borttagning av vattenstämplar kan dock locka mindre transparenta tjänster som ger överdrivna löften eller distribuerar skadlig kod.
För närvarande bör användare vara försiktiga med påståenden om att ett verktyg kan ta bort Claudes osynliga textvattenstämpel. Det finns ännu inget publikt system som kan bevisa att de flesta av dessa tjänster fungerar som utlovat.


0 svar till ”AI-verktyg för att ta bort vattenstämplar översvämmar nätet – men de flesta kan inte bevisa att de fungerar”