Et stigende antal værktøjer hævder nu, at de kan fjerne AI-vandmærker fra tekst og filer. Næsten ingen af dem kan dog dokumentere, at de faktisk kan omgå Anthropics nye usynlige vandmærke til Claude.
Markedet voksede frem kort efter, at Anthropic indførte indholdsmærkning i sine nyeste Claude-modeller. Det omfatter open source-projekter, nyregistrerede websites og kommercielle tjenester, der hjælper brugere med at undgå AI-detektion.
Brugerne kan dog ikke selv verificere de fleste påstande. Anthropic har ikke offentliggjort tekniske detaljer om tekstvandmærket eller et offentligt detektionsværktøj, der kan bekræfte, om et dokument stadig indeholder mærkningen.
Nye værktøjer lover at fjerne vandmærker
Et af de største projekter er watermarks-remover, et open source-værktøj udviklet af Memo-grundlægger Guillaume Meyer. Projektet har fået mere end 4.500 stjerner på GitHub og oplyser, at det understøtter flere former for oplysninger om AI-indholds oprindelse.
Andre kodearkiver og websites er dukket op med lignende løfter, herunder værktøjer, der specifikt er rettet mod Claude-genereret indhold. Nogle kommercielle tjenester hævder også, at de kan fjerne Claude-vandmærker eller producere AI-tekst, som ikke kan opdages.
Disse påstande bygger dog ofte på tests med almindelige AI-detektorer frem for Anthropics eget vandmærkesystem.
Forskellen er vigtig. En tekst kan få en lav score hos en generel AI-detektor og samtidig bevare et vandmærke, som et fremtidigt værktøj til registrering af indholdets oprindelse kan identificere.
Flere tjenester advarer også brugerne om, at intet værktøj kan garantere en fuldstændig omgåelse, fordi detektionsmodeller og metoder ændrer sig over tid.
Fjernelse af metadata er ikke det samme som fjernelse af vandmærker
Mange værktøjer til fjernelse af AI-vandmærker kan udføre opgaver, som er nemme at verificere. De kan fjerne skjulte Unicode-tegn, mellemrum med nul bredde, bidirektionelle kontroltegn og lignende usynligt indhold fra tekst.
De kan også fjerne C2PA-, EXIF- og XMP-metadata fra filer som billeder, dokumenter og PDF-filer.
Det kan fjerne signerede oplysninger om en fils oprindelse. Metadata kan dog forsvinde ved en simpel genlagring, formatkonvertering eller et skærmbillede. Fjernelse af metadata beviser derfor ikke, at et dybere AI-vandmærke i teksten er blevet fjernet.
Anthropics Claude-vandmærke fungerer anderledes. Det gemmes ikke i skjulte tegn eller filmetadata. I stedet indlejres det i modellens ordvalg og strukturen i det genererede sprog.
For at fjerne det vil teksten derfor sandsynligvis skulle omskrives eller parafraseres i betydelig grad, eksempelvis gennem en anden model. På det tidspunkt er den oprindelige formulering blevet ændret, hvilket gør påstande om enkel fjernelse med ét klik misvisende.
Offentlig verificering er endnu ikke mulig
Meyer har oplyst, at hans projekt i øjeblikket fjerner metadata frem for Anthropics underliggende tekstmærkning. Andre tjenester er kommet med mere vidtgående påstande, selv om der ikke findes en offentlig detektor til Claudes vandmærke.
Uafhængige undersøgelser har allerede fundet svagheder i visse værktøjer til tekstrensning. I ét tilfælde undersøgte forskere koden bag et populært værktøj og fandt, at det ikke kunne fjerne en almindelig type skjult tekstindhold.
Det viser forskellen mellem markedsføringspåstande og verificerbare resultater. Uden et offentligt detektionsværktøj kan brugerne ikke bekræfte, om et værktøj faktisk har fjernet vandmærket eller blot ændret dokumentets metadata og formatering.
EU’s AI-forordning driver udviklingen af indholdsmærkning
Anthropic indførte usynlige vandmærker til tekst genereret af Claude-modeller lanceret den 2. august 2026 eller senere. Virksomheden tilføjer også signerede C2PA-metadata om indholdets oprindelse til understøttede filtyper.
Tiltagene er et svar på gennemsigtighedskravene i artikel 50 i EU’s AI-forordning. Kravene trådte i kraft den 2. august og kan medføre bøder på op til 15 millioner euro eller 3 procent af den globale årlige omsætning.
Anthropic oplyser, at et registreret mærke viser, at Claude har behandlet indholdet, ikke nødvendigvis at modellen har skrevet hvert eneste ord. En grammatikkontrol, oversættelse, opsummering eller omskrivning kan derfor resultere i mærket indhold.
Virksomheden erkender også, at omfattende redigering, parafrasering og oversættelse kan fjerne mærket. Anthropic har oplyst, at virksomheden vil understøtte tredjepartsdetektion og offentliggøre yderligere dokumentation.
Ukontrollerede værktøjer kan skabe risiko i softwareforsyningskæden
Den hurtige vækst i værktøjer til fjernelse af AI-vandmærker skaber en anden bekymring ud over regler om indholdets oprindelse og akademisk misbrug.
Nogle projekter distribueres som agentfunktioner eller værktøjer, som brugere føjer direkte til lokale AI-arbejdsgange. De kan bede brugerne om at køre kode, installere afhængigheder eller downloade store filer fra tredjeparter.
Det gør dem til en potentiel risiko for softwareforsyningskæden. Selv open source-projekter bør gennemgås grundigt, før de installeres eller får adgang til følsomme dokumenter.
De nuværende værktøjer kan være åbne og offentligt tilgængelige for gennemgang. En stigende efterspørgsel efter fjernelse af vandmærker kan dog tiltrække mindre gennemsigtige tjenester, som kommer med overdrevne løfter eller distribuerer skadelig kode.
Indtil videre bør brugere være forsigtige med påstande om, at et værktøj kan fjerne Claudes usynlige tekstvandmærke. Der findes endnu ikke noget offentligt system, som kan bevise, at de fleste af disse tjenester fungerer som lovet.


0 svar til “AI-værktøjer til at fjerne vandmærker oversvømmer nettet – men de fleste kan ikke bevise, at de virker”