Et økende antall verktøy hevder nå at de kan fjerne AI-vannmerker fra tekst og filer. Nesten ingen av dem kan imidlertid vise at de faktisk klarer å omgå Anthropics nye usynlige vannmerke for Claude.
Markedet vokste frem kort tid etter at Anthropic innførte innholdsmerking i sine nyeste Claude-modeller. Det omfatter åpen kildekode-prosjekter, nyregistrerte nettsteder og kommersielle tjenester som hjelper brukere med å unngå AI-deteksjon.
Brukerne kan imidlertid ikke selv verifisere de fleste påstandene. Anthropic har ikke offentliggjort tekniske detaljer om tekstvannmerket eller et offentlig deteksjonsverktøy som kan bekrefte om et dokument fortsatt inneholder merkingen.
Nye verktøy lover å fjerne vannmerker
Et av de største prosjektene er watermarks-remover, et åpen kildekode-verktøy utviklet av Memo-grunnlegger Guillaume Meyer. Prosjektet har fått mer enn 4 500 stjerner på GitHub og oppgir at det støtter flere former for informasjon om AI-innholds opprinnelse.
Andre kodearkiver og nettsteder har dukket opp med lignende løfter, inkludert verktøy som spesifikt retter seg mot Claude-generert innhold. Enkelte kommersielle tjenester hevder også at de kan fjerne Claude-vannmerker eller produsere AI-tekst som ikke kan oppdages.
Disse påstandene bygger imidlertid ofte på tester mot vanlige AI-detektorer fremfor Anthropics eget vannmerkesystem.
Forskjellen er viktig. En tekst kan få en lav score hos en generell AI-detektor og samtidig beholde et vannmerke som et fremtidig verktøy for opprinnelsesdeteksjon kan identifisere.
Flere tjenester advarer også brukerne om at ingen verktøy kan garantere fullstendig omgåelse fordi deteksjonsmodeller og metoder endrer seg over tid.
Fjerning av metadata er ikke det samme som fjerning av vannmerker
Mange verktøy for fjerning av AI-vannmerker kan utføre oppgaver som er enkle å verifisere. De kan fjerne skjulte Unicode-tegn, mellomrom med null bredde, toveis kontrolltegn og lignende usynlig innhold fra tekst.
De kan også fjerne C2PA-, EXIF- og XMP-metadata fra filer som bilder, dokumenter og PDF-filer.
Dette kan fjerne signert informasjon om en fils opprinnelse. Metadata kan imidlertid forsvinne ved enkel lagring på nytt, formatkonvertering eller et skjermbilde. Fjerning av metadata beviser derfor ikke at et dypere AI-vannmerke i teksten er fjernet.
Anthropics Claude-vannmerke fungerer annerledes. Det lagres ikke i skjulte tegn eller filmetadata. I stedet bygges det inn i modellens ordvalg og strukturen i det genererte språket.
For å fjerne det vil teksten derfor sannsynligvis måtte skrives om eller parafraseres i betydelig grad, for eksempel gjennom en annen modell. Da har den opprinnelige formuleringen blitt endret, noe som gjør påstander om enkel fjerning med ett klikk misvisende.
Offentlig verifisering er ennå ikke mulig
Meyer har sagt at prosjektet hans foreløpig fjerner metadata fremfor Anthropics underliggende tekstmerking. Andre tjenester har kommet med mer omfattende påstander til tross for at det ikke finnes noen offentlig detektor for Claude-vannmerket.
Uavhengige undersøkelser har allerede avdekket svakheter i enkelte verktøy for tekstrensing. I ett tilfelle undersøkte forskere koden bak et populært verktøy og fant at det ikke klarte å fjerne en vanlig type skjult tekstinnhold.
Dette viser forskjellen mellom markedsføringspåstander og verifiserbare resultater. Uten et offentlig deteksjonsverktøy kan brukerne ikke bekrefte om et verktøy faktisk har fjernet vannmerket eller bare endret dokumentets metadata og formatering.
EUs AI-forordning driver frem innholdsmerking
Anthropic innførte usynlige vannmerker for tekst generert av Claude-modeller lansert 2. august 2026 eller senere. Selskapet legger også til signerte C2PA-metadata om innholdets opprinnelse i støttede filtyper.
Tiltakene er et svar på kravene om åpenhet i artikkel 50 i EUs AI-forordning. Kravene trådte i kraft 2. august og kan føre til bøter på opptil 15 millioner euro eller 3 prosent av den globale årsomsetningen.
Anthropic sier at et oppdaget merke viser at Claude har behandlet innholdet, ikke nødvendigvis at modellen har skrevet hvert eneste ord. En grammatikkontroll, oversettelse, oppsummering eller omskriving kan derfor føre til merket innhold.
Selskapet erkjenner også at omfattende redigering, parafrasering og oversettelse kan fjerne merket. Anthropic har sagt at selskapet vil støtte tredjepartsdeteksjon og publisere ytterligere dokumentasjon.
Ukontrollerte verktøy kan skape risiko i programvareleverandørkjeden
Den raske veksten av verktøy for fjerning av AI-vannmerker skaper en annen bekymring i tillegg til regler om innholdsopprinnelse og akademisk misbruk.
Enkelte prosjekter distribueres som agentfunksjoner eller verktøy som brukere legger direkte til i lokale AI-arbeidsflyter. De kan be brukerne kjøre kode, installere avhengigheter eller laste ned store filer fra tredjeparter.
Dette gjør dem til en potensiell risiko for programvareleverandørkjeden. Selv åpen kildekode-prosjekter bør gjennomgås nøye før de installeres eller får tilgang til sensitive dokumenter.
Dagens verktøy kan være åpne og offentlig tilgjengelige for gjennomgang. Økende etterspørsel etter fjerning av vannmerker kan imidlertid tiltrekke seg mindre transparente tjenester som kommer med overdrevne løfter eller distribuerer skadelig kode.
Foreløpig bør brukere være forsiktige med påstander om at et verktøy kan fjerne Claudes usynlige tekstvannmerke. Det finnes ennå ikke noe offentlig system som kan bevise at de fleste av disse tjenestene fungerer som lovet.


0 responses to “AI-verktøy for å fjerne vannmerker flommer over nettet – men de fleste kan ikke bevise at de fungerer”