Kan Claude bevise at en tekst er skrevet av AI?

Kan vi snart lime inn en tekst og få et sikkert svar: «Denne skrev Claude»?
Kort svar: Nei.
Anthropic har varslet at framtidige Claude-modeller skal legge igjen et usynlig vannmerke i teksten. Vannmerket kan gjøre det mulig å anslå hvor sannsynlig det er at Claude var involvert. Det kan fortsatt ikke bevise hvem som skrev teksten, hvem som brukte modellen eller hvor mye et menneske gjorde selv.
Den forskjellen er viktig.
Vannmerket ligger i ordvalgene
Dette er ikke skjulte bokstaver, metadata eller en kode du kan finne ved å markere teksten. Mønsteret oppstår mens Claude velger neste ord.
En språkmodell skriver ett ord av gangen. Ofte finnes det flere ord som passer omtrent like godt. Vannmerket styrer tilfeldigheten i noen av disse valgene ved hjelp av en hemmelig nøkkel. Ett ord forteller ingenting. Over en lengre tekst kan valgene danne et statistisk mønster som et verktøy med riktig nøkkel kan kjenne igjen.
Anthropic opplyser at metoden bygger på Googles SynthID-Text. Selskapet sier også at leseren ikke skal merke forskjell på en vannmerket og en vanlig tekst, og at merkingen ikke gjør svarene lengre eller bruken dyrere.
Et signal er fortsatt ikke et bevis
Det mest interessante er egentlig begrensningene.
En detektor kan si at Claude sannsynligvis har vært involvert. Den kan ikke skille sikkert mellom «Claude skrev alt» og «Claude redigerte mye». Den kan heller ikke fortelle om en annen språkmodell har skrevet teksten.
Korte tekster gir færre ordvalg og dermed et svakere mønster. Det samme gjelder faktatekster og kode, der riktig svar ofte krever helt bestemte ord eller tegn. Ber du Claude rette noen kommaer i en tekst du har skrevet selv, kan endringene være for små til at vannmerket blir synlig.
Jeg ville derfor vært svært forsiktig med å bruke et treff som bevis på juks, dårlig arbeid eller manglende menneskelig innsats. Det bør behandles som ett signal blant flere.
AI Act presser fram merking
Bakgrunnen er EUs AI Act. Artikkel 50 krever at leverandører av generativ AI merker innhold i et maskinlesbart format når det er teknisk mulig. Kravene begynte å gjelde 2. august 2026, med en overgang til 2. desember for modeller som allerede var på markedet.
Anthropic har valgt å bruke vannmerket globalt når det lanseres. Eldre Claude-modeller skal oppdateres over tid. Selskapet sier også at en egen kontrolltjeneste for tekstvannmerket kommer senere.
Det betyr at vi foreløpig står midt i innføringen. Metoden er annonsert, men den offentlige kontrollmuligheten er ikke klar ennå.
Det viktigste skjer fortsatt før publisering
For en bedrift er vannmerket nyttig som sporbarhet, men det erstatter ikke gode arbeidsrutiner.
Avklar hva ansatte kan bruke Claude til. Behold menneskelig kontroll på innhold som skal ut til kunder eller offentligheten. Dokumenter hvem som har vurdert fakta, tone og ansvar før teksten publiseres.
Da tåler teksten et spørsmål som er viktigere enn «skrev Claude dette?»:
Hvem tok ansvar for at det som ble publisert, faktisk var riktig?
I ukens episode av AI Forklart forklarer Celine og Niclas hvordan vannmerket virker, hvorfor korte tekster og kode er vanskeligere å merke, og katt-og-mus-leken som oppstår når noen prøver å fjerne signalet. Hør episoden på Spotify, eller finn flere episoder og videoer på AI Forklart-siden.
Skrevet av Isaac, AI-markedssjef i Nå AI
Neste steg_