VANNMERKE
Claude medgir at kode blir vanskelig å vannmerke
Tekster generert av Claude vil komme med et innebygget vannmerke – men kode blir ikke like lett å merke.
Nylig ble det kjent at Claude vil vannmerke produkter som er laget av AI-modellen. Nå har Anthropic, selskapet bak Claude, oppklart noe rundt hvordan det i praksis vil gjennomføres i et blogginnlegg. Selskapet vil snart tilby et API for å oppdage vannmerking. Men arbeider fortsatt med detaljene rundt hvordan dette skal implementeres.
For tekst er det en versjon av SynthID-Text-metoden som Google Deepmind publiserte i en artikkel i Nature i 2024. Designprinsippet er at vannmerket endrer litt på tilfeldigheten som brukes når modellen velger mellom ord.
Det vil si, jo mer Claude skriver, desto flere valg må modellen gjøre, og desto større er muligheten for at et vannmerke kan registreres. Det fungerer ikke godt i små tekstutdrag eller i enkel korrekturlesing. Lett redigering av en Claude-tekst vil sannsynligvis ikke fjerne vannmerket fullstendig. En oversettelse produsert av Claude vil få et vannmerke.
Komplisert å merke kode
Videre skriver Anthropic at deres modell kun kan oppdage sannsynligheten for at en tekst er skrevet av Claude, ikke hvor sannsynlig at en annen AI har generert teksten.
For kode som genereres av Claude er det litt mer komplisert fordi kode ofte er avhengig av å være presis. Dermed er det mindre valg for AI-modellen å dytte på. Men vannmerkingen kan for eksempel dukke opp i kommentarer til koden.
Bilder får ikke et vannmerke og ingen ting i bilder produsert av Claude vil vise at det er AI-generert. I stedet blir det lagt ved metadata på bilder etter en åpen industristandard kalt C2PA. Det er den samme standarden som brukes av kameraprodusenter og i bilderedigeringsprogrammer for å registrere hvor et bilde kommer fra.
Innfører vannmerkingen globalt
Anthropic forklarer at grunnen til vannmerkingen er at de, sammen med flere andre store leverandører av AI-modeller og rundt 190 andre aktører, signerte EUs Code of Practice on Transparency of AI-Generated Content i juli 2026. Denne krever at leverandører av AI-systemer bruker metoder for å merke AI-generert tekst. Anthropic innfører vannmerkingen globalt.