Innhold Vis
Claude skal legge usynlige, maskinlesbare merker i AI-generert tekst og digitalt signerte sporbarhetsdata i støttede bildefiler. Tekstmerket skal følge støttede modeller enten du bruker Claude i nettleseren, via API-et, i Claude Code eller gjennom en skyleverandør. Signerte fildata vil bare følge med der filtypen og plattformen støtter dem.
Det høres ut som en endelig løsning på spørsmålet «er dette laget med AI?». Det er det ikke. Anthropic understreker selv at et funnet merke bare viser at innholdet kan ha vært behandlet av Claude. Mangler merket, kan innholdet fortsatt være AI-generert.
Likevel er dette en viktig endring. Vannmerking av tekst på modellnivå er noe ganske annet enn dagens tvilsomme AI-detektorer, og C2PA-metadata gir filer en kontrollerbar historikk. Men systemet får først verdi når det finnes tilgjengelige verktøy som kan lese merkene, og når plattformene faktisk lar dem overleve.
Hva er det Anthropic skal innføre?
Anthropic innfører to forskjellige merkemetoder: et usynlig merke som bygges inn i generert tekst, og digitalt signert C2PA-metadata i støttede filer. Nye Claude-modeller lansert i EU på eller etter 2. august 2026 skal støtte merkingen fra første dag, ifølge Anthropics egen dokumentasjon.
Tekstmerket skal ligge i selve teksten. Det betyr at det kan følge med når teksten kopieres og limes inn et annet sted, og Anthropic sier at det kan overleve noe redigering. Selskapet har foreløpig ikke offentliggjort den tekniske metoden, så vi vet ikke hvor mye omskriving som skal til før signalet blir for svakt.
Filer behandles på en annen måte. Når Claude lager en støttet filtype som SVG, PNG eller JPG, skal filen få signert metadata basert på den åpne C2PA-standarden. Metadataen kan fortelle at filen har vært behandlet av Claude og bidra til å avsløre senere endringer. Den ligger altså ikke som en synlig logo over bildet.
Hvor vil vannmerkingen gjelde?
Merkingen skal gjelde globalt for støttede Claude-modeller, ikke bare for brukere i EU. Anthropic lister opp Claude Platform med API, Claude, Claude Code, Claude Cowork og Claude Tag. Tekstmerkene skal også følge modellen gjennom AWS, Google Cloud og Microsoft Foundry.
Dette er et viktig designvalg. Hvis merkingen bare hadde blitt lagt på i claude.ai, ville den forsvunnet med en gang utviklere brukte samme modell gjennom et API eller en tredjepart. Når signalet lages på modellnivå, får det i utgangspunktet samme rekkevidde som modellen.
Det passer også med hvordan Anthropic har bygget ut Claude fra én chatflate til et helt økosystem for kode og arbeid. Jeg skrev tidligere om hva selskapet samlet annonserte på utviklerkonferansen Code with Claude 2026. Den nye merkingen må fungere på tvers av nettopp disse flatene hvis den skal ha praktisk verdi.
Det finnes likevel et forbehold for filer. Anthropic sier at signert opphavsmetadata kanskje ikke støttes på alle plattformer, fordi det avhenger av funksjonene hos hver enkelt skyleverandør og tjeneste. Tekstvannmerket er den mest gjennomgående delen av planen. Filmerkingen får flere mulige brudd i kjeden.
Når starter Claude med merkingen?
Nye Claude-modeller lansert fra 2. august 2026 får merkingen ved lansering. Eldre modeller er ikke nødvendigvis merket ennå. Anthropic arbeider med å legge til støtte også der, men har ikke gitt en komplett liste over modeller eller en konkret utrullingsplan.
Datoen kommer fra EUs AI Act. Artikkel 50 krever at leverandører merker AI-generert eller manipulert innhold i et maskinlesbart format, så langt det er teknisk mulig. EU-kommisjonens retningslinjer sier at transparenskravene begynte å gjelde 2. august 2026.
Systemer som kom på markedet før denne datoen har en begrenset overgang for selve merke- og deteksjonskravet. For dem er fristen 2. desember 2026. Innhold laget før 2. august trenger heller ikke merkes med tilbakevirkende kraft. Det forklarer hvorfor Anthropic omtaler dette som en pågående innføring og ikke som en bryter som allerede er slått på for absolutt alt Claude lager.
Anthropic har signert EUs frivillige praksiskode for transparens og bruker merkingen for å oppfylle sine forpliktelser. Der kommer også den velkjente haken: De største AI-selskapene kan bygge vannmerking, signeringssystemer og deteksjon inn i hele modellplattformen. Små leverandører og utviklere må fortsatt tolke kravene og dokumentere at deres egen ende av kjeden er riktig. Byråkratiet har som vanlig lettere for å kreve «robust og interoperabelt» enn å forklare hvordan det skal fungere i praksis. C2PA-standarden finnes, men Anthropic har ennå ikke offentliggjort metoden eller dokumentasjonen for tekstvannmerket.
Kan et vannmerke bevise at Claude skrev teksten?
Nei. Et funnet Claude-merke er et signal om at teksten eller filen kan ha vært behandlet av Claude. Det beviser ikke at Claude fant på innholdet, skrev originalen eller står bak alle påstandene. Dette skillet er helt avgjørende hvis merkingen senere brukes i skoler, medier eller arbeidslivet.
Tenk på en tekst skrevet av et menneske og sendt til Claude for korrektur, oversettelse eller forkorting. Resultatet kan få et Claude-merke selv om ideene, argumentene og mesteparten av formuleringene kom fra mennesket. Et deteksjonsverktøy som gjør «Claude-merke funnet» om til «studenten jukset» eller «journalisten skrev ikke dette», går lenger enn teknologien gir dekning for.
Det samme gjelder filer. Signert C2PA-metadata kan vise at Claude behandlet en fil, og den kan gjøre endringer etter signeringen synlige. Men standarden feller ingen dom over om innholdet er sant, godt eller villedende. C2PA-spesifikasjonen beskriver opphavsdata som kontrollerbare tillitssignaler, ikke som en vurdering av om innholdet er «godt» eller «dårlig».
Dette er derfor mer presist enn en vanlig AI-detektor, men også smalere. En detektor forsøker å gjette ut fra språket. Et vannmerke ser etter et signal modellen bevisst har lagt inn. Det reduserer gjettingen, men signalet må fortsatt tolkes riktig.
Hva skjer når teksten eller bildet redigeres?
Claude-merket er laget for å tåle kopiering og noe redigering, men ikke alt. Anthropic sier at tung omskriving, parafrasering, oversettelse eller sammenblanding med annen tekst kan gjøre signalet umulig å finne. Svært korte tekstbiter kan også inneholde for lite informasjon til sikker deteksjon.
Det gir en litt rar asymmetri. En helt uskyldig korrekturrunde kan være nok til at menneskeskrevet tekst får et merke, mens en grundig omskriving av ren Claude-tekst kan få merket til å forsvinne. Vannmerkingen sier dermed mer om behandlingshistorikken enn om hvem som skal få æren eller skylden for sluttresultatet.
For filer er svakheten lettere å forstå. Metadata kan forsvinne når et bilde lagres på nytt, konverteres til et annet format eller gjøres om til et skjermbilde. Nettplattformer kan også fjerne metadata under opplasting og bildebehandling. The Verge peker nettopp på at C2PA-data kan forsvinne, noen ganger uten at brukeren prøver å fjerne dem.
Fravær av et merke er derfor ikke bevis på menneskelig opphav. Teksten kan komme fra en eldre Claude-modell, være for kort, være kraftig redigert eller ha gått gjennom en flate uten støtte. Filen kan ha mistet metadataen på veien. Dette bør stå med store bokstaver i hodet på alle som senere skal bruke deteksjonen til å ta avgjørelser om mennesker.
Hva betyr dette for deg som bruker Claude?
For vanlig bruk endrer merkingen trolig lite i selve arbeidsflyten. Anthropic sier at tekstmerket er usynlig og ikke skal påvirke mening, kvalitet eller lesbarhet. Du trenger ikke krysse av i en egen innstilling når du kopierer tekst fra Claude. Merket skal følge output fra støttede modeller automatisk.
Det viktigste er å forstå hva du leverer videre. Hvis du bruker Claude til et dokument, en illustrasjon eller kode som skal gjennom en publiseringskjede, kan et senere verktøy oppdage at Claude har vært involvert. Det er ikke nødvendigvis et problem. Problemet oppstår hvis arbeidsgiver, skole eller plattform har regler som du ikke kjenner, eller hvis de tolker et merke som mer enn det faktisk er.
Utviklere som bygger tjenester på Claude får en mer konkret jobb. Anthropic sier at hver utvikler selv må vurdere hvilke plikter artikkel 50 gir produktet eller tjenesten. Modellens innebygde signal kan hjelpe, men det fritar ikke den som publiserer AI-generert innhold fra egne krav om synlig merking i situasjoner der loven krever det.
Anthropic har heller ikke sluppet deteksjonsverktøyene ennå. Selskapet lover støtte for brukere og tredjeparter og sier at teknisk dokumentasjon kommer senere. Frem til den finnes, har vi en plan om et signal uten en ferdig offentlig målestokk for hvor robust det er. Det er vanskelig å evaluere et usynlig merke når leseren foreløpig også mangler lommelykten.
Er dette godt nok til å rydde opp i AI-innhold?
Vannmerking kan gi nyttig sporbarhet, men den rydder ikke opp alene. Den beste delen av Anthropics løsning er at tekstsignalet bygges inn ved generering og brukes på tvers av produkter og skyleverandører. Det er langt bedre enn en etikett som bare finnes i én app og forsvinner ved første kopiering.
Svakhetene er like konkrete. Tekstsignalet kan svekkes av redigering. Filmetadata kan fjernes i helt vanlige arbeidsflyter. Deteksjon av et merke beviser behandling, ikke forfatterskap, og manglende funn beviser ingenting. Dessuten vet vi ennå ikke hvordan tredjepartsverktøyene skal fungere eller hvilken feilmargin de får.
Jeg liker prinsippet om mer teknisk sporbarhet og mindre gjetting. Men merkingen må behandles som ett bevismoment, ikke som en digital dommerklubbe. Ellers bytter vi bare ut dagens dårlige AI-detektorer med et nytt system som er mer presist teknisk, men fortsatt kan misbrukes menneskelig.
Den virkelige testen kommer etter utrullingen: Overlever merkene den vanlige reisen gjennom dokumentverktøy, publiseringssystemer, skjermbilder og redigering? Og klarer plattformene å forklare forskjellen mellom «laget av Claude» og «var innom Claude»? Hvis svaret på det siste blir nei, får vi kanskje mer metadata og like mye forvirring. Det ville nesten vært imponerende.
Ofte stilte spørsmål
Er all tekst fra Claude vannmerket nå?
Nei. Nye Claude-modeller lansert fra 2. august 2026 skal merkes fra første dag. Anthropic arbeider også med eldre modeller, men tekst fra eldre modeller, korte svar eller flater uten full støtte kan mangle et merke.
Er Claude-vannmerket synlig når jeg kopierer teksten?
Nei. Anthropic beskriver tekstmerket som usynlig og innebygd i teksten på modellnivå. Det skal kunne følge med ved kopiering og innliming og tåle noe redigering, men selskapet har foreløpig ikke publisert den tekniske metoden.
Kan Claude-vannmerket brukes som bevis på juks?
Ikke alene. Et funnet merke kan vise at teksten har vært behandlet av Claude, men den kan opprinnelig være skrevet av et menneske og bare korrekturlest eller oversatt. Anthropic sier selv at merket ikke bekrefter hele opphavshistorikken.
Kan C2PA-metadata fjernes fra et Claude-bilde?
Ja. Metadata kan forsvinne ved formatkonvertering, ny lagring, skjermbilder eller behandling på en plattform som fjerner den. Derfor betyr fravær av C2PA-data ikke at filen aldri har vært laget eller behandlet med AI.