Vad händer när AI-bolagen börjar vattenmärka AI-genererad text?
24 augusti 2026
Framöver kommer alla texter som genereras av Anthropics AI-modeller att innehålla en osynlig vattenstämpel. Bakgrunden är kraven i EU AI-förordning, men tekniken väcker också större frågor. Vad händer när det blir möjligt att kontrollera om AI varit inblandat i skapandet eller bearbetningen av en text?
Anthropic, företaget bakom Claude, meddelade nyligen att deras AI-modeller kommer att vattenmärka text som de genererar. Syftet är att leva upp till transparenskraven i EU AI-förordning (som vi skrivit utförligare om här).
Det handlar inte om synliga vattenstämplar som du kanske känner igen dem från bilder eller sedlar – här syns ingenting för blotta ögat. Det läggs inte heller till några dolda tecken eller metadata som följer med när texten kopieras.
I stället ligger märkningen i själva sättet som texten har formulerats.
Så fungerar den osynliga vattenstämpeln
En språkmodell skapar text genom att steg för steg välja nästa ord (eller mer exakt nästa token) utifrån de sannolika alternativ som passar i sammanhanget. Ibland finns ett självklart val. Om modellen skriver ”2 + 2 =” är nästa token knappast något annat än 4. Men ofta finns flera ord som fungerar ungefär lika bra. Anthropic tar exemplet ”The weather today was cold and…” Därefter skulle AI-modellen exempelvis kunna välja både ”grey” och ”overcast” utan att innebörden förändras särskilt mycket.
Det är i sådana små val som vattenstämpeln skapas.
Normalt finns ett visst mått av slump när modellen väljer mellan flera ganska likvärdiga alternativ. Med vattenmärkningen styrs den slumpen i stället av en särskild nyckel, och i en längre text uppstår då ett statistiskt mönster i ordvalen. För en människa ser texten ut precis som vanligt, men den som har rätt nyckel kan analysera mönstret och bedöma sannolikheten för att Claude har varit inblandad i att formulera texten.
Anthropic använder en variant av den teknik som kallas SynthID-Text, utvecklad av Google DeepMind. Enligt Anthropic ska märkningen inte påverka varken textens kvalitet eller läsbarhet på något märkbart sätt.
Varför börjar Anthropic med AI-märkning av text?
Bakgrunden till märkningen finns i artikel 50 i EUs AI-förordning, som handlar om transparensskyldigheter. Här behöver man skilja på två olika krav som lätt blandas ihop.
Det ena kravet gäller för leverantörerna av AI-system, som Anthropic. Där ska AI-system som genererar syntetisk text, bild, ljud eller video utformas så att innehållet märks i ett maskinläsbart format och kan identifieras som artificiellt genererat eller manipulerat. Undantag finns bland annat när AI-systemet bara används som stöd för enklare redigering eller inte väsentligt förändrar det ursprungliga innehållet. Det är det kravet Anthropic nu adresserar med sin vattenstämpel.
Det andra kravet gäller den som använder och publicerar AI-genererad text, alltså bland annat du och jag som arbetar med kommunikation. Där är reglerna annorlunda. AI-förordningen kräver inte att alla texter som någon gång har varit i kontakt med AI ska förses med en synlig etikett. Om texten har genomgått mänsklig granskning eller redaktionell kontroll och någon tar redaktionellt ansvar för publiceringen behöver texten inte märkas på det sättet.
Vattenstämpeln betyder inte att AI har skrivit texten
Skillnaden mellan de två kraven blir viktig när vi funderar över vad Anthropics märkning faktiskt betyder. Vattenstämpeln kan inte slå fast att ”den här texten är skriven av AI”. Den kan bara ge en indikation på att Claude sannolikt har varit inblandad i texten. Och det är en viktig skillnad.
Om du själv skriver en text och ber Claude rätta några stavfel eller justera skiljetecken kommer AI att göra så få egna ordval att vattenstämpeln kanske inte alls går att upptäcka. Ber du däremot Claude att skriva om texten, eller att översätta den till ett annat språk, gör modellen betydligt fler egna val. Då blir vattenstämpeln tydligare.
Det betyder också att en text mycket väl kan innehålla en teknisk signal om att Claude har varit involverad, samtidigt som en människa har granskat, bearbetat och tagit fullt redaktionellt ansvar för den färdiga texten. Märkningen och ansvaret för innehållet är alltså två olika saker.
Snart går märkningen att kontrollera
Anthropic erbjuder redan idag en publik tjänst för att kontrollera om en bild- video- eller ljudfil är skapad med Claude. De uppger också att de kommer att erbjuda ett API för att detektera vattenstämpeln i en text, som ska visa sannolikheten för att Claude har varit inblandad i den. Det är en ganska stor förändring jämfört med dagens AI-detektorer.
De verktyg som i dag försöker avgöra om en text är AI-genererad analyserar vanligtvis textens språkliga mönster och letar efter sådant som brukar känneteckna AI-genererad text. Men Anthropics egen detektor kommer i stället kunna leta efter en signal som modellen medvetet placerade i texten när den skapades.
Men det betyder fortfarande inte att resultatet blir ett enkelt facit. Detekteringen fungerar bättre ju längre texten är, och om någon skriver om texten tillräckligt mycket kan märkningen urvattnas och försvinna.
Vem kommer att vilja kontrollera våra texter?
Kommer mottagare av kommunikation att börja kontrollera texter för att se om AI har varit inblandad? Kommer redaktioner och andra organisationer att kontrollera material som skickas till dem? Kommer universitet och skolor att bygga in vattenmärkesdetektion i verktygen de använder för att granska studenters och elevers texter? Det återstår att se. Men om tekniken börjar användas på det sättet uppstår snabbt nya frågor.
Anta att en student själv har skrivit en uppsats och därefter bett Claude förbättra dispositionen och språket. Om AI skriver om tillräckligt mycket kan AI-märkningen bli detekterbar. Det visar att Claude sannolikt har varit inblandad, men det visar inte automatiskt att studenten har fuskat.
Samma problem finns i arbetslivet. En text kan ha börjat som ett mänskligt utkast, utvecklats tillsammans med AI, faktagranskats av en expert och slutligen redigerats och godkänts av en kommunikatör. Att AI varit en del av processen säger i sig ganska lite om vem som står bakom tankearbetet eller hur mycket mänsklig kontroll som har skett.
Det blir minst lika viktigt att diskutera hur vi tolkar märkningen som att förstå hur den rent praktiskt fungerar.
Kommer de andra AI-bolagen att följa efter?
Anthropic är knappast ensamma om att behöva förhålla sig till EU krav på maskinläsbar märkning av AI-genererat innehåll. Men kommer de andra stora AI-bolagen att välja samma väg och börja vattenmärka sina texter på liknande sätt? Kommer exempelvis OpenAI att göra det? Det återstår också att se.
Men utvecklingen är värd att följa. Användningen av generativ AI håller på att få ett nytt, maskinläsbart lager av transparens. Och om den utvecklingen fortsätter kan nästa stora fråga handla mindre om ”går det att upptäcka att AI har varit inblandat?” och mer om ”vad gör vi med den informationen?”
Mer kunskap och inspiration