Hoppa till innehåll
Djurord lurar AI-jättens nya osynliga vattenstämpel
Foto: Reddit r/artificial
Teknik

Djurord lurar AI-jättens nya osynliga vattenstämpel

Av

Anthropic lägger till en osynlig vattenstämpel i texter från AI-modellen Claude. Men ett udda knep med djurnamn raderar spåren direkt.

AI-företaget Anthropic, skaparna bakom den populära chattbotten Claude, har börjat baka in en osynlig vattenstämpel i sina AI-genererade texter. Syftet är att förhindra fusk och uppfylla kraven i EU:s kommande AI-lagstiftning.

Enligt företaget påverkar märkningen inte textens kvalitet eller läsbarhet. Istället handlar det om en matematisk sannolikhetsberäkning, där AI:n styrs att välja specifika ord och formuleringar som bildar ett spårbart mönster.

Från och med augusti 2026 kommer detta att vara ett lagkrav för alla nya Claude-modeller som lanseras i EU, och därmed även för svenska användare. Vattenstämpeln ska finnas kvar även om texten kopieras och klistras in på andra ställen.

Men systemet har en uppenbar svaghet. Eftersom vattenstämpeln bygger på att AI:n har frihet att välja ord, fungerar den inte när modellen tvingas vara exakt – som vid strikta översättningar eller ordagrant citerande.

Nu sprids dessutom ett udda knep för att helt tvätta bort märkningen. Genom att be Claude skriva en text och fylla den med slumpmässiga, versala djurnamn, förbrukas systemets inbyggda slumpmässighet.

Vattenstämpeln hamnar då i de inlagda djurorden. Om man därefter ber chattbotten att skriva ut exakt samma text igen, men utan djurnamnen, raderas den underliggande märkningen helt.

Hur Anthropic och andra techjättar ska täppa till dessa kryphål innan de europeiska lagkraven träder i kraft i full skala återstår nu att se.

Läs också:

Vår journalistik bygger på trovärdighet och opartiskhet. Fakta som publiceras ska vara verifierbara och relevanta. Vi strävar efter förstahandskällor och att vara på plats där händelser utspelar sig. Läs mer här.