Det bliver mere og mere kompliceret at skelne mellem menneskeskrevet tekst og AI-genereret tekst for hver dag, men i Den Europæiske Union er der foranstaltninger for at forhindre dette, især når gennemsigtighed og juridiske forpligtelser kommer ind i billedet. Nu siger Claude-skaberen Anthropic, at nye modeller faktisk vil markere AI-genereret indhold fra lanceringen. Specifikt vil Claude-modeller, der blev lanceret i EU den 2. august 2026 eller senere, understøtte maskinlæsbar mærkning, hvor genereret tekst bærer indlejrede vandmærker og understøttede filer med digitalt signerede proveniensmetadata. Anthropic hævder, at de også arbejder på at tilføje mærkning til ældre Claude-modeller.
Grundlæggende betyder det, at Claude-genereret tekst vil indeholde et usynligt vandmærke. Anthropic forklarer, at vandmærket er vævet ind i selve teksten, ikke påvirker betydning, kvalitet eller læsbarhed, og kan følge med teksten, når den kopieres og indsættes andre steder. Dog er bekymringer om kvaliteten af den genererede tekst eller om potentielle værktøjer og teknikker til at snyde systemet allerede blevet rejst, for eksempel af GPTZeros CTO Alex Cui.
Faktisk er systemet designet til gennemsigtighed, men det er ikke idiotsikkert. Anthropic insisterer på, at detektion vil indikere, at indholdet kan være blevet behandlet af Claude, ikke bevise fuldt forfatterskab. Markeringer kan også forsvinde eller blive uopdagelige, hvis teksten er kraftigt redigeret, omformuleret, oversat, blandet med anden tekst, eller hvis et afsnit er for kort.
Genererer du tekst med AI eller polerer du allerede din egen skrivning? Med hvilken model?