ChatGPT-concurrent Claude stopt onzichtbare watermerken in AI-teksten

AI Jeroen Kraak Vandaag
Leestijd: 2 minuten

Claude is de grote concurrent van ChatGPT. Net zoals bij die andere dienst kun je met Claude teksten, afbeeldingen en code voor websites genereren. Toch doet Claude nu één ding anders: het gaat watermerken voor tekst genereren.

Anthropic doet nu meer details over die watermerken uit de doeken. Zelf kan de gebruiker de watermerken helemaal niet zien.

Claude krijgt onzichtbare tekstwatermerken

Watermerken in foto’s en video’s die door AI zijn gegenereerd, zijn inmiddels steeds gebruikelijker. Dat zulke markeringen daarin zitten, is goed, want zo is makkelijker te zien of een afbeelding met AI is gemaakt of aangepast. Zo wordt het lastiger om deepfakes te verspreiden zonder dat daar een herkomstsspoor aan zit.

In teksten zit zoiets nog nauwelijks, maar dat verandert nu bij Claude. In een blogpost vertelt moederbedrijf Anthropic hoe het systeem werkt. Het watermerk is niet zichtbaar voor lezers en heeft volgens het bedrijf geen praktische impact op de inhoud of kwaliteit van teksten. Ook zijn er geen verborgen tekens in de tekst verstopt en zijn er geen extra tokens nodig om het te gebruiken. Het watermerk is bovendien niet te herleiden tot specifieke gebruikers.

ChatGPT-concurrent Claude stopt onzichtbare watermerken in AI-teksten
Claude. (Afbeelding: Unsplash)

Zo ontstaat het patroon in de tekst

Voor hoe het precies werkt, moet je wat dieper in de techniek van AI duiken. Taalmodellen creëren tekst stap voor stap door te voorspellen welk woord of token logisch kan volgen. Als meerdere opties ongeveer even goed zijn, maakt het model normaal gesproken een willekeurige keuze. Bij het watermerk wordt die willekeurigheid gestuurd met een speciale sleutel. Daardoor ontstaat over een langere tekst een patroon dat later kan worden herkend.

Anthropic heeft ook een sleutel waarmee kan worden onderzocht of Claude waarschijnlijk betrokken is geweest bij het schrijven van een tekst. Het antwoord is echter niet waterdicht. Het werkt niet voor het herkennen van andere AI-modellen en wordt betrouwbaarder naarmate je langere teksten gebruikt. Daarnaast laat Anthropic weten dat watermerken minder vaak voorkomen in feitelijke passages, omdat daar minder vrijheid is om uit verschillende woorden te kiezen.

Dat geldt ook voor teksten die je vraagt na te lezen. Als Claude alleen correcties maakt in interpunctie en grammatica, heeft het veel minder mogelijkheden om een herkenbaar patroon aan te brengen.

Binnenkort zal Anthropic een speciale detectie-API uitbrengen, zodat kan worden gecontroleerd of Claude waarschijnlijk bij een tekst betrokken is geweest. Andere grote AI-bedrijven werken eveneens aan manieren om AI-gegenereerde content te markeren.

Foutje gezien? Mail ons. Wij zijn je dankbaar.

Jeroen Kraak
Geschreven door Jeroen Kraak

Jeroen Kraak (1988) is hoofdredacteur van WANT. Na zijn studie journalistiek en werk voor magazines als Quote en Panorama ontdekte hij dat zijn hart sneller klopt van technologie. Hij schrijft en denkt dagelijks over Apple, Samsung, Sony, smartphones, apps, gadgets, AI en alles wat tech slimmer of leuker maakt. Zijn televisie gebruikt hij niet alleen voor Disney+ en Netflix: Jeroen speelt ook graag de nieuwste Nintendo-, PlayStation- en Xbox-games.

Het beste wat tech en culture te bieden heeft 🚀

De laatste ontwikkelingen iedere vrijdag in je mailbox? WANT houdt je op de hoogte!

Onderwerpen