OpenAI begint de komende weken met het toevoegen van een onzichtbaar watermerk aan tekst die ChatGPT en Codex produceren voor gebruikers in de Europese Unie. De functie wordt beschikbaar voor in aanmerking komende gebruikers van alle abonnementen. Het bedrijf zegt hiermee te voldoen aan de transparantieregels van de Europese AI-verordening.
Die regels zijn op 2 augustus ingegaan en verplichten AI-bedrijven om gegenereerde inhoud herkenbaar te maken voor systemen die dat kunnen controleren. OpenAI voert de watermerken voorlopig alleen standaard in binnen de EU. Ontwikkelaars die de API van OpenAI gebruiken, kunnen de functie wereldwijd vanaf nu inschakelen voor bepaalde modellen. Daar staat het watermerk standaard uit.
Patroon in woordkeuze
Het watermerk verschijnt niet als een zichtbaar teken of symbool. De technologie past de woordkeuze van een model subtiel aan, waardoor in de tekst een patroon ontstaat. Een detector kan dat patroon herkennen aan de hand van de tekst en een geheime sleutel.
Omdat het patroon in de woorden zelf zit, blijft het volgens OpenAI behouden wanneer iemand de tekst kopieert en plakt. Het watermerk bevat geen informatie waarmee de gebruiker kan worden geïdentificeerd. OpenAI zegt bovendien geen wezenlijke invloed op de prestaties van de modellen te hebben gemeten.
De methode heet textGrain. OpenAI publiceerde daarover ook een technisch rapport, samen met onderzoekers van de University of Pennsylvania en Yale. Door veel kleine aanpassingen in de voorspelling van volgende woorden te combineren, kan een controlesysteem vaststellen of tekst waarschijnlijk door een OpenAI-model is gemaakt.
Beperkingen bij controle
Het watermerk is niet altijd betrouwbaar te detecteren. In tests van OpenAI daalde de herkenning van ongeveer 92 naar 66 procent nadat 10 procent van de woorden door synoniemen was vervangen. Ook korte teksten, antwoorden op rekenvragen en vertaalde tekst zijn moeilijker te controleren.
OpenAI waarschuwt daarom dat een ontbrekend watermerk niet bewijst dat een tekst door een mens is geschreven. De tekst kan te kort of te veel bewerkt zijn, of afkomstig zijn van een AI-systeem van een ander bedrijf. Een gevonden watermerk laat bovendien niet zien hoeveel menselijke beoordeling, redactie of creativiteit aan de tekst is toegevoegd.
Voorlopig krijgen alleen goedgekeurde onderzoekers en gespecialiseerde organisaties toegang tot de detector. OpenAI wil die partijen gebruiken om de betrouwbaarheid en verantwoordelijke toepassingen verder te beoordelen. Anthropic kondigde eerder aan tekst van Claude wereldwijd te gaan watermerken. Ook Google, Meta en Microsoft hebben zich aangesloten bij afspraken van de Europese Unie over de herkenbaarheid van AI-inhoud.



