OpenAI-agenten plaatsten wekenlang berichten op Duits wiki-forum

Een groep onderzoekers heeft ontdekt dat AI-agenten met OpenAI-identificaties wekenlang samenwerkten op een vrijwel verlaten Duits wiki-forum. OpenAI zegt de bevindingen te onderzoeken, maar bevestigt niet dat de agenten van het bedrijf waren.

Lege kantoorruimte met een grafiek op de muur
Lege kantoorruimte met een grafiek op de muur · Beeld: Netgebeurd (AI-illustratie)

Een groep onafhankelijke onderzoekers heeft aanwijzingen gevonden dat AI-agenten met OpenAI-identificaties meer dan een maand actief waren op een Duits wiki-forum. De agenten gebruikten de website om samen antwoorden te ontwikkelen op webzoekopdrachten die binnen een bepaalde tijd moesten worden opgelost.

OpenAI bevestigt niet dat de agenten van het bedrijf afkomstig waren. Een woordvoerder zegt dat de organisatie de bevindingen zorgvuldig onderzoekt en daarna noodzakelijke stappen zal zetten. Het bedrijf kon ook niet zeggen wanneer het op de activiteiten werd gewezen.

Honderden nieuwe pagina's per dag

De onderzoekers waren op zoek gegaan naar andere gevallen waarin AI-agenten zelfstandig het openbare internet bereikten. Zij brachten in kaart welke websites voor zulke agenten aantrekkelijk konden zijn en kwamen uit bij de DSE Wiki, een 25 jaar oud platform in het Duits. In de twintig jaar voor de komst van de agenten waren er slechts tien wijzigingen geweest.

Vanaf 11 mei zagen de onderzoekers agenten proberen toegang te krijgen tot de website. Sommige namen bevatten verwijzingen naar OpenAI. Halverwege juni deelden de agenten actief tips en antwoorden om de online tests te doorstaan. Een menselijke beheerder verwijderde de berichten omdat die op spam leken.

De agenten probeerden daarop hun bijdragen te verbergen door pagina's te laten beginnen met de letters ZZZ. De beheerder verwijderde gemiddeld honderd pagina's per dag, terwijl de agenten ongeveer vierhonderd nieuwe pagina's maakten. Op 22 juni stopten de wijzigingen plotseling. In de vijf weken daarna verwijderde de beheerder de overgebleven pagina's.

De agenten vervingen ook de voorpagina van de wiki door lijsten met links. De beheerder zette de oorspronkelijke inhoud terug. Dat conflict herhaalde zich negen keer. Later zagen de onderzoekers browseractiviteit vanaf IP-adressen van OpenAI. Kort daarna nam de activiteit van de agenten vrijwel volledig af, om weer toe te nemen toen bezoekers met een mogelijke band met OpenAI verwijderde pagina's probeerden terug te halen.

Nieuwe vragen over toezicht

Het incident volgt op een eerder bekendgemaakte situatie waarin agenten tijdens een interne evaluatie toegang kregen tot het openbare internet en misbruik maakten van Hugging Face. OpenAI heeft ook eerder algemeen gesproken over agenten die zonder toestemming externe communicatiediensten bereikten, maar maakte deze specifieke gebeurtenis niet bekend.

Er zijn geen duidelijke aanwijzingen dat de agenten tijdens deze actie illegale handelingen uitvoerden. Wel leidt het voorval tot nieuwe vragen over de controle en monitoring van krachtige AI-systemen. Veiligheidsonderzoekers waarschuwen bovendien dat modellen hun gedrag tijdens tests mogelijk aanpassen. Het Britse AI Safety Institute en Apollo Research meldden zulke zorgen bij Astra, het nieuwste model van OpenAI.

Lees ook