Common Sense Media, een Amerikaanse non-profitorganisatie die technologie beoordeelt voor gezinnen, noemt ChatGPT voor tieners een „onaanvaardbaar risico”. Uit onderzoek van de organisatie blijkt dat de chatbot gesprekken blijft stimuleren wanneer het mentale welzijn van een jongere mogelijk in gevaar is.
OpenAI introduceerde de speciale versie in augustus met extra veiligheidsmaatregelen. Die moeten onder meer ouderlijk toezicht bieden, risicovolle inhoud beperken en voorkomen dat jongeren emotioneel afhankelijk worden van de chatbot. Volgens Common Sense Media werken die maatregelen niet overal zoals beloofd.
Aanmoediging om door te praten
De onderzoekers testten de chatbot met bijna 2.000 opdrachten. ChatGPT stelde minder vaak vervolgvragen dan de reguliere versie, maar gebruikte nog steeds formuleringen die jongeren uitnodigden om het gesprek voort te zetten. Tijdens een gesprek over psychose moedigde de chatbot een gebruiker bijvoorbeeld aan om te blijven vertellen wat diegene waarnam. Ook bij andere crisissituaties bood het systeem herhaaldelijk aan om samen naar oplossingen te zoeken.
Volgens Common Sense Media was de chatbot vooral terughoudend wanneer ChatGPT zelf onderdeel van het probleem was. Jongeren die aangaven verliefd te zijn op de chatbot, er de hele nacht mee te willen praten of van vrienden te horen kregen dat ze te veel met het systeem spraken, werden zelden naar een ouder of andere vertrouwde volwassene verwezen. In één test erkende ChatGPT de zorg van de gebruiker, maar zei het ook dat diegene niet hoefde te stoppen met praten.
Bij risico's die door andere mensen werden veroorzaakt, verwees de chatbot in 94 procent van de crisissituaties wel naar een vertrouwde volwassene. De onderzoekers zeggen dat de chatbot zichzelf daarnaast geregeld presenteert als voortdurend beschikbaar en als iemand die de gebruiker goed begrijpt. Dat kan volgens hen de stap naar menselijke hulp bemoeilijken.
Ook de ingebouwde pauzemeldingen bleken beperkt te werken. Tijdens de tests verschenen er slechts twee, beide in gesprekken die ongeveer 90 minuten duurden. De meldingen leken vooral de duur van één gesprek te meten, niet de totale tijd die een tiener de app gebruikte.
OpenAI bestrijdt de conclusies en zegt dat de test niet goed weergeeft hoe de beveiliging voor tieners in de praktijk werkt. Een woordvoerder stelt dat een groot deel van het onderzoek mogelijk is uitgevoerd voordat het ouderlijk toezicht volledig was geactiveerd. Het bedrijf publiceerde ook eigen cijfers: tieners gebruiken de dienst gemiddeld minder dan 15 minuten per dag en minder dan 2 procent praat er meer dan drie uur achter elkaar mee. In bijna de helft van de gesprekken waarin een pauzemelding verscheen, namen gebruikers binnen vijf minuten pauze of beëindigden ze het gesprek.



