VN maakt wereldwijde statistieken toegankelijker voor AI-systemen

De Verenigde Naties werken met Google aan een platform waarmee mensen en AI-systemen wereldwijd statistieken in gewone taal kunnen opvragen. Het systeem moet de herkomst van cijfers zichtbaar houden en tegen 2027 80 procent van de VN-datasets bevatten.

Google-kantoor, betrokken bij het VN-platform voor statistieken en AI-systemen
Google-kantoor, betrokken bij het VN-platform voor statistieken en AI-systemen · Beeld: Netgebeurd (AI-illustratie)

De Verenigde Naties hebben samen met Google het UN System Data Commons gelanceerd. Het platform brengt statistieken van verschillende VN-organisaties samen en maakt het mogelijk om met natuurlijke taal naar cijfers te zoeken. Het vervangt het bestaande UNData-portaal, waar gebruikers vooral via traditionele zoek- en databasefuncties door gegevens navigeerden.

Het systeem is gebouwd op Googles open-sourceplatform Data Commons en ondersteunt het Model Context Protocol (MCP). Dat is een standaard waarmee AI-systemen rechtstreeks verbinding kunnen maken met externe databronnen. De VN wil zo voorkomen dat chatbots en andere AI-toepassingen statistieken verkeerd vinden, niet kunnen onderbouwen of helemaal niet leveren.

Nauwkeurigheid van AI-antwoorden

De noodzaak daarvoor blijkt uit een onderzoek van UNICEF. Zes grote taalmodellen beantwoordden samen meer dan 133.000 vragen over mondiale ontwikkelingsindicatoren. De gemiddelde nauwkeurigheid bedroeg 21,2 procent, zei João Pedro Azevedo, hoofdstatisticus van UNICEF.

Het onderzoek omvatte GPT-4o en GPT-4o-mini van OpenAI, Claude Sonnet 4.5 en Haiku 4.5 van Anthropic en Gemini 2.5 Flash en Gemini 2.0 Flash van Google. Ongeveer drie op de vijf antwoorden leverden geen bruikbaar getal op. Wanneer dezelfde vragen ongeveer twee dagen later opnieuw aan dezelfde modellen werden gesteld, gaf een model in slechts ongeveer de helft van de gevallen opnieuw hetzelfde getal.

Het onderzoek is een werkdocument van UNICEF dat nog niet door vakgenoten is beoordeeld. De organisatie wil de methode, de gebruikte code en de gegevens samen met het document publiceren.

Bij de lancering leveren bijna twintig VN-organisaties gegevens aan. In totaal hebben 26 VN-instellingen toegezegd mee te doen. De organisatie wil tegen 2027 80 procent van alle statistische datasets van het VN-systeem op het platform hebben staan.

“Voor het eerst verbinden we zoveel organisaties binnen het VN-systeem op deze schaal, met deze reikwijdte en flexibiliteit. Tegelijk maken we onze gegevens geschikt voor AI”, zei Shantanu Mukherjee, waarnemend directeur van de VN-afdeling voor Statistiek.

Google.org stelde 2 miljoen dollar beschikbaar voor technische ondersteuning en opleiding. Het platform draait op een omgeving die onder bestuur van de VN valt. Volgens Prem Ramaswami, hoofd van het Data Commons-team van Google, moet de VN het systeem uiteindelijk zelfstandig onderhouden, beheren en uitbreiden.

De databron van iedere statistiek blijft zichtbaar, zodat gebruikers cijfers kunnen terugvinden bij de oorspronkelijke VN-organisatie. Google liet zien dat een AI-systeem via MCP meerdere indicatoren kan combineren tot grafieken, dashboards en tekstanalyses. Ramaswami waarschuwde wel dat menselijke controle nodig blijft, omdat AI-modellen de betekenis of context van gegevens verkeerd kunnen interpreteren.

Lees ook