AI-modeller gissar fel på global statistik i fyra av fem fall. Nu bygger FN ett nytt system med Google för att stoppa hallucinationerna.
Många vänder sig till AI-verktyg som Chatgpt och Gemini för att förstå världen. Men när det gäller hård fakta och global statistik är de smarta assistenterna urusla på att svara rätt.
Ett nytt test från FN-organet Unicef, där sex ledande språkmodeller fick svara på över 133 000 frågor om global utveckling, visar på ett haveri. Den genomsnittliga träffsäkerheten låg på ynka 21,2 procent.
Ofta vägrade modellerna ens ge en siffra. Och när exakt samma fråga ställdes igen några dagar senare, ändrade AI:n ofta sitt svar helt. Testet omfattade bland annat Open AI:s GPT-4o, Anthropics Claude 4.5 och Googles senaste Gemini-modeller.
För att råda bot på de skenande hallucinationerna lanserar FN nu plattformen "UN System Data Commons" i samarbete med Google. Det är ett gigantiskt projekt för att göra världens samlade statistik läsbar för AI.
Det nya systemet bygger på Googles öppna källkod och stöder en ny standard kallad "Model Context Protocol". Det innebär i praktiken att AI-system framöver kan koppla upp sig direkt mot FN:s servrar för att hämta dagsfärsk, kvalitetssäkrad data istället för att gissa sig fram.
Behovet är akut. Unicef, vars sajt har över sex miljoner besökare i månaden, uppskattar att var tionde besökare nu kommer via en AI-assistent. Bara trafiken från klickbara länkar i Chatgpt har ökat med 67 procent det senaste året.
FN har som mål att 80 procent av alla deras statistiska databaser ska vara integrerade i det nya AI-vänliga systemet till år 2027. Google stöttar projektet med både teknisk expertis och ett bidrag på drygt 20 miljoner kronor.
Läs också:
