Nvidia fick en AI att krossa ett ökänt intelligenstest med full pott. Hemligheten var inte en smartare AI, utan verktygen runtomkring.
Techvärlden tävlar febrilt om att bygga den absolut smartaste AI-modellen. Men chiptillverkaren Nvidia, som blivit ett av världens mest värdefulla företag tack vare AI-boomen, visar nu att branschen kanske stirrar sig blind på fel sak.
I ny forskning konstaterar Nvidia att ramverket runt AI:n – den så kallade byggställningen eller "harness" – är mycket viktigare än själva grundmodellen när det gäller att lösa avancerade uppgifter.
För att bevisa detta lät forskarna AI-modellen Claude Opus 5 ta sig an ARC-AGI-3. Det är ett ökänt svårt test som går ut på att klara okända 2D-spel helt utan instruktioner.
Genom att koppla modellen till ett skräddarsytt ramverk som hanterar minne och agerar övervakare, fick de AI:n att nå 100 procent. Utan Nvidias ramverk stannade exakt samma AI-modell på 30 procent.
Konkurrenten OpenAI har tidigare slitit sitt hår över samma test. Deras modeller skrapade ihop under 10 procent, innan de insåg att de också behövde justera ramverken för att få upp poängen.
Att få AI att klara långsiktiga uppgifter i flera steg är branschens heliga graal. När Microsoft nyligen testade 19 olika toppmodeller på dokumentredigering visade det sig att samtliga tappade tråden och fyllde texterna med fel.
"Det är ramverket som gör modellen till en självgående agent", förklarar Adel El Hallack, produktchef på Nvidias AI-avdelning.
Forskningen går hand i hand med Nvidias vd Jensen Huangs senaste drag. Bolaget har börjat släppa egna AI-modeller och ramverk helt gratis som öppen källkod.
Strategin är glasklar: Genom att göra det enkelt för startups och vanliga företag att bygga smarta AI-agenter, minskar beroendet av jättar som OpenAI. Och oavsett vem som bygger framtidens AI, kommer de att behöva köpa Nvidias grafikkort för att driva den.
Läs också:
