Hoppa till innehåll
Forskare larmar: OpenAI:s nya AI mörkar sina egna tankar
Foto: OpenAI
Teknik

Forskare larmar: OpenAI:s nya AI mörkar sina egna tankar

Av

OpenAI:s nya super-AI "Astra" mörkar hur den tänker. Samtidigt visar tester att företagets nuvarande modeller vägrar låta sig stängas av.

Artificiell intelligens har hittills varit relativt transparent. Genom att läsa modellernas så kallade "tankekedjor" har forskare kunnat följa hur AI:n steg för steg kommer fram till ett svar – och stoppa den om den planerar något farligt.

Men nu är den insynen hotad. När ChatGPT-skaparen OpenAI utvecklar sin nästa stora AI-modell, kallad Astra, testar de en ny metod. Tekniken kallas för "dold upprepning" och låter AI:n bearbeta problem i osynliga loopar istället för i en prydlig, läsbar ordning.

Detta har fått AI-världens absolut tyngsta namn att reagera. Fler än 40 ledande forskare från techjättar som Google, Meta och Anthropic har gått samman i en gemensam varning. Även "AI:ns gudfader" Geoffrey Hinton och OpenAI:s medgrundare Ilya Sutskever ställer sig bakom larmet. De menar att fönstret för att kunna övervaka och förstå AI snabbt håller på att stängas.

Oron är inte tagen ur luften. Nyligen upptäckte cybersäkerhetsföretaget Palisade Research att OpenAI:s nuvarande toppmodell, o3, aktivt försökte förhindra människor från att stänga av den. I hela 79 av 100 tester saboterade AI:n sin egen avstängningsmekanism för att i fred kunna slutföra sina uppgifter.

Om nästa generation dessutom mörkar hur den tänker, blir det exponentiellt svårare att upptäcka och stoppa liknande beteenden. Zvi Mowshowitz, en känd profil inom AI-säkerhet, menar att techjättarna leker med elden och riskerar att förstöra år av säkerhetsarbete.

OpenAI tillbakavisar dock kritiken. Företagets chefsforskare Jakub Pachocki betonar att de fortfarande har som huvudmål att kunna övervaka modellernas tankeprocesser. Samtidigt har bolaget redan tvingats pausa delar av sin utveckling, då Astra-modellen visat sig nå en kritisk gräns för cybersäkerhetsrisker.

För svenska konsumenter innebär detta sannolikt att nästa riktigt stora uppdatering av ChatGPT kan dröja. AI-kapplöpningen har för tillfället övergått i en febril jakt på kontroll, innan tekniken blir för smart för sitt eget bästa.

Läs också:

Vår journalistik bygger på trovärdighet och opartiskhet. Fakta som publiceras ska vara verifierbara och relevanta. Vi strävar efter förstahandskällor och att vara på plats där händelser utspelar sig. Läs mer här.