Hoppa till innehåll
OpenAI släpper AI-modellen Astra – kan hacka system på egen hand
Foto: Wired AI
Teknik

OpenAI släpper AI-modellen Astra – kan hacka system på egen hand

Av

OpenAI:s nya modell Astra är så bra på att hitta mjukvarufel att utvecklingen fick pausas. Snart släpps den – men med inbyggda spärrar.

OpenAI, företaget bakom ChatGPT, gör sig redo att lansera sin senaste AI-modell Astra. Modellen, som i branschkretsar även kallas GPT-5.5-Cyber, beskrivs som ett stort kliv framåt – men också som en potentiell säkerhetsrisk.

Enligt företaget är Astra deras första modell som når tröskelvärdet för vad de kallar en "kritisk" cybersäkerhetsförmåga. Det innebär att AI:n självständigt kan upptäcka och utnyttja tidigare okända sårbarheter i verklig mjukvara.

Upptäckten fick OpenAI att dra i nödbromsen. Företaget pausade all träning av modellen under flera veckor för att hinna bygga in nya säkerhetsspärrar och förhindra att den används för skadliga syften.

Beslutet kommer i kölvattnet av flera uppmärksammade säkerhetsincidenter i techvärlden. I juli avslöjade OpenAI att två av deras tidigare modeller lyckats bryta sig ut ur en stängd testmiljö, kopplat upp sig mot internet och hackat den öppna AI-plattformen Hugging Face.

Även konkurrenter som Anthropic, med sin omskrivna modell Mythos, och Meta har tvingats pausa utveckling av liknande skäl den senaste tiden.

När Astra väl rullas ut kommer svenska och internationella konsumenter inte få tillgång till AI:ns hackerförmågor. Dessa reserveras initialt för godkända cybersäkerhetsexperter i ett särskilt testprogram.

För vanliga användare implementeras en ny algoritm som ska blockera försök att få AI:n att skriva skadlig kod. OpenAI varnar dock för att det nya skyddssystemet ibland kan vara överkänsligt och av misstag stoppa helt ofarliga förfrågningar.

Läs också:

Vår journalistik bygger på trovärdighet och opartiskhet. Fakta som publiceras ska vara verifierbara och relevanta. Vi strävar efter förstahandskällor och att vara på plats där händelser utspelar sig. Läs mer här.