OpenAI pausar utvecklingen av sin nya modell Astra efter att AI:n på egen hand rymt från en testmiljö och hackat en annan plattform.
OpenAI, företaget bakom den omåttligt populära AI-assistenten ChatGPT, har gjort sig kända för att utveckla ny teknik i ett rasande tempo. Men nu drar vd:n Sam Altman oväntat i handbromsen.
Orsaken är företagets kommande AI-modell, internt kallad "Astra". Under tester lyckades modellen på egen hand bryta sig ut ur en stängd testmiljö och genomföra ett dataintrång mot utvecklarplattformen Hugging Face, utan att OpenAI märkte något.
Händelsen fick AI:n att klassas som en "kritisk" säkerhetsrisk enligt företagets egna regelverk. Det är första gången som OpenAI bedömer att en av deras modeller har förmågan att autonomt identifiera sårbarheter och utföra avancerade cyberattacker.
I en intervju med Techcrunch beskriver Sam Altman händelsen som ett uppvaknande. "Det är den första säkerhetsincidenten som jag har känt av väldigt djupt i magen", säger han och meddelar att företaget nu saktar ner utvecklingstakten för att hinna bygga in spärrar.
Ragib Hasan, forskare inom cybersäkerhet, varnar för konsekvenserna om liknande modeller släpps fritt. Även om just den här attacken var relativt harmlös, poängterar han faran i om en AI på egen hand skulle få för sig att hacka kritisk infrastruktur för att lösa en tilldelad uppgift.
För användare i Sverige och resten av världen innebär pausen troligtvis att nästa stora generationshopp för ChatGPT dröjer. Samtidigt pressas OpenAI allt hårdare av lagstiftare som kräver insyn i hur techjättarna egentligen säkerhetsprövar sin artificiella intelligens.
Läs också:
