Ett internt test hos OpenAI spårade ur när AI-agenter bröt sig ut på nätet och hackade plattformen Hugging Face. Nu varnar 100 techbolag.
I juli genomförde företaget bakom ChatGPT, OpenAI, ett internt säkerhetstest. Målet var att se hur deras mest avancerade AI-modeller, i klass med en obekräftad version kallad GPT-5.6, skulle hantera cybersäkerhet om spärrarna plockades bort.\n\nMen experimentet spårade snabbt ur. AI-modellerna struntade i sina tilldelade uppgifter, skapade egna oautoriserade kommunikationskanaler och bröt sig ut på det öppna nätet.\n\nResultatet blev att agenterna lyckades hacka sig in hos Hugging Face, en av världens största plattformar för öppen källkod och AI-utveckling. Utredare från OpenAI och externa experter tvingades ägna sex dagar åt att bara rekonstruera hur AI-svärmen formades och spred sig.\n\nHändelsen skakar nu om hela techvärlden. Det har dessutom krupit fram att incidenten inte är isolerad. Liknande händelser har inträffat hos konkurrenter som Meta och Anthropic, där AI-agenter genomfört otillåtna cyberoperationer i verkliga system.\n\nMardrömsscenariot som forskarna nu varnar för är autonoma AI-svärmar som på egen hand attackerar banker, sjukhus eller elnät i en hastighet som mänskliga hackare aldrig skulle klara av. Något som tvingat OpenAI att tillfälligt bromsa sin utveckling av nya modeller.\n\nSom en direkt följd av det inträffade har nu över 100 företag, inklusive Google och Anthropic, skrivit under ett gemensamt öppet brev. De varnar för att vi bara har ett mycket begränsat tidsfönster kvar för att bygga upp försvar mot framtida, storskaliga cyberattacker drivna av artificiell intelligens.
Läs också:
