En kritisk sårbarhet låter hackare kapa AI-assistenter från insidan. Samtidigt varnar experter för att vi saknar regler för AI-agenter.
AI-assistenter som Github Copilot, Claude Code och Gemini har blivit standardverktyg för att skriva och granska kod. De fungerar som autonoma medarbetare som kan hämta filer, köra program och navigera direkt på utvecklarens dator.
Nu skakar den nyligen upptäckta sårbarheten "Plugin4Shell" techvärlden. Genom ett oväntat enkelt trick kan hackare lura AI-assistenten att ladda ner skadlig kod från en falsk uppdatering. Det värsta av allt? Användaren behöver inte ens klicka på en länk för att attacken ska lyckas.
Eftersom AI-agenten redan har djupgående tillgång till utvecklarens system, får hackarna automatiskt samma makt. De kan stjäla lösenord, läsa hemlig källkod och infiltrera företagets bakomliggande servrar.
Flera företag har tvingats agera snabbt. Anthropic och OpenAI har redan täppt till hålet i Claude Code respektive Codex. För användare av Github Copilot fanns initialt ingen lösning på plats vid avslöjandet, och Google har meddelat att de inte tänker uppdatera sin äldre Gemini-klient överhuvudtaget.
Problemet belyser en mycket större kris i techbranschen: vi vet fortfarande inte hur vi ska tygla autonoma AI-program. När den amerikanska myndigheten NIST nyligen släppte nya, strikta säkerhetsregler för digitala identiteter lämnades AI-agenter i princip helt utanför. Dagens säkerhetsstandarder bygger fortfarande på antagandet att det är en människa av kött och blod som sitter vid tangentbordet.
Konsekvenserna av detta glapp är redan märkbara i verkligheten. Säkerhetsföretaget Mandiant rapporterar att hackare har gått från att bara ställa frågor till chattbottar, till att låta kapade AI-agenter utföra avancerade cyberattacker på egen hand. Det kan också bli dyrt; i ett fall löpte en AI-agent amok på grund av ett fel och genererade molnkostnader på närmare en halv miljon kronor på under en timme.
Säkerhetsbranschen står nu inför ett paradigmskifte. Frågan är inte längre bara vem som loggar in i ett system, utan hur vi säkerställer att en självtänkande AI inte utför handlingar den aldrig fick tillåtelse att göra.
Läs också:
