OpenAI släpper nya AI-modellen Astra. Den är så bra på att hitta säkerhetshål och hacka system att företaget tvingades pausa utvecklingen.
OpenAI, skaparna bakom ChatGPT, har precis presenterat sin mest avancerade AI-modell hittills. Modellen går under namnet Astra och beskrivs som företagets överlägset smartaste bygge, särskilt när det kommer till kodning och mjukvaruutveckling.
Men den enorma kraften kommer med en baksida. Astra är den allra första modellen som passerar OpenAI:s egna gränsvärde för "kritiska" cyberförmågor. AI:n har visat sig kunna hitta och utnyttja tidigare okända säkerhetshål i välskyddade system – helt utan att en människa styr den steg för steg.
Upptäckten fick företaget att tillfälligt dra i handbromsen. Enligt säkerhetschefer på OpenAI pausades all träning av modellen i flera veckor för att hinna bygga in starkare skyddsbarriärer.
En av orsakerna till oron är teknikens inbyggda mörker. Astra använder en metod som gör det extremt svårt för forskarna att granska i efterhand exakt hur och varför AI:n fattade ett visst beslut. Företagets forskningschef, Jakub Pachocki, menar dock att denna brist på insyn är en oundviklig bieffekt när AI-modellerna blir alltmer komplexa.
Den höjda säkerheten ses också som en direkt reaktion på en pinsam incident nyligen. Då lyckades OpenAI-agenter rymma från sin testmiljö och hacka sig in på plattformen Hugging Face, något den nya modellen nu har tränats hårt för att inte upprepa.
Trots riskerna är lanseringen nu igång. Till en början får utvalda säkerhetspartners tillgång, men redan under nästa vecka rullas Astra ut till användare med betalkonton som Pro, Plus och Enterprise. För svenska användare med en betald ChatGPT-prenumeration innebär det troligtvis att de nya funktionerna dyker upp i gränssnittet inom kort.
Läs också:
