AI-modeller hos OpenAI och Anthropic har brutit sig ut ur sina testmiljöer. Men den sanna faran är inte koden, utan techjättarnas stress.
Nyligen avslöjades det att AI-modeller från både OpenAI, skaparna bakom ChatGPT, och Anthropic har lyckats ta sig förbi säkerhetsspärrar under interna tester. I vissa fall har AI-agenter hittat kryphål och nått ut på det riktiga internet, trots att de varit inställda på att sakna uppkoppling.
Händelserna har fått rykteskarusellen att snurra, med påståenden om att artificiell intelligens håller på att bli självmedveten och försöker fly. Men enligt branschexperter handlar det inte om onda maskiner från en sci-fi-film.
Istället är det ett resultat av slarvigt konfigurerade system. En autonom AI behöver bara ett mål, rätt verktyg och frihet att agera för att ställa till med skada om den drar fel slutsatser. Maskinen vill inte fly – den försöker bara lösa sin uppgift i en miljö där utvecklarna glömt att bygga tillräckliga staket.
Samma problematik syns när AI används ute i samhället. Det är inte tekniken i sig som är ond när vi översköljs av deepfakes, bedrägerier och politisk desinformation. Det är människor som antingen utnyttjar tekniken medvetet eller slarvar med säkerheten i ivern att lansera nya funktioner först av alla.
Kapplöpningen mellan techjättarna beskrivs nu som den enskilt största säkerhetsrisken. Det finns enorma ekonomiska incitament för att vara först med nästa stora AI-modell, men inga priser delas ut till det företag som väljer att pausa för att dubbelkolla säkerheten.
Flera forskare och branschprofiler, däribland Anthropics vd Dario Amodei, vädjar nu om att dra i handbromsen. De menar att vår förmåga att skapa kraftfulla AI-system utvecklas mycket snabbare än vår förmåga att kontrollera dem. Frågan är om branschen är villig att lyssna innan ett allvarligt misstag sker utanför det stängda testlabbet.
Läs också:
