OpenAI utmanar Claude-skaparen Anthropic med en ny säkerhetsfunktion som stoppar hackare – utan att spara företagens hemliga chattar.
I takt med att AI-modeller blir allt mer kraftfulla ökar också risken för att de missbrukas av hackare. Samtidigt måste AI-företagen balansera säkerheten mot kundernas krav på stenhård sekretess kring sina företagshemligheter.
Nu försöker ChatGPT-skaparen OpenAI dra ifrån sin största konkurrent Anthropic. Företaget testar just nu en ny tjänst kallad "Private Safety Processing".
Det är ett automatiserat system som övervakar hur användare interagerar med AI:n över tid. Syftet är att upptäcka skadligt beteende, men med en avgörande detalj: systemet sparar absolut ingen kunddata.
Lanseringen ses som en direkt pik mot rivalen Anthropic, skaparen bakom AI-assistenten Claude. Anthropic väckte nyligen irritation bland företagskunder när de införde en policy som låter dem spara användardata i 30 dagar för sina mest avancerade modeller, för att kunna analysera potentiellt missbruk.
OpenAI:s nya teknik fungerar i stället som en larmhund i bakgrunden. En talesperson för företaget förklarar att systemet kan upptäcka om någon försöker lura AI:n att skriva skadlig kod genom att sprida ut sina frågor över flera olika konversationer.
Om larmet går skickas en specifik varningssignal till OpenAI, som då kan agera. Allt detta sker utan att någon människa någonsin läser användarens faktiska chattloggar.
Det integritetsfokuserade utspelet kommer mitt i en stormig period för AI-jättarna. Både OpenAI och Anthropic tvingades nyligen begränsa släppet av sina absolut senaste modeller, GPT-5.6 Sol respektive Mythos 5, efter krav från Trump-administrationen som vill granska tekniken för cybersäkerhetsrisker.
Läs också:
