Hoppa till innehåll
OpenAI och Anthropic vill ha externa "AI-poliser" i labben
Foto: Americans for Responsible Innovation
Teknik

OpenAI och Anthropic vill ha externa "AI-poliser" i labben

Av

OpenAI och Anthropic vill ge externa granskare total insyn i sina AI-labb. Men experter varnar för att det kan bli ett tandlöst PR-trick.

Techjättarna bakom Chat GPT och Claude gör en oväntad helomvändning. OpenAI och Anthropic föreslår nu att utomstående experter ska få flytta in i deras laboratorier för att granska framtidens AI-modeller under själva utvecklingen.

Fram tills nu har oberoende aktörer, som säkerhetsgruppen METR, oftast bara fått testa färdiga AI-modeller strax innan de släpps till allmänheten. Enligt vissa bedömare har granskarnas insyn dessutom strypts nästan helt sedan förra året.

Problemet med dagens testmetoder är att de nya AI-modellerna har blivit så pass smarta att de kan känna av när de utvärderas. Risken är att de uppför sig exemplariskt under slutprovningen, men döljer farliga beteenden. För att upptäcka detta krävs tillgång till modellens "tankeprocess" redan under träningsfasen.

Utspelen kommer efter att OpenAI, Anthropic och Google DeepMind i hemlighet diskuterat AI-säkerhet under flera veckor. Branschen vill nu visa att man tar de potentiella riskerna på allvar.

Men initiativet möts av skepsis. Kritiker drar paralleller till bankvärlden, där statliga granskare faktiskt har makt att tvinga fram förändringar eller till och med stänga ner en verksamhet.

– Om man inte ger dem den typen av makt, vet jag inte vad de egentligen ska göra där, säger experten på bankreglering Julie Andersen Hill om de föreslagna AI-granskarna.

Organisationer som lobbar för en ansvarsfull teknikutveckling välkomnar förslaget, men anser att frivilliga åtaganden inte räcker. Brad Carson, ordförande för Americans for Responsible Innovation, kräver nu att lagstiftare agerar snabbt för att tvinga fram statliga säkerhetsstandarder.

Exakt vilka befogenheter granskarna får, och när detta blir verklighet, är fortfarande oklart. För vanliga användare innebär det förhoppningsvis att framtida versioner av populära AI-tjänster kommer att testas betydligt hårdare innan de dyker upp i våra mobiler.

Läs också:

Vår journalistik bygger på trovärdighet och opartiskhet. Fakta som publiceras ska vara verifierbara och relevanta. Vi strävar efter förstahandskällor och att vara på plats där händelser utspelar sig. Läs mer här.