David Robinson har sagt upp sig från OpenAI efter tre och ett halvt år på företaget. Han arbetade med säkerhet och transparens och ledde bland annat arbetet med de säkerhetsrapporter som publicerades i samband med stora modellsläpp.
I en egen text i The Atlantic beskriver Robinson beslutet som resultatet av ett större problem. Enligt honom utvecklar OpenAI och andra ledande AI-bolag allt kraftfullare system utan den försiktighetskultur som tekniken nu kräver.
Robinsons roll gör kritiken särskilt intressant eftersom han arbetade med de processer som ska bedöma riskerna innan avancerade modeller släpps. Han var bland annat involverad i OpenAI Preparedness Framework och säkerhetsrapporteringen kring företagets modeller.
Annons
OpenAI beskriver själva Preparedness Framework som grunden för hur företaget identifierar och hanterar risker som cybersäkerhet, biologiska och kemiska förmågor, självförbättring och mer självständiga AI-system.
”Trial and error” fungerar inte längre
Kärnan i Robinsons kritik är inte att OpenAI saknar säkerhetsteam eller tester. Problemet är enligt honom kulturen runt själva utvecklingen.
Silicon Valley har länge byggt produkter genom att lansera snabbt, upptäcka problem och sedan förbättra dem. Robinson menar att den modellen blir farligare när samma arbetssätt används på AI-system som själva kan använda verktyg, skriva kod och agera mot andra datorsystem.
Han argumenterar i stället för att de ledande AI-labben behöver börja arbeta mer som kärnkraftverk och flygindustrin. Där byggs säkerheten i flera lager så att ett enskilt mänskligt misstag inte ska kunna få katastrofala konsekvenser.
I juli lyckades OpenAI-modeller under interna cybersäkerhetstester ta sig förbi kontroller som skulle hålla dem isolerade från internet. Modellerna utnyttjade sårbarheter, fick internetåtkomst och komprometterade delar av både OpenAI egen forskningsmiljö och Hugging Faces system.
OpenAI beskrev senare händelsen som ett varningsskott och konstaterade att avancerade AI-agenter blivit tillräckligt kapabla för att hitta och utnyttja säkerhetsbrister över flera datorsystem om skydden runt dem inte är tillräckliga.
Läs mer: AI-testerna skulle göra modellerna säkrare, nu har de blivit en säkerhetsrisk
OpenAI har redan tvingats bromsa
Det finns samtidigt en viktig motbild till Robinsons kritik. OpenAI har faktiskt börjat bromsa utvecklingen när de egna säkerhetssystemen slagit larm.
Efter Hugging Face-incidenten pausade företaget delar av träningen av sina mest avancerade modeller. OpenAI uppgav då att säkerheten behövde hinna ikapp modellernas snabbt ökande förmåga och att företagets största planerade träningskörning skulle hållas tillbaka medan nya skydd testades.
Senast stoppades också den planerade lanseringen av GPT-6.1 Astra efter att modellen inte klarat företagets interna säkerhetskrav. Problemet var kopplat till just den utveckling Robinson varnar för: AI-system som blir bättre på att arbeta självständigt under lång tid men samtidigt svårare att hålla inom de gränser utvecklaren satt upp.
Läs mer: OpenAI stoppar nästa ChatGPT-modell: “för farlig”
OpenAI svar på Robinsons kritik är också att företaget håller på att förstärka säkerheten. En talesperson uppger för TechCrunch att OpenAI bland annat arbetar med hårdare säkerhet i forskningsmiljöerna, mer extern utvärdering och bättre övervakning för att upptäcka problem tidigare under träningen.
Säkerhetsfrågan flyttar in i själva AI-utvecklingen
Robinsons avhopp kommer dessutom efter flera förändringar inom OpenAI säkerhetsorganisation. I juli lämnade Johannes Heidecke rollen som chef för Safety Systems i samband med att företaget organiserade om och integrerade säkerhetsarbetet närmare forskningen.
Enligt Wired skrev OpenAI forskningschef Mark Chen då internt att kraven på säkerhetsarbetet ökar samtidigt som företaget tränar modeller i snabbare takt och tiden mellan lanseringarna minskar.
Det gör Robinsons kritik svårare att avfärda som en principiell diskussion om hypotetisk superintelligens. OpenAI har under 2026 själv dokumenterat AI-system som lämnat avsedda testmiljöer, nått externa system och blivit betydligt mer kapabla inom offensiv cybersäkerhet.
Samtidigt bygger företagets nästa generation produkter på att modellerna ska få göra mer på egen hand. GPT-6 Astra kan använda datorer och verktyg under längre arbetsflöden, medan Dots är byggda för att fortsätta arbeta i bakgrunden utan att användaren behöver sitta kvar framför ChatGPT.
Det är där Robinsons kritik träffar en av de svåraste frågorna för hela AI-branschen. Ju mer användbart ett självständigt AI-system blir, desto större möjligheter behöver det att faktiskt påverka omvärlden.
Säkerhet handlar därför inte längre bara om att hindra en chatbot från att skriva ett olämpligt svar. När modeller får webbläsare, kodmiljöer, internetåtkomst och andra verktyg måste säkerhetssystemen också kunna kontrollera vad AI faktiskt gör.
Robinson menar att den förändringen kräver mer än bättre tester. Hans slutsats är att själva kulturen runt utvecklingen måste förändras.
För OpenAI kommer kritiken från någon som under flera år arbetade med just de system som skulle göra den snabba utvecklingen säker. Det är det som gör avhoppet betydligt mer besvärande än ännu en extern varning om AI-risker.
Spela lite spel!
Spela lite spel från TeknikGeeks redaktions utvalda bibliotek. Ett slumpmässigt spel i varje artikel.
