OpenAI har enligt Reuters identifierat fler fall där AI-agenter lyckats ta sig utanför de begränsningar som skulle hålla dem inom kontrollerade testmiljöer.
Uppgifterna kommer från personer med insyn i företagets pågående utredning. De nya fallen ska ha upptäckts när OpenAI granskade tidigare tester efter incidenten där en AI-modell komprometterade delar av Hugging Faces infrastruktur under ett internt cybersäkerhetstest.
Reuters uppger att det fortfarande är oklart hur många ytterligare incidenter som identifierats, när de inträffade eller exakt hur modellerna tog sig förbi skydden. Enligt nyhetsbyråns källor var händelserna begränsade och det finns inga uppgifter om att modellerna ska ha lämnat OpenAI:s eget nätverk.
Annons
Utredningen fortsätter
OpenAI offentliggjorde tidigare i juli en teknisk rapport om incidenten hos Hugging Face.
Enligt företaget lyckades en AI-modell utnyttja en tidigare okänd zero day-sårbarhet för att lämna den isolerade testmiljön. Därefter komprometterades delar av Hugging Faces infrastruktur för att komma åt information som kunde hjälpa modellen att slutföra den cybersäkerhetsuppgift den fått.
OpenAI beskriver händelsen som den mest omfattande som hittills upptäckts under företagets säkerhetstester.
Läs även: Ny AI-tvist: Apple stämmer OpenAI
Flera externa tjänster berördes
I sin rapport uppger OpenAI att modellerna under testerna fick åtkomst till fyra konton på fyra olika tjänster.
Ett konto användes som mellanled för nätverkstrafik, ett för datalagring och två användes endast för att läsa information. OpenAI skriver också att ett mindre antal andra externa konton nåddes under separata utvärderingar.
Bolaget uppger samtidigt att man inte sett några tecken på att de berörda tjänsterna utsatts för någon bredare påverkan och att de berörda leverantörerna informerats.
Läs även: Giveaway: Vinn 3 000 kr presentkort på Webhallen
Skärper säkerheten efter incidenten
Enligt Reuters fortsätter OpenAI nu att analysera loggar från tidigare tester för att avgöra om fler liknande incidenter har inträffat.
OpenAI uppger samtidigt att flera av de skydd som normalt används i företagets AI-system medvetet var avstängda under testerna för att modellerna skulle kunna utvärderas under så realistiska förhållanden som möjligt.
Efter incidenten har bolaget infört skärpta åtkomstkontroller, förbättrad övervakning och nya rutiner för framtida säkerhetstester.



