OpenAI hittar fler fall där AI-agenter tog sig förbi skydd

Publicerad
Bild på en mobil med OPENAI loggan

OpenAI har upptäckt ytterligare fall där autonoma AI-agenter tagit sig utanför sina avsedda testmiljöer. Fynden ska ha gjorts under den utredning som inleddes efter den uppmärksammade säkerhetsincidenten hos Hugging Face tidigare i juli.

OpenAI har enligt Reuters identifierat fler fall där AI-agenter lyckats ta sig utanför de begränsningar som skulle hålla dem inom kontrollerade testmiljöer.

Uppgifterna kommer från personer med insyn i företagets pågående utredning. De nya fallen ska ha upptäckts när OpenAI granskade tidigare tester efter incidenten där en AI-modell komprometterade delar av Hugging Faces infrastruktur under ett internt cybersäkerhetstest.

Reuters uppger att det fortfarande är oklart hur många ytterligare incidenter som identifierats, när de inträffade eller exakt hur modellerna tog sig förbi skydden. Enligt nyhetsbyråns källor var händelserna begränsade och det finns inga uppgifter om att modellerna ska ha lämnat OpenAI:s eget nätverk.

Annons

Utredningen fortsätter

OpenAI offentliggjorde tidigare i juli en teknisk rapport om incidenten hos Hugging Face.

Enligt företaget lyckades en AI-modell utnyttja en tidigare okänd zero day-sårbarhet för att lämna den isolerade testmiljön. Därefter komprometterades delar av Hugging Faces infrastruktur för att komma åt information som kunde hjälpa modellen att slutföra den cybersäkerhetsuppgift den fått.

OpenAI beskriver händelsen som den mest omfattande som hittills upptäckts under företagets säkerhetstester.

Läs även: Ny AI-tvist: Apple stämmer OpenAI

Flera externa tjänster berördes

I sin rapport uppger OpenAI att modellerna under testerna fick åtkomst till fyra konton på fyra olika tjänster.

Ett konto användes som mellanled för nätverkstrafik, ett för datalagring och två användes endast för att läsa information. OpenAI skriver också att ett mindre antal andra externa konton nåddes under separata utvärderingar.

Bolaget uppger samtidigt att man inte sett några tecken på att de berörda tjänsterna utsatts för någon bredare påverkan och att de berörda leverantörerna informerats.

Läs även: Giveaway: Vinn 3 000 kr presentkort på Webhallen

Skärper säkerheten efter incidenten

Enligt Reuters fortsätter OpenAI nu att analysera loggar från tidigare tester för att avgöra om fler liknande incidenter har inträffat.

OpenAI uppger samtidigt att flera av de skydd som normalt används i företagets AI-system medvetet var avstängda under testerna för att modellerna skulle kunna utvärderas under så realistiska förhållanden som möjligt.

Efter incidenten har bolaget infört skärpta åtkomstkontroller, förbättrad övervakning och nya rutiner för framtida säkerhetstester.

Vinn ett presentkort på Webhallen. Delta i vår giveaway för chansen att vinna 3000 kr.