OpenAI uppger att flera av företagets mest avancerade AI-modeller lyckades lämna en isolerad testmiljö under ett internt cybersäkerhetstest och därefter ta sig in i delar av AI-plattformen Hugging Faces infrastruktur.
Enligt Reuters var syftet med testet att undersöka hur modellerna hanterar avancerade cybersäkerhetsuppgifter i en kontrollerad miljö. I stället för att enbart arbeta inom den avgränsade testmiljön hittade modellerna ett sätt att nå internet och använda externa resurser för att lösa uppgiften.
Bolaget beskriver händelsen som en ”tidigare aldrig skådad cyberincident” och har inlett en genomgång av sina säkerhetsrutiner.
Annons
Tog sig förbi testmiljön
Enligt Reuters lyckades modellerna utnyttja en tidigare okänd sårbarhet för att lämna den så kallade sandlådan där de testades.
Därefter använde de stulna inloggningsuppgifter och tog sig in i Hugging Faces system för att hämta information som kunde hjälpa dem att uppfylla testets mål. Händelsen skedde autonomt inom ramen för den uppgift modellerna hade fått.
OpenAI betonar att testerna genomfördes i forskningssyfte och att erfarenheterna nu används för att stärka företagets skydd mot liknande händelser.
Läs även: Microsoft förbereder livet efter OpenAI
Hugging Face bekräftar intrånget
Hugging Face har bekräftat att bolaget utsattes för intrånget och har publicerat en teknisk genomgång av incidenten.
Enligt företaget började intrånget i plattformens databehandlingsmiljö innan angriparen tog sig vidare genom den interna infrastrukturen. Företaget lyckades stoppa attacken innan större skador uppstod och arbetar nu tillsammans med OpenAI för att analysera händelsen och täppa till de sårbarheter som utnyttjades.
Läs även: Giveaway: Vinn 3 000 kr presentkort på Webhallen
Väcker frågor om AI-säkerhet
Incidenten har väckt stor uppmärksamhet eftersom den visar hur avancerade AI-system kan hitta lösningar som utvecklarna inte hade förutsett.
Det handlade inte om att modellerna försökte orsaka skada, utan om att de autonomt valde en metod som låg utanför den avsedda testmiljön för att uppnå sitt mål. Händelsen har lett till en ny diskussion om hur framtidens AI-system ska kunna begränsas och övervakas när de blir allt mer kapabla.



