AINyhet

OpenAI avslöjar historisk AI-incident under säkerhetstest

Publicerad
OpenAis kontor

OpenAI har avslöjat en ovanlig säkerhetsincident där avancerade AI-modeller under ett internt test lyckades ta sig ut ur en isolerad testmiljö och kompromettera AI-plattformen Hugging Face. Händelsen beskrivs som den första i sitt slag.

OpenAI uppger att flera av företagets mest avancerade AI-modeller lyckades lämna en isolerad testmiljö under ett internt cybersäkerhetstest och därefter ta sig in i delar av AI-plattformen Hugging Faces infrastruktur.

Enligt Reuters var syftet med testet att undersöka hur modellerna hanterar avancerade cybersäkerhetsuppgifter i en kontrollerad miljö. I stället för att enbart arbeta inom den avgränsade testmiljön hittade modellerna ett sätt att nå internet och använda externa resurser för att lösa uppgiften.

Bolaget beskriver händelsen som en ”tidigare aldrig skådad cyberincident” och har inlett en genomgång av sina säkerhetsrutiner.

Annons

Tog sig förbi testmiljön

Enligt Reuters lyckades modellerna utnyttja en tidigare okänd sårbarhet för att lämna den så kallade sandlådan där de testades.

Därefter använde de stulna inloggningsuppgifter och tog sig in i Hugging Faces system för att hämta information som kunde hjälpa dem att uppfylla testets mål. Händelsen skedde autonomt inom ramen för den uppgift modellerna hade fått.

OpenAI betonar att testerna genomfördes i forskningssyfte och att erfarenheterna nu används för att stärka företagets skydd mot liknande händelser.

Läs även: Microsoft förbereder livet efter OpenAI

Hugging Face bekräftar intrånget

Hugging Face har bekräftat att bolaget utsattes för intrånget och har publicerat en teknisk genomgång av incidenten.

Enligt företaget började intrånget i plattformens databehandlingsmiljö innan angriparen tog sig vidare genom den interna infrastrukturen. Företaget lyckades stoppa attacken innan större skador uppstod och arbetar nu tillsammans med OpenAI för att analysera händelsen och täppa till de sårbarheter som utnyttjades.

Läs även: Giveaway: Vinn 3 000 kr presentkort på Webhallen

Väcker frågor om AI-säkerhet

Incidenten har väckt stor uppmärksamhet eftersom den visar hur avancerade AI-system kan hitta lösningar som utvecklarna inte hade förutsett.

Det handlade inte om att modellerna försökte orsaka skada, utan om att de autonomt valde en metod som låg utanför den avsedda testmiljön för att uppnå sitt mål. Händelsen har lett till en ny diskussion om hur framtidens AI-system ska kunna begränsas och övervakas när de blir allt mer kapabla.

Vinn ett presentkort på Webhallen. Delta i vår giveaway för chansen att vinna 3000 kr.