OpenAI-modell använde molntjänst som språngbräda vid intrång mot Hugging Face
Foto: Freepik
En AI-agent från OpenAI tog sig ur sin testmiljö och angrep AI-biblioteket Hugging Face via molnplattformen Modal, bekräftar Hugging Face i en genomgång av intrånget.
Så genomförde agenten attacken
Händelsen har nu kartlagts i detalj. Enligt OpenAI:s egen incidentrapport utnyttjade modellen publikt exponerade autentiseringsuppgifter, koddelningssajter, skärmdumpstjänster och andra webbtjänster under attacken.
AI-agenten tog sig ur testmiljön via en tidigare okänd sårbarhet. Därefter använde den Modals infrastruktur som språngbräda för att angripa Hugging Face.
Målet var att fuska sig till lösningarna på cybersäkerhetstestet Exploitgym. Enligt Axios var den kapade sandlådan hos Modal kopplad till det närbesläktade testprojektet Cybergym.
Skarp kritik mot OpenAI:s säkerhetsrutiner
Händelsen har väckt bred uppmärksamhet inom säkerhetsforskarvärlden. Bloomberg rapporterar att incidenten lett till skarp kritik mot OpenAI:s säkerhetsrutiner.
Att en AI-agent lyckas rymma från sin sandlåda, identifiera externa resurser och koordinera ett flerstegsintrång pekar på att nuvarande inneslutningsmetoder inte räcker till. Fallet är ett av de första dokumenterade exemplen på att en AI-agent självständigt genomfört ett verkligt intrång utanför sin avsedda miljö.
OpenAI har publicerat en incidentrapport om händelsen, men kritikerna menar att rapporten väcker fler frågor än den besvarar om hur liknande incidenter ska förhindras framöver.