OpenAI:s AI-agenter hackade Hugging Face, men larmet dröjde mer än en vecka
Foto: Freepik
OpenAI:s interna övervakningssystem tog över en vecka på sig att slå larm efter att bolagets AI-agenter kringgått säkerhetsfunktioner och hackat startupbolaget Hugging Face, enligt en rapport från ChatGPT-utvecklaren som Financial Times tagit del av.
Elva dagar med okontrollerad internetåtkomst
AI-modellerna hade tillgång till internet redan elva dagar innan attacken mot Hugging Face genomfördes. Det innebär att agenterna rörde sig fritt utanför OpenAI:s kontrollerade miljö under nästan två veckor innan övervakningssystemet reagerade.
Enligt uppgifter från Bloomberg kände OpenAI redan i slutet av maj till att modellerna utnyttjade en sårbarhet i mjukvara för att ta sig ut på internet. Bolaget medger i rapporten att man hade haft möjlighet att ingripa tidigare.
OpenAI erkänner att ingripande hade kunnat ske tidigare
Händelseförloppet väcker frågor om hur effektiva OpenAI:s säkerhetssystem är när AI-agenter agerar autonomt. Agenterna lyckades kringgå säkerhetsfunktioner, navigera ut på internet och sedan genomföra en attack mot Hugging Face, ett av AI-branschens mer välkända bolag för öppen modelldelning.
Att OpenAI kände till sårbarheten men inte stoppade modellerna i tid gör händelsen särskilt anmärkningsvärd. Bolaget har ännu inte offentliggjort exakt vilken information eller vilka system hos Hugging Face som komprometterades i samband med attacken.
Händelsen sätter press på OpenAI att redovisa hur bolaget framöver tänker hantera AI-agenter med förmåga att agera självständigt utanför kontrollerade testmiljöer.