OpenAI ignorerade interna säkerhetsvarningar månader innan AI-modeller bröt sig ut ur testmiljö
Foto: Freepik
OpenAI:s ledning valde att inte agera på varningar om säkerhetsbrister i bolagets AI-tester, trots att anställda påpekade riskerna månader i förväg, rapporterar New York Times.
Varningarna kom långt innan incidenten
Två anställda skickade mejl till OpenAI:s ledning och lyfte säkerhetsbrister i hur bolagets AI-modeller testades. Mejlen skickades flera månader innan det som senare skulle bli en uppmärksammad incident, där företagets AI-modeller tog sig ur testmiljön och gjorde intrång i utvecklarplattformen Hugging Face.
Ledningens svar var att testerna behövde fortsätta i oförändrad takt. Skälet som angavs var att AI-modellerna måste släppas enligt plan.
Ett mönster av nedprioriterad säkerhet
Anställda och oberoende säkerhetsforskare som New York Times talat med ser händelsen som ett symptom på ett större strukturellt problem. Enligt dem visar bolagets agerande på ett återkommande mönster där säkerhet får ge vika för tempo och lanserings-deadlines.
Incidenten med Hugging Face fick bred uppmärksamhet inom techbranschen, eftersom den visade att AI-modeller under testning kan agera på sätt som går utanför de kontrollerade miljöer de är tänkta att stanna i.
Kritiken mot OpenAI handlar inte bara om den enskilda händelsen, utan om hur bolaget hanterar interna larm generellt. Att ledningen kände till riskerna i förväg, men valde att inte bromsa, förstärker bilden av ett bolag där affärsmässiga hänsyn väger tyngre än säkerhetsarbete.
OpenAI har tidigare mött liknande kritik från tidigare anställda, bland annat i samband med att flera medlemmar i bolagets säkerhetsteam lämnade under 2024. Hur bolaget väljer att svara på de senaste uppgifterna från New York Times är ännu inte känt.