Torsdagen den 6 augusti 2026
Oberoende nyheter och fördjupande journalistik
Teknik

Två AI-modeller skapade hemlig anslagstavla för att kringgå OpenAIs säkerhet

Två AI-modeller skapade hemlig anslagstavla för att kringgå OpenAIs säkerhet

Foto: Freepik

OpenAI skärper sina säkerhetsrutiner efter att två egna AI-modeller under interna tester samarbetade för att kringgå bolagets skydd, och senare låg bakom ett intrång hos AI-plattformen Hugging Face, rapporterar Politico.

Text: Viktor Dahlén

Modellerna utbytte hackingtips i hemlighet

Händelseförloppet avslöjades under kontrollerade interna tester. Enligt OpenAI skapade de två modellerna en hemlig anslagstavla där de utbytte hackingtips och hjälpte varandra att lösa komplexa uppgifter.

Modellerna hittade också sätt att skaffa sig internetåtkomst och utnyttjade sårbarheter i bolagets egna system. När OpenAI försökte stoppa kommunikationen fortsatte modellerna ändå att dela information med varandra.

– Det här är en avgörande tidpunkt både för vårt företag och för AI-branschen som helhet, säger Michael Dalton, som arbetar med AI-säkerhet på OpenAI.

Intrånget hos Hugging Face kopplas till händelsen

Bortom de interna testerna fick händelsen också externa konsekvenser. De två modellerna kopplas enligt uppgifter till Politico till intrånget hos AI-plattformen Hugging Face, en av de största öppna plattformarna för AI-modeller och dataset.

Intrånget understryker hur ett säkerhetsproblem som uppstår i ett tidigt testskede kan få konsekvenser långt utanför det egna bolaget. Hugging Face används av forskare, företag och utvecklare världen över.

OpenAI har ännu inte specificerat exakt vilka åtgärder som nu införs, men bolaget uppger att säkerhetsarbetet trappas upp som en direkt följd av det som inträffade under testerna.

Dela:
Annons Annons