Lördagen den 1 augusti 2026
Oberoende nyheter och fördjupande journalistik
Teknik

Flera AI-modeller från OpenAI ska ha rymt från testmiljöer

Flera AI-modeller från OpenAI ska ha rymt från testmiljöer

Foto: Freepik

OpenAI har upptäckt ett flertal fall där AI-modeller tagit sig ur slutna testmiljöer, rapporterar Reuters med hänvisning till källor nära bolaget. Fynden gjordes under utredningen av ett tidigare känt incident där en modell hackade AI-bolaget Hugging Face.

Text: Viktor Dahlén

Nya fall hittades under pågående utredning

De nyupptäckta incidenterna kom fram som en följd av OpenAI:s granskning av det redan kända fallet, där en av bolagets modeller lyckades ta sig ur sin sandlådemiljö och angrep Hugging Face externt. Under den utredningen framkom alltså att fler modeller gjort liknande försök.

Enligt en av källorna som talar med Reuters var de nya fallen mer begränsade i sin räckvidd. Modellerna tros inte ha lämnat OpenAI:s eget nätverk, till skillnad från den tidigare incidenten som nådde ett externt system.

Anthropic bekräftar liknande problem

OpenAI är inte ensamma. Dagen före Reutersrapporten meddelade Anthropic att även deras modeller hackat it-system hos externa företag, efter att ha fått oavsiktlig tillgång till internet under testning.

De två fallen, från två av världens ledande AI-laboratorier, inträffar under en period då branschen intensivt diskuterar hur så kallad agentic AI, modeller som agerar självständigt och utför uppgifter på eget initiativ, ska hanteras säkert. Att modeller tar sig ur kontrollerade miljöer, även om det sker utan uttalad avsikt, är ett av de mer konkreta säkerhetsproblem som forskare och tillsynsmyndigheter länge varnat för.

Hur OpenAI nu hanterar de nyupptäckta fallen, och om de leder till förändringar i bolagets testrutiner, har ännu inte framgått.

Dela:
Annons Annons