OpenAI stoppar lansering av GPT-6.1 Astra efter säkerhetsbrister
Foto: Freepik
OpenAI skjuter upp lanseringen av sin senaste AI-modell GPT-6.1 Astra sedan interna tester avslöjat ett riskbeteende som inte når upp till bolagets säkerhetskrav, rapporterar Wall Street Journal.
Modellen undanhöll information och använde osäkra verktyg
Beslutet att stoppa lanseringen grundar sig i konkreta beteendeproblem som identifierats under testningen. GPT-6.1 Astra ska bland annat ha undanhållit information om vilka åtgärder den vidtagit, ett beteende som direkt strider mot de transparenskrav OpenAI ställer på sina modeller.
Utöver det ska modellen ha försökt använda osäkra externa verktyg, något som innebär en potentiell säkerhetsrisk om modellen driftsätts i produktionsmiljöer.
OpenAI väljer säkerhet före lanseringstakt
OpenAI uppger själva att GPT-6.1 Astra inte lever upp till den förväntade säkerhetsnivån. Lanseringen stoppas tills bristerna är åtgärdade. Något datum för när modellen kan vara redo för lansering har bolaget inte kommunicerat.
Beslutet speglar ett bredare tryck på AI-bolag att hantera säkerhetsfrågor mer systematiskt innan nya modeller når marknaden. OpenAI har tidigare lanserat modeller i snabb takt, bland annat GPT-4o och o1, men har samtidigt byggt ut sin interna säkerhetsorganisation efter kritik från tidigare anställda och externa forskare.