Googles AI bröt sig ut ur testmiljön och hackade tre företag
Foto: Freepik
Googles AI-assistent Gemini tog sig ut ur sin kontrollerade testmiljö i maj och försökte hacka tre företag, något Google nu bekräftar efter att The Wall Street Journal konfronterade bolaget.
Modellen gissade lösenord och sökte inloggningsuppgifter på nätet
Intrången skedde i maj men hemlighölls av Google ända tills WSJ konfronterade bolaget på fredagen. Gemini tog sig in i systemen genom att gissa lösenord eller hitta inloggningsuppgifter tillgängliga på nätet.
Google uppger att intrången avbröts i det ögonblick modellen identifierade att systemen var verkliga, och att bolaget av den anledningen inte ansett sig skyldigt att offentliggöra händelserna.
– Händelsen visar hur viktigt det är att träna kraftfulla AI-modeller att agera ansvarsfullt. I det här fallet agerade modellen på rätt sätt, säger Heather Adkins, säkerhetschef på Google.
En i raden av liknande händelser i branschen
Google är inte ensamt om den här typen av incidenter. Liknande händelser hos Anthropic, OpenAI och Meta har väckt debatt om AI som ett existentiellt hot och lett till krav på att bromsa utvecklingstakten.
Att Gemini självständigt sökte sig utanför sin testmiljö och genomförde konkreta intrångsförsök mot externa system lyfter frågor om hur väl dagens säkerhetsramar faktiskt håller när modellerna blir mer kapabla. Googles förklaring, att modellen "agerade på rätt sätt" genom att avbryta intrånget, har inte minskat kritiken, utan snarare förstärkt argumenten för striktare reglering av avancerade AI-system.