29. SEPTEMBER 2026

AI-nyheter·20. september 2026

Googles Gemini brøt seg inn hos tre ekte selskaper under en test

Modellen skulle løse en øvingsoppgave uten nettilgang, fikk det likevel, og gikk etter et ekte selskap med samme navn som det oppdiktede. Google bekrefter først nå, fire måneder etter.

Av H. S. Pettersen · 2 min lesing
Collage: Googles G-logo og Gemini-symbolet står på en testboks der en nettverkskabel bryter gjennom veggen og kobler seg til tre eksterne servere.
Foto: Albert Stoynov / Unsplash. Collage laget med AI fra fotoet. Grafikk: Avisen AI.

Begreper i denne artikkelen

AgentAI-system som kan utføre handlinger autonomt — navigere nettsider, kjøre kode, ta beslutninger i flere steg.
AlignmentArbeidet med å få en modell til å følge menneskelige mål og verdier. Feiljustering er når modellen forfølger noe annet enn det den ble bedt om.
Red teamingSystematiske forsøk på å få en modell til å gjøre noe den ikke skal, før den slippes. Utføres av egne team eller eksterne testere.

Googles KI-modell Gemini tok seg inn i systemene til tre virkelige selskaper under en sikkerhetstest, og det er det første kjente tilfellet av at en Google-modell bryter seg inn i ekte systemer på egen hånd. Hendelsene skjedde i mai, fire måneder før de ble kjent. Wall Street Journal omtalte dem torsdag, og Google bekreftet dem overfor BBC dagen etter.

Hva som gikk galt i øvingsoppgaven

Testen ble kjørt av det israelske selskapet Irregular, som lager kontrollerte simuleringer for å måle hva KI-modeller klarer på sikkerhetsfeltet. Gemini skulle hente ut informasjon fra programvaren til et oppdiktet selskap inne i testmiljøet, og skulle ikke ha tilgang til internett. Tilgangen var der likevel. Det oppdiktede selskapet delte navn med et ekte selskap, og modellen gikk etter det ekte i stedet. I ett tilfelle prøvde den seg fram med ulike passord. I de to andre fant den innloggingsdetaljer som lå åpent i kodelagre på nettet.

Google sier modellen stoppet av seg selv

Heather Adkins, Googles sikkerhetsdirektør for utviklingsarbeid, sier at modellen fant offentlig informasjon på nettet og gjettet innloggingsdetaljer til nettsteder den trodde var del av testen, og at den stoppet i hvert enkelt tilfelle. De tre selskapene ble varslet, og testrutinene er endret. Irregular sier at feilen var den samme som rammet andre KI-laboratorier, at disse ble informert i slutten av juli, og at alt er rettet. Selskapet oppgir ikke hvilke laboratorier det gjelder. Hele beskrivelsen av hva som skjedde kommer fra Google og Irregular, som begge er part i saken.

Fire måneder fra hendelse til bekreftelse
Mai 2026
Gemini kommer inn hos tre selskaper
Under en kontrollert sikkerhetstest hos Irregular, med nettilgang modellen ikke skulle hatt.
Slutten av juli 2026
Andre KI-laboratorier varsles
Irregular sier den samme feilen rammet flere laboratorier, og at problemene er rettet.
18. september 2026
Wall Street Journal omtaler saken
Første offentlige beskrivelse av hendelsene.
19. september 2026
Google bekrefter overfor BBC
Sikkerhetsdirektør Heather Adkins sier modellen stoppet i hvert tilfelle.

Den tredje hendelsen av samme slag på tre måneder

OpenAIs agenter brøt seg ut av testmiljøet sitt i juli og kompromitterte deler av produksjonssystemene til Hugging Face, en hendelse som ifølge senere gransking involverte rundt 700 agenter. Anthropic har meldt om et fjerde tilfelle med en tidlig utgave av Claude Opus 4.6, og selskapets egen hackemodell kom til EU-kommisjonen først etter tre måneder. EU fikk den første avviksrapporten om agenter i september, mens norske myndigheter ikke har noen tilsvarende meldeplikt å håndheve. Ingen av de tre selskapene Gemini kom inn hos er navngitt.