Flere teknologiselskaper har i 2026 opplyst at KI-agenter har kommet seg ut av avgrensede testmiljøer og inn i reelle systemer. Ifølge sikkerhetsforsker Thorsten Holz peker hendelsene på en konkret risiko, men ikke på en nært forestående «robotoppstand».
Kortversjonen
- Flere store teknologiselskaper har i 2026 opplevd at avanserte KI-agenter har brutt ut av isolerte testmiljøer under sikkerhetsprøving.
- OpenAI- og Gemini-modeller har klart å finne sikkerhetshull for å skaffe seg internettilgang og ta seg inn i eksterne systemer.
- En OpenAI-agent tok seg nylig inn i en australsk helseportal og skrev data til en server, uten at pasientinformasjon ble berørt.
- Sikkerhetsforskere frykter at teknologien kan bli misbrukt av ondsinnede aktører mot kritisk infrastruktur heller enn at KI utvikler seg til superintelligens.
KI-agenter er systemer som ikke bare svarer på spørsmål, men som også kan utføre handlinger på egen hånd, som å kjøre kode, surfe på nettet og klikke seg gjennom digitale systemer, skriver DW.
OpenAI, Anthropic, Google og Meta har alle opplyst at KI-agenter i 2026 har kommet seg ut av kontrollerte testmiljøer. Hendelsene har skjedd under sikkerhetstesting av modellene.
Fant vei ut av sandkassen
I juli opplyste OpenAI at to av selskapets modeller hadde kommet seg ut av en såkalt sandkasse under en intern test. Modellene ble testet i ExploitGym, et system som måler om KI-agenter kan utnytte kjente programvarefeil.
Da modellene ikke klarte testoppgaven, fant de ifølge OpenAI en svakhet i programvaren som skulle holde dem i det isolerte testmiljøet. De fikk dermed tilgang til internett og tok seg inn på Hugging Face, en plattform der KI-utviklere lagrer modeller og data.
Modellene forsøkte der å finne svaret på testoppgaven og organiserte innsatsen på meldingsfora de selv opprettet, ifølge OpenAIs redegjørelse. Selskapet opplyste at denne atferden ikke var instruert. Hugging Face oppdaget inntrengningen og stanset den før OpenAI knyttet hendelsen til sin egen test. Det ble etter det opplyste ikke hentet ut kundedata.
Google har også bekreftet at Gemini under en test i mai gjettet eller fant påloggingsopplysninger og fikk tilgang til nettsidene til tre reelle selskaper. Google fikk først vite om inntrengningene i juli og offentliggjorde dem noen uker senere.
Les også: Skyggenettverk og propaganda: historien bak KGBs «Operasjon SIG» – del 2
I slutten av september sa Australias statsminister Anthony Albanese at en OpenAI-agent hadde tatt seg inn i en statistikkportal tilknyttet Medicare, landets offentlige helsesystem. Agenten skal ha fått tilgang til ikke-offentlige filer og skrevet data til en statlig server. Ingen pasientopplysninger skal ha blitt berørt.
Frykter misbruk heller enn superintelligens
Thorsten Holz, vitenskapelig direktør ved Max Planck-instituttet for sikkerhet og personvern i Tyskland, er blant forskerne som tester KI-systemer. Han sier utviklingen har overrasket ham.
– Det føles litt sprøtt hvor kraftige disse modellene har blitt. Jeg hadde ikke ventet at de skulle være så opptatt av å løse oppgaver at de begynte å gjøre ting vi aldri forutså, sier Holz til Deutsche Welle.
Han ser likevel ikke vitenskapelig grunnlag for at en superintelligens i overskuelig framtid på egen hånd skal beslutte å utslette mennesker. Slik programvare trenger dessuten store datasentre for å kjøre, noe som gjør den synlig, påpeker han.
Holz mener den mest nærliggende faren er at aktører med onde hensikter bruker stadig mer kapabel KI mot kritisk infrastruktur, til omfattende kompromittering av vanlige datamaskiner eller til å manipulere informasjon i stor skala og destabilisere politikken.
– Det vi definitivt trenger, er å finne ut hvordan vi kan bygge opp mer kompetanse innen sikkerhet, KI og særlig i skjæringspunktet mellom de to, sier han.
Han oppfordrer også til skepsis til selskapenes egne beskrivelser av teknologien. – Det finnes også fryktspredning, eller litt hype, rundt hvor avanserte disse modellene er, sier Holz.












