DEBATT | Marius Sandbu

SIKKERHET OG KONTROLL: Virksomheter bør fortsette å prioritere grunnleggende sikkerhet og samtidig etablere kontroll over KI-agentene de tar i bruk, skriver Marius Sandbu.

KI-agentene kommer — sitt rolig i båten

Utviklingen innen generativ kunstig intelligens går nå så raskt at det kan være vanskelig å skille reelle trusler fra spekulasjoner. Les hvilke grep virksomhetene må ta nå, uten å få panikk.

Publisert

Nye språkmodeller kan analysere store mengder informasjon, finne sårbarheter, styre datamaskiner, nettlesere og kjøre komplekse kommandoer.  

Når en språkmodell får tilgang til å utføre handlinger, har vi i praksis fått en KI-agent. Spørsmålet er ikke lenger bare hva modellen kan svare på, men hva den kan gjøre.

Evnen til å utnytte sårbarheter

Utviklingen er veldig tydelig innen cybersikkerhet. CyberGym og ExploitGym er målinger som verifiserer hvor gode språkmodeller er innenfor angitte områder. Da Anthropic lanserte KI-modellen Mythos våren 2026, oppnådde modellen 83 prosent i CyberGym. Bare fem måneder senere presenterte Z.ai en modell som presterte bedre på den samme testen.

Det teknologiske forspranget blir med andre ord hentet inn raskt.

Når agentene løper løpsk

I sommer gjennomførte OpenAI en intern test av en ny språkmodell med agenter mot Exploitgym, hvor sikkerhetsmekanismene var redusert. Agentene fant på egenhånd en ukjent sårbarhet, brøt seg ut av det isolerte testmiljøet og skaffet seg internettilgang. Deretter brukte de flere angrepsmetoder for å få tilgang til svarene på ExploitGym testen hos Hugging Face, en plattform der utviklere deler og laster ned KI-modeller, datasett og verktøy for maskinlæring.

Hendelsen viser at avanserte agenter kan gjennomføre komplekse angrepskjeder. Dagens agenter er likevel ofte støyende og lite strategiske, noe som gjør dem lettere å oppdage.

Den største trusselen på kort sikt er trolig kompetente trusselaktører som bruker generativ KI som en kapasitetsforsterker. Teknologien kan hjelpe dem med å kartlegge angrepsflater, analysere sårbarheter og automatisere deler av et angrep.

En bølge med sikkerhetsoppdateringer

Den mest merkbare konsekvensen av utviklingen blir sannsynligvis ikke fullt autonome cyberangrep. Det vil først komme i form av en bølge med sikkerhetsoppdateringer.

Store programvareleverandører bruker allerede generativ KI til å analysere kildekode for å avdekke nye sårbarheter.  Microsofts MDASH-system benytter mer enn 100 spesialiserte agenter til å finne og validere sårbarheter. Anthropic opplyser at Mozilla fant og rettet 271 sårbarheter i Firefox under testing av en tidlig versjon Mythos.

Når leverandørene finner flere sårbarheter, må virksomhetene håndtere flere oppdateringer.

Når leverandørene finner flere sårbarheter, må virksomhetene håndtere flere oppdateringer. Sikkerhetsteamene må raskere avgjøre hvilke funn som representerer reell risiko, og hvilke systemer som bør prioriteres.

Samtidig er det viktig å beholde perspektivet. VulnCheck, som hjelper virksomheter med å forutsi og prioritere sikkerhetstrusler, skriver i sin årlige rapport at bare 14 av 1 061 sårbarheter knyttet til KI-assistert oppdagelse ble utnyttet i reelle angrep. Det tilsvarer omtrent 1,3 prosent og ligger nær den generelle utnyttelsesgraden.

Sårbarheter ser likevel ut til å bli utnyttet raskere. Virksomhetene får dermed kortere tid til å vurdere risiko før man må installere oppdateringer.

Den nye angrepsflaten finnes allerede internt

Risikoen kommer ikke bare fra eksterne angripere eller nye sårbarheter. Virksomheter tar i bruk agenter som Claude, Codex, GitHub Copilot og en rekke andre tjenester. Disse agentene har tilgang til kildekode, dokumenter og andre interne systemer.

Hver agent representerer en digital identitet med mulighet til å utføre handlinger. Virksomheten må derfor vite hvilke agenter som er i bruk, hvem som eier dem, hvilke data de kan behandle, og hvilke handlinger de kan utføre.

Arbeidet kan oppsummeres i tre områder:

  1. Oversikt: Etabler et register over agenter, eiere, formål og tilganger.

  2. Innsikt: Logg og overvåk agentenes dataflyt, verktøybruk og handlinger.

  3. Kontroll: Begrens tilganger, isoler kjøring av kode og krev godkjenning før handlinger med høy risiko.

Sitt rolig, men følg med

KI-agentene kommer, men det er ingen grunn til panikk. Virksomhetene bør fortsette å prioritere grunnleggende sikkerhet og samtidig etablere kontroll over agentene de tar i bruk.

Det er trygt å sitte rolig i båten, så lenge man vet hvem som har tilgang til roret, hva de kan gjøre, og hvordan handlingene deres overvåkes.