Sikkerhet31. juli 2026

Ny kontroll over AI-agenters verktøybruk

Av redaksjonen

Forskere har utviklet et system som begrenser AI-agenters tilgang til verktøy, og reduserer risikoen for uønskede handlinger selv med brede tillatelser.

Kunstig intelligens (AI)-agenter får ofte vide tillatelser til å bruke verktøy, selv når de kun trenger tilgang til en snever funksjon for å utføre en spesifikk oppgave. Dette utgjør en sikkerhetsrisiko, da en kompromittert potensielt kan misbruke disse overflødige rettighetene. Forskere har nå introdusert Intent-Governed Access Control (IGAC), et på serversiden som adresserer dette problemet. IGAC reduserer dynamisk AI-agentens tilgang til verktøy, slik at den kun får utføre handlinger som er direkte relevante for brukerens forespørsel. Systemet oversetter en godkjent forespørsel til et kortvarig , som deretter snevrer inn agentens liste over tilgjengelige verktøy og sjekker effekten av potensielle handlinger før de blir utført. Dette betyr at en AI-agent med tilgang til mange systemer (gitt via integrasjonslegitimasjon) kun får mulighet til å bruke de spesifikke funksjonene som kreves der og da. IGAC kan ikke gi en AI-agent flere rettigheter enn det som er definert i dens statiske politikk, altså dens forhåndsdefinerte sikkerhetsgrenser. Den ekstra sikkerheten avhenger av hvor nøyaktig intensjonssertifikatet er, og hvor godt systemet klarer å estimere handlingenes konsekvenser. Testene, som inkluderte 176 syntetiske oppgaver og 306 ende-til-ende simuleringer, viste at IGAC uten et referansesertifikat reduserte en komposittindikator for eksponering fra 1.0000 til 0. I faktiske modellkjøringer med IGAC-OpenPort-løsningen ble ingen usikre handlinger fullført. Residuelle tilfeller av usikker autoritet, hvor agenter ble gitt mer autoritet enn nødvendig uten å utføre usikre handlinger, ble identifisert, men disse ble aldri utført. På tross av de lovende resultatene, peker forskerne på presisjonen i intensjonssertifikatet som den største gjenværende flaskehalsen. Dette betyr at systemets evne til å tolke og begrense AI-ens intensjoner så nøyaktig som mulig, er avgjørende for maksimal sikkerhet.