Sikkerhet31. juli 2026

Minneforgiftning truer AI-agenter: Ny benchmark avslører sårbarheter

Av redaksjonen

En ny studie viser at AI-agenter enkelt lagrer og utfører skadelige instruksjoner, med varierende evne til å reparere skaden.

Nye funn fra forskere ved MemSecBench avslører betydelige sikkerhetshull i minnesystemer. Skadelige instruksjoner, som kan implanteres av angripere, blir lagret i langtidshukommelsen og kan deretter påvirke agentens handlinger lenge etterpå. Studien kartlegger angrepets livssyklus, fra innføring av ondsinnet kode til dens konsekvenser og forsøk på reparasjon. Av 310 testtilfeller viste det seg at ondsinnet minne ble lagret i 84,2 % av tilfellene, og at den fullstendige angrepskjeden, hvor instruksjonen både ble lagret og utført, lyktes i 50,3 % av tilfellene. Forskjellen i angrepsresistens og evne til selektiv reparasjon, altså å fjerne kun den skadelige instruksjonen, varierte betydelig mellom ulike AI-konfigurasjoner. Dette indikerer at valget av agent-harnisk, og har stor innvirkning på sikkerheten.