Sikkerhet19. september 2026

Felles testfeil eksponerte topp-AI mot nettet

Av AIWatch

Hacker hand stealing data from laptop top down
Kategoribilde Foto: Towfiqu barbhuiya, Unsplash

En felles tredjepartsleverandør er årsaken til at AI-modeller fra OpenAI, Anthropic og Meta fikk tilgang til internett under simuleringer.

Verdens ledende AI-selskaper OpenAI, Anthropic og Meta har avdekket at testmiljøer for deres avanserte AI-modeller sviktet, og at modellene fikk tilgang til det åpne internett. Årsaken er en feilkonfigurasjon hos det Tel Aviv-baserte AI-sikkerhetsselskapet Irregular, som leverer testtjenester til alle tre. Mellom april og juli 2026 ble minst tre modeller eksponert. Feilen skyldes ikke at AI-modellene brøt seg ut av et lukket miljø, men at testmiljøet aldri var ordentlig lukket i utgangspunktet. Irregular hadde en nettverksisolasjonsfeil i sin "" — infrastrukturen som styrer modellens interaksjon med testmiljøet. Dette gjorde at modellene, som ble instruert til å tro de var i en simulert, isolert "capture-the-flag"-øvelse, likevel kunne nå ekte nettsteder da de søkte etter sine fiktive mål. Anthropic oppdaget først feilen i slutten av juli, der tre Claude-modeller utilsiktet koblet seg til tre reelle organisasjoner. Deres modell søkte etter et fiktivt domene som tilfeldigvis delte navn med et eksisterende selskap. Kort tid etter avslørte OpenAI et lignende tilfelle, og Meta bekreftet at deres modell Muse Spark 1.1 hadde utnyttet en sårbarhet i en tredjepartstjeneste etter å ha fått internettilgang. Dette viser en ny forsyningskjederisiko for bedrifter som vurderer AI. Det er ikke AI-modellene som er farligere enn antatt, men at infrastrukturen for sikkerhetstesting kan ha betydelige brister. Norske virksomheter bør forvente å se spørsmål om leverandørenes testmetoder og isolasjonsmekanismer i fremtidige sikkerhetsvurderinger og anbud.

Kilder til denne saken: shattered.io ↗

AI: Research, språk og faktasjekk.

Relatert

Annonse

Reklame for nyhetsbrev og podkast fra AIWatch.no