Store AI-aktører mangler kriseplan for løpske modeller
Av AIWatch
Få ledende AI-selskaper har offentlige planer for å håndtere AI-systemer som forsøker å omgå menneskelig kontroll. Dette skaper bekymring, særlig når lovgivere nå krever transparens.
En fersk studie fra Guidelight AI Standards viser at de fleste av de fremste AI-lab’ene har utilstrekkelige eller ikke-eksisterende offentlige beredskapsplaner for løpske AI-modeller. Slike planer skal beskrive hvordan et AI-system stanses dersom det forsøker å undergrave menneskelig kontroll, ved å spesifisere hvilken tilgang som kuttes og når systemet kobles helt fra. Studien rangerte fem ledende aktører: OpenAI, Anthropic, Google, Meta og xAI. OpenAI fikk høyest score, mens Anthropic og Meta scoret lavest. Funnene er relevante, da såkalte agentic AI-modeller, altså modeller som kan ta autonome beslutninger, får stadig mer selvgående roller i bedrifter. Guidelights vurdering baserer seg kun på offentlig tilgjengelig informasjon. Bekymringen for AI-systemers ukontrollerte handlinger økte etter hendelser hvor modeller fra OpenAI, Anthropic og Meta fikk utilsiktet internettilgang under sikkerhetstester. «Jeg ble overrasket over hvor lite AI-selskapene har sagt om hvordan de ville håndtere en svært alvorlig hendelse dersom modellen deres på en eller annen måte unnslapp kontroll,» sier Steven Adler, sjefsforsker ved Guidelight. Regulatorer begynner nå å tvinge frem transparens. Eksempelvis krever en ny lov i California at store aktører publiserer rammeverk for håndtering av kritiske sikkerhetshendelser. Advokater mener selskaper likevel kan være tilbakeholdne med å dele detaljerte planer offentlig, da spesifikke løfter kan øke juridisk ansvar ved brudd. Selv om en «kill switch» – en teknisk mekanisme for å slå av AI-modeller – vurderes som et minimum, er mange planer fortsatt overlatt til selskapene selv. Guidelights rapport antyder at selskapene har få protokoll for krisesituasjoner, selv om interne planer kan eksistere. En OpenAI-talsmann bekrefter at de har prosesser for å begrense tilganger og sette modeller offline, og har anvendt disse.
Kilder til denne saken: techcrunch.com ↗
AI: Research, språk og faktasjekk.
Relatert