Store AI-selskaper skiller seg ut med sikkerhetsrammeverk
Av AIWatch
Regulatoriske krav tvinger de største utviklerne av kunstig intelligens til å publisere egne sikkerhetsrammeverk, men innholdet varierer stort mellom aktørene.
California og EUs AI-forordning definerer en egen kategori for «» – de ledende utviklerne av de kraftigste AI-modellene, som OpenAI og Google DeepMind. Disse må nå forholde seg til særskilte plikter, som å offentliggjøre og rapportere kritiske sikkerhetshendelser. Dette betyr konkret at selskaper som Meta, Anthropic, OpenAI og Google DeepMind alle har publisert sine egne, ofte frivillige, retningslinjer for hvordan de vil håndtere risikofylte AI-modeller. De må beskrive hvordan de identifiserer farlige egenskaper, tester modellene og iverksetter sikkerhetstiltak før modellene tas i bruk. Eksempelvis definerer Anthropics Responsible Scaling Policy (RSP) spesifikke AI Safety Levels og nødvendige beskyttelsestiltak knyttet til dem, mens OpenAI bruker sitt Preparedness Framework. Felles for rammeverkene er mekanismen der selskaper definerer terskelverdier for modellens kapabiliteter, utfører evalueringer og forplikter seg til sikkerhetstiltak før disse tersklene overskrides. Dette kan ha direkte konsekvenser for norske virksomheter som vurderer å ta i bruk slike AI-tjenester; de får nå et tydeligere innblikk i leverandørens risikohåndtering, noe som forenkler risikovurderinger og intern AI-styring. xAI skiller seg ut ved at deres Risk Management Framework fortsatt er i utkastform, og har fått kritikk av tredjeparter for manglende rigor, blant annet av Future of Life Institute. Meta har nylig oppdatert sitt rammeverk, Advanced AI Scaling Framework (v2), som nå inkluderer tap av kontroll som et nytt risikoområde, i tillegg til cybersikkerhet og kjemiske/biologiske trusler. Dette viser en utvikling mot bredere risikodekning. Selv om rammeverkene er selvpubliserte, er kravet om å ha og offentliggjøre et slikt rammeverk en lovfestet plikt under reguleringer som EUs AI-forordning, med mål om å øke transparensen og ansvaret i AI-utviklingen.
Kilder til denne saken: casrai.org ↗
AI: Research, språk og faktasjekk.
Relatert
Regulering28. sep.
AI-verktøy i arbeidslivet krever strengere kontroll mot diskriminering
Regulering28. sep.
AI-assistent booket gymtimer og slettet andres plasser
Regulering28. sep.
AIPolicyTracker sporer AI-regelverk i 212 jurisdiksjoner
Regulering28. sep.
Domstol tillater svartelisting av Anthropic uten bevis for «onde hensikter»