Microsoft innfører AI-forbud mot hacking og lureri
Av AIWatch
Microsoft har lansert et nytt sett med etiske retningslinjer for sine AI-modeller, som blant annet skal forhindre dem fra å utføre cyberangrep eller manipulere mennesker. Målet er å sikre at fremtidens superintelligente AI støtter, ikke erstatter, mennesket.
Microsoft har innført en ny «atferdskodeks» for sine AI-modeller, et internt regelverk som skal styre modellene bort fra farlig oppførsel. Dokumentet beskriver de verdiene og «røde linjene» som skal ligge til grunn for trening av selskapets AI, og er mer konkret enn generelle oppfordringer om å kontrollere utviklingstempoet. Reglene inkluderer «absolutte begrensninger» som forbyr AI-en å utføre cyberangrep, delta i produksjon av atomvåpen eller lage . I tillegg skal modellene ikke bruke adaptive, bedragerske eller selvforsterkende mekanismer for å unnslippe eller overstyre menneskelig kontroll, slik at de kan slås av eller modifiseres ved behov. Kodeksen understreker at superintelligente AI-systemer sannsynligvis vil overgå menneskelig ytelse i de fleste oppgaver i løpet av det neste tiåret. Den slår fast at modellene skal støtte mennesker fremfor å erstatte dem, og slik bidra til «menneskelig blomstring». Dette kommer i en tid med økt fokus på AI-sikkerhet, drevet av hendelser med «ulydige» AI-agenter og bekymringer for eksistensiell risiko.
Kilder til denne saken: TechCrunch AI ↗
AI: Research, språk og faktasjekk.
Relatert
Regulering26. sep.
USA krever forrang i testing av OpenAI- og Anthropic-modeller
Regulering25. sep.
Verdens AI-regulering splittes i risiko og ansvar
Regulering25. sep.
Toppsjefer vil bremse AI-utviklingen: Frykter ukontrollert vekst
Regulering25. sep.
Verden har fått et lappeteppe av AI-lover, EU er mest omfattende