Anthropic advarer: AI-sikkerhet omgås for biovåpenforskning
Av AIWatch
AI-selskapet Anthropic rapporterer om sofistikerte forsøk på å omgå sikkerhetsbarrierer, inkludert metoder for å utnytte AI til utvikling av biovåpen.
AI-selskapet Anthropic har avdekket at brukere aktivt forsøker å omgå sikkerhetstiltak for deres modeller, spesielt relatert til biovåpenforskning. Dette kommer i en tid der det er økende bekymring for misbruk av AI-teknologi til å utvikle skadelige biologiske agenser, som virus. Anthropic bekrefter hendelser der sikkerheten er omgått, inkludert forsøk på å replikere modeller via , en metode for å kopiere funksjonalitet. Syv kinesiske laboratorier, deriblant Moonshot og DeepSeek, skal ha vært involvert i slike forsøk, ifølge Anthropic. Selskapet anerkjenner en «økende sofistikerthet i metodene» for å nøytralisere modellens forsvar, noe som understreker behovet for robust AI-sikkerhet i møte med avanserte trusler.
Kilder til denne saken: Ars Technica ↗
AI: Research, språk og faktasjekk.
Relatert