AI overvurderer straff og mangler sosial forståelse
Av AIWatch
Store språkmodeller tolker sosiale normbrudd mye strengere enn mennesker, viser ny forskning. Dette kan gi feilvurderinger i AI-systemer som skal megle konflikter eller simulere politikk.
Nye studier avdekker at dagens AI-modeller overdriver reaksjonene på sosiale , og feilvurderer hvor mennesker ville vist toleranse eller tilbakeholdenhet. Modellene, inkludert seks ulike språkmodeller, forutser langt oftere negative sanksjoner – som for eksempel offentlig skam – der mennesker forventer ingen reaksjon. Dette tyder på at kunstig intelligens mangler det forskerne kaller «», altså forventninger om hvem som håndhever regler og hvordan. Dette gjør at AI-systemer kan tegne et forvrengt bilde av sosial regulering, spesielt når den sosiale avstanden øker. Forskere ved NormReact-prosjektet har testet dette med 450 scenarioer som inkluderer brudd på sosiale regler, og funnet at modellene overrapporterer straff og underrapporterer toleranse. Dette er kritisk for norske arbeidsplasser som vurderer å bruke AI i konfliktløsning, HR-systemer eller politikkutforming. En AI som alltid forventer harde reaksjoner kan eskalere situasjoner i stedet for å deeskalere, og misforstå nyansene i mellomenneskelige relasjoner. Feilvurderingene betyr at utviklere må trene modellene bedre på kontekst og sosiale forventninger, utover bare hva som er rett og galt.
Kilder til denne saken: arXiv cs.AI ↗
AI: Research, språk og faktasjekk.
Relatert