Claude får usynlig vannmerke for å avsløre AI-tekst
Av AIWatch
Anthropic legger et diskret, statistisk vannmerke i tekst fra Claude. Grepet, som svarer på EU-krav, hjelper til å identifisere AI-generert innhold uten å endre kvaliteten.
Anthropic, selskapet bak chatbotten Claude, implementerer nå et usynlig vannmerke i all tekst generert av fremtidige Claude-modeller. Dette skal hjelpe med å identifisere innhold skapt av kunstig intelligens, et tiltak som svarer på nye EU-regler. Vannmerket utnytter de mange små beslutningene tar under tekstgenerering. I stedet for å velge vilkårlig, baserer Claude valgene på en og den foregående teksten. Resultatet er et statistisk mønster som er usynlig for mennesker, men som kan avdekkes av dem med riktig nøkkel for å estimere sannsynligheten for at Claude har skrevet teksten. Anthropic forsikrer at vannmerket ikke forringer tekstkvaliteten, kreativiteten, nøyaktigheten eller lesbarheten. Tester viser heller ingen nedgang i brukertilfredshet eller økt kostnad eller treghet i modellens drift. Begrensningene ligger i svært korte passasjer og tekster med lite rom for variasjon, som fakta eller kode. Kraftig omskriving kan også fjerne vannmerket helt, men det kan da spørres om teksten fortsatt er AI-generert i vesentlig grad. Selskapet understreker at vannmerket kun indikerer sannsynligheten for Claude-involvering, ikke identifiserer brukere eller etablerer eierskap. Det skiller seg fra andre AI-deteksjonsverktøy ved å sjekke et innebygd signal fremfor stilistiske mønstre. Utrullingen er global og vil snart inkludere en API for offentlig sjekk, da det foreløpig ikke er teknisk mulig å begrense funksjonen til kun EU-området.
Kilder til denne saken: google.com ↗
AI: Research, språk og faktasjekk.
Relatert