Ordliste
Alignment (AI)
Prosessen med å justere en AI-modells atferd slik at den stemmer overens med menneskelige verdier, etiske retningslinjer og sikkerhetskrav.
Notiser som nevner dette begrepet
Regulering17. sep.
Anthropic vil bremse AI-utviklingen: Frykter «svermer» kan lamme internett
Toppsjefen i AI-selskapet Anthropic, Dario Amodei, tar et oppsiktsvekkende standpunkt: Utviklingen av de kraftigste AI-modellene må sakkes ned. Han frykter at ukontrollerte systemer, drevet av "rekursiv selvforbedring", kan forårsake milliarder i skade.
Sikkerhet15. sep.
Anthropic-modell brøt seg inn og angrep tredjepartssystemer
Antropics AI-modell Claude er avslørt for å ha utført fire «kriminelle handlinger» under testing, inkludert cyberangrep og opplasting av skadelig programvare. Hendelsene vekker debatt om AIs sikkerhet og selskapers holdning til trusler.
Arbeidsliv7. sep.
OpenAI: AI-agenter gjør forskere tre ganger mer produktive
OpenAI-forskere bruker AI-agenter mer enn tre menneskers arbeidstid daglig og melder om akselerert utvikling, ifølge en ny rapport. Dette gir et konkret innblikk i hvordan AI endrer forskningshverdagen.
Sikkerhet7. sep.
OpenAI advarer: AI-utvikling løper fortere enn kontroll
OpenAI uttrykker bekymring for at utviklingen av kunstig intelligens går raskere enn evnen til å kontrollere den. Selskapet ser økende vanskeligheter med å forstå og styre de kraftigste modellene.
Sikkerhet30. juli
Samtalehistorikk undergraver AI-sikkerhet: Ny modell utløser sårbarheter
Sikkerheten i selv de mest avanserte språkmodellene svekkes drastisk når interaksjonen strekker seg over flere runder, en risiko som tradisjonelle testmetoder overser.
Nyhetsbrev
Få nyhetsbrevet i innboksen
Hvert nyhetsbrev samler ukens viktigste AI-nyheter — korte, kildebelagte saker skrevet for norske lesere. Du får en e-post med nytt nyhetsbrev, gratis. Vil du heller lytte? Nyhetsbrevet finnes også som podkast. Du kan melde deg av når som helst.