AIwatch — utgave

Uke 31

29. juli 2026

Les om politisk bias i LLM-er, hvordan større språkmodeller forsterker feil og mye annet.

Podkastversjonca. 20 min 29 sekAbonner
  1. 01
    Keyboard with AI button
    Foto: Boliviainteligente, Unsplash
    Forskning

    AgentRCA: Nytt AI-rammeverk for feilsøking i industrien

    Forskere har utviklet AgentRCA, et nytt AI-rammeverk som kan identifisere årsaker til avvik i industrianlegg uten behov for store mengder treningsdata. Dette kan effektivisere feilsøking betydelig.

    Les hele notisen →
  2. 02
    Arbeidsliv

    Fremtidens AI: Ny definisjon av «AI-native»

    Forskere foreslår en teknisk definisjon for AI-native systemer, basert på kunstig intelligens' evne til autonomt å revidere egen kode. Dette skiller markedsføringsbegrepet fra faktiske systemendringer.

    Les hele notisen →
  3. 03
    Forskning

    LLM-hallusinasjoner kan vise ideologisk slagside i politisk svar

    Ny forskning indikerer at store språkmodeller (LLM-er) som svarer på politiske spørsmål kan generere feilinformasjon med en tendens mot venstresiden, selv når kildematerialet er fra ulike ideologiske retninger.

    Les hele notisen →
  4. 04
    Produkt

    Ny autonome AI-agent «Manus» presentert

    En ny AI-agent kalt Manus AI lover å bygge bro mellom avansert resonnement og praktisk utførelse, noe som kan endre måten kunstig intelligens samhandler med den virkelige verden.

    Les hele notisen →
  5. 05
    Sikkerhet

    Text-to-SQL-systemer utfordres av rollebasert tilgangskontroll

    Ny forskning viser at dagens benchmark for Text-to-SQL ikke fanger opp hvordan systemene presterer under realistiske tilgangsbegrensninger, noe som kan føre til feilvurderinger av teknologiens anvendbarhet.

    Les hele notisen →
  6. 06
    Næringsliv

    Store språkmodeller sliter med avansert SQL-feilretting

    Ny forskning viser betydelige begrensninger i store språkmodellers evne til å feilrette sammensatt SQL-kode, noe som har direkte implikasjoner for dataarkitektur i bedrifter.

    Les hele notisen →
  7. 07
    Regulering

    Evaluering av AI-aktens krav og LLM-støtte

    Ny forskning utforsker hvordan EU AI-aktens krav implementeres i kravspesifikasjon, og potensiell rolle for storskala språkmodeller. Studien peker på mangler i dagens praksis og ser muligheter for maskinstøtte.

    Les hele notisen →
  8. 08
    Forskning

    Forskning viser "regresjonsskatt" ved tilføring av ferdigheter til LLM-agenter

    Nye funn indikerer at tilføring av ferdigheter til store språkmodeller (LLM) ikke alltid fører til forbedring, men kan faktisk forringe ytelsen på enkelte oppgaver. Dette har betydning for utviklingen av mer robuste AI-systemer.

    Les hele notisen →
  9. 09
    Produkt

    TRACE-Router optimaliserer valg av språkmodeller for agentbaserte systemer

    Ny forskning presenterer en metode for å forbedre ytelsen for AI-agenter ved å velge riktig stor språkmodell (LLM) basert på oppgavenivå, snarere enn individuelle kall.

    Les hele notisen →
  10. 10
    Forskning

    Større språkmodeller forsterker feil raskere

    Ny forskning fra Google AI indikerer at større og mer komplekse språkmodeller genererer feil raskere enn mindre modeller, noe som utfordrer antagelsen om lineær forbedring av pålitelighet med skala.

    Les hele notisen →