Siste notiser
10Foto: Boliviainteligente, Unsplash Arbeidsliv28. juli
Fremtidens AI: Ny definisjon av «AI-native»
Forskere foreslår en teknisk definisjon for AI-native systemer, basert på kunstig intelligens' evne til autonomt å revidere egen kode. Dette skiller markedsføringsbegrepet fra faktiske systemendringer.
Forskning28. juli
AgentRCA: Nytt AI-rammeverk for feilsøking i industrien
Forskere har utviklet AgentRCA, et nytt AI-rammeverk som kan identifisere årsaker til avvik i industrianlegg uten behov for store mengder treningsdata. Dette kan effektivisere feilsøking betydelig.
Forskning28. juli
LLM-hallusinasjoner kan vise ideologisk slagside i politisk svar
Ny forskning indikerer at store språkmodeller (LLM-er) som svarer på politiske spørsmål kan generere feilinformasjon med en tendens mot venstresiden, selv når kildematerialet er fra ulike ideologiske retninger.
Produkt28. juli
Ny autonome AI-agent «Manus» presentert
En ny AI-agent kalt Manus AI lover å bygge bro mellom avansert resonnement og praktisk utførelse, noe som kan endre måten kunstig intelligens samhandler med den virkelige verden.
Sikkerhet28. juli
Text-to-SQL-systemer utfordres av rollebasert tilgangskontroll
Ny forskning viser at dagens benchmark for Text-to-SQL ikke fanger opp hvordan systemene presterer under realistiske tilgangsbegrensninger, noe som kan føre til feilvurderinger av teknologiens anvendbarhet.
Næringsliv28. juli
Store språkmodeller sliter med avansert SQL-feilretting
Ny forskning viser betydelige begrensninger i store språkmodellers evne til å feilrette sammensatt SQL-kode, noe som har direkte implikasjoner for dataarkitektur i bedrifter.
Forskning28. juli
Forskning viser "regresjonsskatt" ved tilføring av ferdigheter til LLM-agenter
Nye funn indikerer at tilføring av ferdigheter til store språkmodeller (LLM) ikke alltid fører til forbedring, men kan faktisk forringe ytelsen på enkelte oppgaver. Dette har betydning for utviklingen av mer robuste AI-systemer.
Regulering28. juli
Evaluering av AI-aktens krav og LLM-støtte
Ny forskning utforsker hvordan EU AI-aktens krav implementeres i kravspesifikasjon, og potensiell rolle for storskala språkmodeller. Studien peker på mangler i dagens praksis og ser muligheter for maskinstøtte.
Produkt28. juli
TRACE-Router optimaliserer valg av språkmodeller for agentbaserte systemer
Ny forskning presenterer en metode for å forbedre ytelsen for AI-agenter ved å velge riktig stor språkmodell (LLM) basert på oppgavenivå, snarere enn individuelle kall.
Forskning28. juli
Større språkmodeller forsterker feil raskere
Ny forskning fra Google AI indikerer at større og mer komplekse språkmodeller genererer feil raskere enn mindre modeller, noe som utfordrer antagelsen om lineær forbedring av pålitelighet med skala.