Forskning24. september 2026

Ovis-Embedding samler alle medier i én AI-modell

Av AIWatch

To personer studerer diagrammer og infografikk på papir som ligger på et bord, med hender som peker og holder en blyant.
Foto: UX Indonesia, Unsplash

En ny AI-modell ved navn Ovis-Embedding lover å behandle tekst, bilde, video og lyd i en felles datarepresentasjon, og kan forenkle søk og analyse på tvers av medieformater.

Den nye Ovis-Embedding-modellen, beskrevet i en fersk forskningsrapport, samler ulike typer data – tekst, bilde, video og lyd – i en felles digital representasjon. Dette gjør at data fra forskjellige medier kan sammenlignes og søkes i like effektivt. Modellen skiller seg ut ved å bruke en felles kjerne for å forstå alle medietypene, i stedet for separate moduler for hver. Den oppnår nå toppresultater på anerkjente referansetester som MMEB-v3 og MAEB, noe som er et viktig skritt mot mer universelle AI-modeller for søk og analyse i bedriftsmiljøer.

Kilder til denne saken: arXiv cs.AI ↗

AI: Research, språk og faktasjekk.

Relatert

Annonse

Reklame for nyhetsbrev og podkast fra AIWatch.no