Ovis-Embedding samler alle medier i én AI-modell
Av AIWatch
En ny AI-modell ved navn Ovis-Embedding lover å behandle tekst, bilde, video og lyd i en felles datarepresentasjon, og kan forenkle søk og analyse på tvers av medieformater.
Den nye Ovis-Embedding-modellen, beskrevet i en fersk forskningsrapport, samler ulike typer data – tekst, bilde, video og lyd – i en felles digital representasjon. Dette gjør at data fra forskjellige medier kan sammenlignes og søkes i like effektivt. Modellen skiller seg ut ved å bruke en felles kjerne for å forstå alle medietypene, i stedet for separate moduler for hver. Den oppnår nå toppresultater på anerkjente referansetester som MMEB-v3 og MAEB, noe som er et viktig skritt mot mer universelle AI-modeller for søk og analyse i bedriftsmiljøer.
Kilder til denne saken: arXiv cs.AI ↗
AI: Research, språk og faktasjekk.
Relatert