Produkt2. september 2026

Gradium TTS knuser konkurrenter på «vanskelige» tall, leverer lyd på 216 ms

Av AIWatch

Digitalt bakgrunn med binærkode, en global kartoverlay og lysende søyler som symboliserer dataflyt og teknologi.
Kategoribilde Foto: Getty Images, Unsplash

Nye tekst-til-tale-modeller sliter ofte med tall og spesialtegn. Nå viser Gradium AIs nye TTS-modell en treffprosent på 81 % på slike utfordringer, og setter en ny standard for nøyaktighet og responstid.

Gradium AI lanserer en ny modell som er overlegen konkurrentene på kritiske detaljer. Modellen oppnår en nøyaktighet på 81 prosent på en test med 500 «vanskelige» setninger som inkluderer ordrenummer, e-postadresser og telefonnumre – tall som ofte feilleses av stemmeassistenter. Resultatet plasserer Gradiums modell betydelig foran Cartesia Sonic 3.6 (75,1 %) og ElevenLabs v3 Conversational (65,4 %) i den menneskebaserte evalueringen. Samtidig leverer modellen første lyd på bare 216 millisekunder, og er 170 ms raskere enn forgjengeren. Denne hastigheten er avgjørende for sømløse samtaler i kundeservice og agentløsninger. Gradium har gjort modellen til standard i sin og Studio, og eksisterende brukere trenger ingen migrering. For å sikre transparens er testsettet på 500 setninger åpent tilgjengelig på , noe som tillater uavhengig verifisering av resultatene.

Kilder til denne saken: MarkTechPost ↗

AI: Research, språk og faktasjekk.

Relatert

Annonse

Reklame for nyhetsbrev og podkast fra AIWatch.no