Il modello vocale AI di Alibaba entra nella top 5 globale, supera i rivali statunitensi negli accenti regionali
Il nuovo modello vocale AI di Alibaba Group Holding è entrato tra i primi cinque a livello globale nel benchmark Speech Arena, superando i rivali occidentali OpenAI e xAI. Il modello supporta oltre 30 lingue, sette principali dialetti cinesi e più di 20 accenti regionali. La Speech Arena, gestita da Artificial Analysis con sede a San Francisco e sostenuta da Nat Friedman e Andrew Ng, classifica i modelli tramite valutazioni utente anonime di clip vocali utilizzando un sistema Elo. Gli utenti valutano tre capacità fondamentali: riconoscimento vocale, comprensione e conversazione vocale end-to-end, e sintesi vocale. In un indice separato di Word Error Rate di Artificial Analysis, il modello Fun-Realtime-ASR di Alibaba si è classificato primo con un tasso di errore dell'1,8%, il che significa che meno di due parole su 100 sono state trascritte in modo errato. Alibaba possiede il South China Morning Post.
Fatti principali
- Il modello vocale AI di Alibaba è entrato nella top 5 globale nel benchmark Speech Arena.
- Ha superato i rivali occidentali OpenAI e xAI.
- Supporta oltre 30 lingue, sette dialetti cinesi e oltre 20 accenti regionali.
- La Speech Arena è gestita da Artificial Analysis, sostenuta da Nat Friedman e Andrew Ng.
- Il benchmark utilizza valutazioni utente anonime di clip vocali con classificazione basata su Elo.
- Valuta le capacità di riconoscimento vocale, comprensione vocale e sintesi vocale.
- Il modello Fun-Realtime-ASR di Alibaba si è classificato primo nell'indice Word Error Rate con l'1,8%.
- Alibaba possiede il South China Morning Post.
Entità
Istituzioni
- Alibaba Group Holding
- OpenAI
- xAI
- Artificial Analysis
- South China Morning Post
Luoghi
- San Francisco
- United States
- Beijing
- China