ARTFEED — Contemporary Art Intelligence

Il modello vocale AI di Alibaba entra nella top 5 globale, supera i rivali statunitensi negli accenti regionali

ai-technology · 2026-05-29

Il nuovo modello vocale AI di Alibaba Group Holding è entrato tra i primi cinque a livello globale nel benchmark Speech Arena, superando i rivali occidentali OpenAI e xAI. Il modello supporta oltre 30 lingue, sette principali dialetti cinesi e più di 20 accenti regionali. La Speech Arena, gestita da Artificial Analysis con sede a San Francisco e sostenuta da Nat Friedman e Andrew Ng, classifica i modelli tramite valutazioni utente anonime di clip vocali utilizzando un sistema Elo. Gli utenti valutano tre capacità fondamentali: riconoscimento vocale, comprensione e conversazione vocale end-to-end, e sintesi vocale. In un indice separato di Word Error Rate di Artificial Analysis, il modello Fun-Realtime-ASR di Alibaba si è classificato primo con un tasso di errore dell'1,8%, il che significa che meno di due parole su 100 sono state trascritte in modo errato. Alibaba possiede il South China Morning Post.

Fatti principali

  • Il modello vocale AI di Alibaba è entrato nella top 5 globale nel benchmark Speech Arena.
  • Ha superato i rivali occidentali OpenAI e xAI.
  • Supporta oltre 30 lingue, sette dialetti cinesi e oltre 20 accenti regionali.
  • La Speech Arena è gestita da Artificial Analysis, sostenuta da Nat Friedman e Andrew Ng.
  • Il benchmark utilizza valutazioni utente anonime di clip vocali con classificazione basata su Elo.
  • Valuta le capacità di riconoscimento vocale, comprensione vocale e sintesi vocale.
  • Il modello Fun-Realtime-ASR di Alibaba si è classificato primo nell'indice Word Error Rate con l'1,8%.
  • Alibaba possiede il South China Morning Post.

Entità

Istituzioni

  • Alibaba Group Holding
  • OpenAI
  • xAI
  • Artificial Analysis
  • South China Morning Post

Luoghi

  • San Francisco
  • United States
  • Beijing
  • China

Fonti