MiLMMT-46-v1.0: Il Post-Addestramento Senza Riferimenti Migliora la Traduzione Multilingue
I ricercatori hanno lanciato MiLMMT-46-v1.0, un grande modello linguistico progettato specificamente per la traduzione automatica multilingue. Questo nuovo modello supera sistemi affermati come Google Translate, Gemini 3 Pro e GPT-5 sulla base di metriche di qualità senza riferimenti. Si basa sulla versione precedente, MiLMMT-46-v0.1, impiegando l'ottimizzazione delle politiche con relative group (GRPO), che combina i premi di due modelli di stima della qualità, filtrati per lingua. La versione finale del modello integra checkpoint SFT e RL attraverso l'interpolazione lineare. Mostra una qualità di traduzione migliorata in 46 lingue rispetto ai modelli precedenti e supera recenti benchmark come Seed-X, HY-MT2 e TranslateGemma. Inoltre, la ricerca indaga la distillazione on-policy (OPD), che eguaglia ma non supera la qualità ottenuta con RL. Questo lavoro è disponibile nell'articolo arXiv 2608.10812.
Fatti principali
- MiLMMT-46-v1.0 è un grande modello linguistico aperto per la traduzione multilingue.
- Utilizza un post-addestramento senza riferimenti con GRPO.
- Il premio è la media di due modelli di stima della qualità senza riferimenti ed è filtrato dall'identificazione della lingua.
- Il modello è creato interpolando linearmente i checkpoint SFT e RL.
- Migliora la qualità della traduzione in 46 lingue rispetto ai modelli SFT.
- Supera Seed-X, HY-MT2 e TranslateGemma.
- Raggiunge punteggi leader senza riferimenti contro Google Translate, Gemini 3 Pro e GPT-5.
- La distillazione on-policy raggiunge ma non supera la frontiera della qualità RL.
Entità
Istituzioni
- arXiv
- Google Translate
- Gemini 3 Pro
- GPT-5
- Seed-X
- HY-MT2
- TranslateGemma