Il modello Hy4 di Tencent sale nella classifica dell'IA open-source grazie all'addestramento tramite ecosistema
Tencent Holdings ha compiuto progressi significativi con il suo modello preview Hy4, ottenendo un punteggio di 64,3 sul benchmark DeepSWE, superando Alibaba's Qwen-3.8 Max (56,6) e DeepSeek-V4 Pro (62,7). Rilasciato venerdì, Hy4 ha conquistato l'ottava posizione globale nella classifica WebDev di Code Arena, dietro Anthropic's Claude Fable 5 e davanti a Alibaba's Qwen 3.8-Flash-Next al nono posto. Questo rappresenta un notevole balzo in avanti rispetto al precedente modello di Tencent, Hy3, che era classificato al 34° posto. Gli analisti, tra cui Ronald Keung di Goldman Sachs, hanno notato che il successo di Hy4 deriva dalla strategia unica di Tencent 'prodotto più modello', che sfrutta i dati degli utenti del suo vasto ecosistema per un addestramento continuo, migliorando particolarmente le attività di produttività e codifica nel panorama in evoluzione dell'IA agentica.
Fatti principali
- Il modello preview Hy4 ha ottenuto un punteggio di 64,3 sul benchmark DeepSWE, superando Alibaba's Qwen-3.8 Max (56,6) e DeepSeek-V4 Pro (62,7).
- Il modello preview Hy4 si è classificato ottavo a livello globale nella classifica WebDev di Code Arena, dietro Anthropic's Claude Fable 5 e davanti a Alibaba's Qwen 3.8-Flash-Next.
- Il precedente modello di Tencent, Hy3, era classificato al 34° posto nello stesso benchmark.
- Il modello preview Hy4 è stato rilasciato venerdì.
- Tencent utilizza il suo ecosistema di prodotti per addestrare i modelli, raccogliendo dati degli utenti per un addestramento iterativo.
- Gli analisti di Goldman Sachs guidati da Ronald Keung hanno commentato la strategia.
- Il modello preview Hy4 riporta la serie Hunyuan di Tencent nella fascia alta dei modelli open-source.
- Notevoli miglioramenti nelle capacità di codifica rispetto a Hy3.
Entità
Istituzioni
- Tencent Holdings
- Alibaba Group Holding
- DeepSeek
- Goldman Sachs
- Anthropic
- Code Arena