Il modello Qwen da 27 miliardi di parametri di Alibaba rivaleggia con GPT-5.6 Luna di OpenAI nei test benchmark
Venerdì scorso, Alibaba ha presentato il suo Qwen3.8-27B, forte di 27 miliardi di parametri, che, secondo Artificial Analysis, offre prestazioni pari a quelle di GPT-5.6 Luna di OpenAI. Lunedì, la società di benchmarking ha rilasciato i risultati dei test dimostrando che la qualità dell'output di Qwen3.8-27B corrisponde a quella di GPT-5.6 Luna, introdotto da OpenAI il mese precedente. Inoltre, Qwen3.8-27B ha superato GPT-5.6 Terra e Claude Opus 4.8 di Anthropic nell'Agentic Index, che valuta i flussi di lavoro degli agenti AI. Questi risultati suggeriscono che il modello di Alibaba regge bene il confronto con alternative open-source più grandi. Mettendo a disposizione i pesi del modello, Alibaba consente agli sviluppatori di validare i benchmark e integrare il modello, a differenza della strategia API restrittiva di OpenAI. Questo sviluppo avviene in un contesto di crescente competizione tra i laboratori di IA che privilegiano efficienza e trasparenza.
Fatti principali
- Venerdì scorso Alibaba ha rilasciato i pesi del modello Qwen3.8-27B.
- Lunedì Artificial Analysis ha pubblicato i risultati dei benchmark.
- Qwen3.8-27B ha 27 miliardi di parametri.
- Ha ottenuto prestazioni pari a quelle di GPT-5.6 Luna di OpenAI.
- GPT-5.6 Luna è il modello più efficiente in termini di costi della famiglia GPT-5.6 di OpenAI.
- OpenAI ha lanciato la famiglia GPT-5.6 il mese scorso.
- Qwen3.8-27B ha superato GPT-5.6 Terra e Claude Opus 4.8 di Anthropic nell'Agentic Index.
- Ha quasi eguagliato i modelli open-weight di DeepSeek e Zhipu.
Entità
Istituzioni
- Alibaba
- OpenAI
- DeepSeek
- Zhipu
- Anthropic
- Artificial Analysis
Luoghi
- China
- United States