ARTFEED — Contemporary Art Intelligence

Il modello Qwen da 27 miliardi di parametri di Alibaba rivaleggia con GPT-5.6 Luna di OpenAI nei test benchmark

ai-technology · 2026-08-18

Venerdì scorso, Alibaba ha presentato il suo Qwen3.8-27B, forte di 27 miliardi di parametri, che, secondo Artificial Analysis, offre prestazioni pari a quelle di GPT-5.6 Luna di OpenAI. Lunedì, la società di benchmarking ha rilasciato i risultati dei test dimostrando che la qualità dell'output di Qwen3.8-27B corrisponde a quella di GPT-5.6 Luna, introdotto da OpenAI il mese precedente. Inoltre, Qwen3.8-27B ha superato GPT-5.6 Terra e Claude Opus 4.8 di Anthropic nell'Agentic Index, che valuta i flussi di lavoro degli agenti AI. Questi risultati suggeriscono che il modello di Alibaba regge bene il confronto con alternative open-source più grandi. Mettendo a disposizione i pesi del modello, Alibaba consente agli sviluppatori di validare i benchmark e integrare il modello, a differenza della strategia API restrittiva di OpenAI. Questo sviluppo avviene in un contesto di crescente competizione tra i laboratori di IA che privilegiano efficienza e trasparenza.

Fatti principali

  • Venerdì scorso Alibaba ha rilasciato i pesi del modello Qwen3.8-27B.
  • Lunedì Artificial Analysis ha pubblicato i risultati dei benchmark.
  • Qwen3.8-27B ha 27 miliardi di parametri.
  • Ha ottenuto prestazioni pari a quelle di GPT-5.6 Luna di OpenAI.
  • GPT-5.6 Luna è il modello più efficiente in termini di costi della famiglia GPT-5.6 di OpenAI.
  • OpenAI ha lanciato la famiglia GPT-5.6 il mese scorso.
  • Qwen3.8-27B ha superato GPT-5.6 Terra e Claude Opus 4.8 di Anthropic nell'Agentic Index.
  • Ha quasi eguagliato i modelli open-weight di DeepSeek e Zhipu.

Entità

Istituzioni

  • Alibaba
  • OpenAI
  • DeepSeek
  • Zhipu
  • Anthropic
  • Artificial Analysis

Luoghi

  • China
  • United States

Fonti