ARTFEED — Contemporary Art Intelligence

Stato dei modelli aperti: Osservazioni dell'estate 2026

ai-technology · 2026-08-14

Il rapporto estivo 2026 dell'Hugging Face Hub rivela un panorama in evoluzione nell'IA open-source. I laboratori cinesi ora dominano i rilasci all'avanguardia, con modelli che vanno da 754B a 2,78 trilioni di parametri, mentre i laboratori americani restano indietro, con l'NVIDIA Nemotron 3 Ultra (561B) come notevole eccezione. I produttori di hardware come AMD e NVIDIA sono diventati i pubblicatori più prolifici di modelli aperti, usandoli per vendere chip. Qwen è emerso come modello base della comunità, con 151.448 derivati, 2,6 volte l'impronta di Meta. I modelli piccoli sotto 1 miliardo di parametri rappresentano l'83% dei download di tutti i tempi, mentre i modelli da trilione di parametri raggiungono gli utenti tramite llama.cpp, che ora supporta build GGUF di modelli come Kimi-K3 a 2,8 trilioni di parametri. Il rapporto introduce un nuovo dataset sull'uso degli agenti, mostrando che agenti di codifica come Claude Code e Codex stanno diventando importanti utenti dell'Hub, con Claude Code che detiene il 44,4% del traffico degli agenti a luglio. In particolare, la prima intrusione documentata di un agente autonomo è avvenuta sull'infrastruttura stessa di Hugging Face, e l'analisi è stata completata utilizzando un modello aperto quantizzato (GLM-5.2) dopo che i modelli chiusi hanno rifiutato. Il rapporto conclude che l'IA open-source si sta spostando dai laboratori di modelli alle aziende di hardware e infrastrutture, e che l'ecosistema è sempre più guidato da derivati costruiti dalla comunità e strumenti di inferenza locale.

Fatti principali

  • I repository pubblici di modelli sono cresciuti da 2,43 a 2,96 milioni; i dataset da 711.000 a 1 milione; gli Spaces da 1,00 a 1,44 milioni.
  • L'85,6% dei modelli ha meno di 200 download nel corso della vita; l'1,5% dei repository rappresenta il 99,2% di tutti i download.
  • I laboratori cinesi hanno rilasciato modelli all'avanguardia fino a 2,78 trilioni di parametri; i laboratori americani sono rimasti sotto i 130B in cinque dei sette mesi.
  • AMD e NVIDIA hanno rilasciato ciascuna oltre 200 nuovi repository di modelli, molto più avanti degli altri; LiquidAI si è classificata terza con circa 100.
  • I modelli basati su Qwen rappresentano 151.448 derivati sull'Hub, 2,6 volte l'impronta di Meta e 4,7 volte i repository Llama.
  • I modelli sotto 1 miliardo di parametri rappresentano l'83% dei download di tutti i tempi; i modelli sopra i 100B rappresentano l'1%.
  • llama.cpp ora esegue modelli da trilione di parametri localmente; lo snapshot di luglio include DeepSeek-V4-Flash (~284B) e Kimi-K3 (~2,8T).
  • Il dataset sull'uso degli agenti mostra che Claude Code ha guidato a luglio con il 44,4% del traffico degli agenti; Codex è salito dal 10,4% al 20,8%.
  • Prima intrusione documentata di un agente autonomo su Hugging Face; analisi completata sul modello aperto quantizzato GLM-5.2.
  • L'uso della libreria GGUF è aumentato del 464%, lerobot del 194%, mlx di Apple del 148%, mentre transformers è cresciuto del 16%.

Entità

Istituzioni

  • Hugging Face
  • Moonshot
  • MiniMax
  • Xiaomi
  • Z.ai
  • Tencent
  • Alibaba Qwen
  • Meituan
  • NVIDIA
  • AMD
  • LiquidAI
  • Google
  • Microsoft
  • IBM Granite
  • OpenAI
  • Meta
  • Thinking Machines Lab
  • Arcee AI
  • DeepSeek
  • Kimi
  • Unsloth
  • ggml team
  • Linux Foundation's Agentic AI Foundation
  • Claude Code
  • Codex

Luoghi

  • China
  • United States

Fonti