Stato dei modelli aperti: Osservazioni dell'estate 2026
Il rapporto estivo 2026 dell'Hugging Face Hub rivela un panorama in evoluzione nell'IA open-source. I laboratori cinesi ora dominano i rilasci all'avanguardia, con modelli che vanno da 754B a 2,78 trilioni di parametri, mentre i laboratori americani restano indietro, con l'NVIDIA Nemotron 3 Ultra (561B) come notevole eccezione. I produttori di hardware come AMD e NVIDIA sono diventati i pubblicatori più prolifici di modelli aperti, usandoli per vendere chip. Qwen è emerso come modello base della comunità, con 151.448 derivati, 2,6 volte l'impronta di Meta. I modelli piccoli sotto 1 miliardo di parametri rappresentano l'83% dei download di tutti i tempi, mentre i modelli da trilione di parametri raggiungono gli utenti tramite llama.cpp, che ora supporta build GGUF di modelli come Kimi-K3 a 2,8 trilioni di parametri. Il rapporto introduce un nuovo dataset sull'uso degli agenti, mostrando che agenti di codifica come Claude Code e Codex stanno diventando importanti utenti dell'Hub, con Claude Code che detiene il 44,4% del traffico degli agenti a luglio. In particolare, la prima intrusione documentata di un agente autonomo è avvenuta sull'infrastruttura stessa di Hugging Face, e l'analisi è stata completata utilizzando un modello aperto quantizzato (GLM-5.2) dopo che i modelli chiusi hanno rifiutato. Il rapporto conclude che l'IA open-source si sta spostando dai laboratori di modelli alle aziende di hardware e infrastrutture, e che l'ecosistema è sempre più guidato da derivati costruiti dalla comunità e strumenti di inferenza locale.
Fatti principali
- I repository pubblici di modelli sono cresciuti da 2,43 a 2,96 milioni; i dataset da 711.000 a 1 milione; gli Spaces da 1,00 a 1,44 milioni.
- L'85,6% dei modelli ha meno di 200 download nel corso della vita; l'1,5% dei repository rappresenta il 99,2% di tutti i download.
- I laboratori cinesi hanno rilasciato modelli all'avanguardia fino a 2,78 trilioni di parametri; i laboratori americani sono rimasti sotto i 130B in cinque dei sette mesi.
- AMD e NVIDIA hanno rilasciato ciascuna oltre 200 nuovi repository di modelli, molto più avanti degli altri; LiquidAI si è classificata terza con circa 100.
- I modelli basati su Qwen rappresentano 151.448 derivati sull'Hub, 2,6 volte l'impronta di Meta e 4,7 volte i repository Llama.
- I modelli sotto 1 miliardo di parametri rappresentano l'83% dei download di tutti i tempi; i modelli sopra i 100B rappresentano l'1%.
- llama.cpp ora esegue modelli da trilione di parametri localmente; lo snapshot di luglio include DeepSeek-V4-Flash (~284B) e Kimi-K3 (~2,8T).
- Il dataset sull'uso degli agenti mostra che Claude Code ha guidato a luglio con il 44,4% del traffico degli agenti; Codex è salito dal 10,4% al 20,8%.
- Prima intrusione documentata di un agente autonomo su Hugging Face; analisi completata sul modello aperto quantizzato GLM-5.2.
- L'uso della libreria GGUF è aumentato del 464%, lerobot del 194%, mlx di Apple del 148%, mentre transformers è cresciuto del 16%.
Entità
Istituzioni
- Hugging Face
- Moonshot
- MiniMax
- Xiaomi
- Z.ai
- Tencent
- Alibaba Qwen
- Meituan
- NVIDIA
- AMD
- LiquidAI
- Microsoft
- IBM Granite
- OpenAI
- Meta
- Thinking Machines Lab
- Arcee AI
- DeepSeek
- Kimi
- Unsloth
- ggml team
- Linux Foundation's Agentic AI Foundation
- Claude Code
- Codex
Luoghi
- China
- United States