Le aziende cinesi di IA lottano con la carenza di chip mentre la domanda di inferenza aumenta
Le aziende cinesi di intelligenza artificiale stanno affrontando significative limitazioni computazionali mentre passano dallo sviluppo di modelli all'implementazione su larga scala. I chip domestici sono inadeguati per compiti complessi come la programmazione. Sebbene siano stati fatti sforzi per ottimizzare i carichi di lavoro di inferenza per l'hardware locale, la generazione di token di alta qualità dipende ancora dai processori Nvidia, che sono scarsi a causa delle restrizioni all'esportazione. Guan Jiawei, vicepresidente della startup di ottimizzazione dell'inferenza Approaching.AI, ha sottolineato una 'bipolarizzazione' della domanda, con un'enorme disparità tra la necessità di token di alta qualità e la loro disponibilità. I processori domestici possono gestire solo output di qualità inferiore, ostacolando la sostenibilità commerciale. La situazione è aggravata da un aumento drammatico nell'uso di token, con le chiamate giornaliere di token in Cina che hanno superato i 140 trilioni a marzo, un aumento di oltre 1.000 volte rispetto all'inizio del 2024, come riportato dall'Amministrazione Nazionale dei Dati.
Fatti principali
- Le aziende cinesi di IA stanno ottimizzando il software per far fronte alla crescente domanda di inferenza.
- L'inferenza può essere adattata all'hardware domestico, ma compiti complessi come la programmazione richiedono ancora chip Nvidia.
- Guan Jiawei, vicepresidente di Approaching.AI, osserva che la domanda di token di alta qualità supera di gran lunga l'offerta.
- I processori domestici non possono garantire in modo affidabile parametri di prestazione rigorosi per compiti di alto livello.
- I token di alta qualità dipendono ancora da Nvidia a causa della debole monetizzazione dei livelli di bassa qualità.
- Le chiamate giornaliere medie di token in Cina hanno superato i 140 trilioni a marzo, con un aumento di oltre 1.000 volte rispetto all'inizio del 2024.
- La carenza di potenza di calcolo è aggravata dal fatto che l'IA sta diventando più agentica.
- L'accesso limitato ai processori Nvidia riduce il pool di chip di fascia alta.
Entità
Istituzioni
- Approaching.AI
- National Data Administration
- Nvidia
Luoghi
- China