ARTFEED — Contemporary Art Intelligence

Meituan rilascia il primo modello AI cinese con trilioni di parametri addestrato su chip nazionali

ai-technology · 2026-06-30

Il gigante cinese della consegna di cibo Meituan ha rilasciato LongCat-2.0, un modello linguistico di grandi dimensioni con 1,6 trilioni di parametri e una finestra di contesto di 1 milione di token, affermando che è il primo modello AI cinese con trilioni di parametri addestrato interamente su hardware nazionale. Il modello è stato reso open source martedì ed è paragonabile al modello V4-pro di DeepSeek lanciato ad aprile. Mentre DeepSeek ha utilizzato chip nazionali solo per l'inferenza, LongCat-2.0 li ha utilizzati sia per l'inferenza che per il pre-addestramento, un processo computazionalmente più intensivo. Meituan ha dichiarato che il modello è stato costruito su cluster su larga scala di decine di migliaia di superpod AI ASIC, dimostrando un addestramento all'avanguardia su piattaforme hardware alternative. Sebbene Meituan non abbia nominato il suo fornitore di hardware, ha menzionato l'uso della Huawei Collective Communication Library (HCCL) per migliorare la stabilità dell'addestramento, simile a Nvidia NCCL.

Fatti principali

  • Meituan ha rilasciato LongCat-2.0 martedì
  • LongCat-2.0 ha 1,6 trilioni di parametri e una finestra di contesto di 1 milione di token
  • È il primo modello AI cinese con trilioni di parametri addestrato interamente su chip nazionali
  • Il modello V4-pro di DeepSeek lanciato ad aprile ha una scala comparabile
  • LongCat-2.0 ha utilizzato hardware nazionale sia per l'inferenza che per il pre-addestramento
  • Il modello è stato costruito su cluster di decine di migliaia di superpod AI ASIC
  • Meituan ha utilizzato la Huawei Collective Communication Library (HCCL) per la stabilità dell'addestramento
  • HCCL è simile a Nvidia NCCL

Entità

Istituzioni

  • Meituan
  • DeepSeek
  • Huawei
  • Nvidia

Luoghi

  • Beijing
  • China

Fonti