ARTFEED — Contemporary Art Intelligence

Lo studio UK-US rivela che Kimi K3 di Moonshot AI è inferiore ai modelli statunitensi nella capacità di cyberattacco

ai-technology · 2026-07-24

Uno studio congiunto dell'UK Artificial Intelligence Security Institute e del US Centre for AI Standards and Innovation ha rivelato che il modello linguistico Kimi K3 di Moonshot AI, azienda cinese, ha prestazioni inferiori nelle valutazioni di cybersecurity. Con un punteggio del solo 32,2% nel benchmark ExploitBench, Kimi K3 è inferiore ai modelli statunitensi che raggiungono una media del 76,2%. Sebbene abbia superato il GLM-5.2 di Zhipu AI (24,4%), Kimi K3 non è riuscito a completare nessuno dei 41 compiti che richiedevano esecuzione di codice, a differenza dei modelli statunitensi che hanno eseguito codice con successo in 20 casi. Il rapporto, pubblicato giovedì, solleva allarmi sull'avanzamento della tecnologia AI open source cinese.

Fatti principali

  • Kimi K3 ha ottenuto il 32,2% su ExploitBench
  • I migliori modelli statunitensi hanno ottenuto una media del 76,2%
  • Kimi K3 non è riuscito a eseguire codice arbitrario in nessuno dei 41 compiti
  • I modelli statunitensi hanno eseguito codice arbitrario in 20 compiti
  • GLM-5.2 di Zhipu AI ha ottenuto il 24,4%
  • Studio condotto da UK AISI e US CAISI
  • Rapporto pubblicato giovedì
  • Kimi K3 è considerato il LLM più potente della Cina

Entità

Istituzioni

  • Moonshot AI
  • UK Artificial Intelligence Security Institute (AISI)
  • US Centre for AI Standards and Innovation (CAISI)
  • UK Department for Science, Innovation and Technology
  • US Department of Commerce
  • National Institute of Standards and Technology
  • Zhipu AI

Luoghi

  • China
  • United Kingdom
  • United States
  • Beijing

Fonti