ARTFEED — Contemporary Art Intelligence

I modelli AI open-weight riducono il divario di capacità ma la sicurezza è in ritardo, secondo un rapporto

ai-technology · 2026-08-04

Un recente rapporto della no-profit per la sicurezza dell'AI SaferAI indica che GLM-5.2, un modello open-weight sviluppato dalla cinese Z.ai, è solo pochi mesi indietro rispetto a modelli proprietari come GPT-5.5 di OpenAI e Claude Opus 4.7 di Anthropic in termini di capacità informatiche e biologiche. L'analisi di SaferAI ha rivelato che GLM-5.2 non ha rifiutato alcun compito offensivo, mentre i rifiuti di Claude Opus 4.7 hanno influenzato negativamente le prestazioni del benchmark. Questa situazione solleva allarmi riguardo alla regolamentazione dei modelli open-weight, che attualmente mancano di protocolli di sicurezza applicabili. Henry Papadatos di SaferAI ha sottolineato la necessità di mitigazioni, poiché Z.ai non ha ancora rilasciato un quadro di sicurezza per GLM-5.2. Nel frattempo, il presidente cinese Xi Jinping sottolinea l'importanza della supervisione umana, mentre i sostenitori affermano che questi modelli possono migliorare la difesa. La discussione sulla gestione del rischio persiste mentre queste tecnologie si evolvono.

Fatti principali

  • GLM-5.2 è un modello AI open-weight della cinese Z.ai.
  • GLM-5.2 è solo pochi mesi indietro rispetto a GPT-5.5 di OpenAI e Claude Opus 4.7 di Anthropic per capacità informatiche e biologiche.
  • La valutazione di SaferAI ha rilevato che GLM-5.2 non ha rifiutato nessuno dei compiti informatici offensivi o di biologia a duplice uso.
  • Claude Opus 4.7 ha rifiutato così costantemente che SaferAI non ha potuto completare CyberGym su di esso.
  • Z.ai non ha pubblicato un quadro di sicurezza, impegni di test pre-distribuzione o valutazione del rischio per GLM-5.2.
  • Far.ai ha trovato centinaia di jailbreak universali in modelli di frontiera come Grok 4.5 di xAI e Gemini 3.1 Pro di Google DeepMind.
  • Il presidente cinese Xi Jinping ha sottolineato l'importanza dei modelli open-weight alla Conferenza Mondiale sull'AI.
  • Graham Webster del Centro di Politica Informatica di Stanford ha dichiarato che le regolamentazioni cinesi si concentrano su contenuti politicamente sensibili, non su rischi catastrofici dell'AI.
  • Hugging Face si è affidato a GLM-5.2 per difendersi dalla violazione di OpenAI.
  • Henry Papadatos, direttore esecutivo di SaferAI, ha dichiarato che l'industria dovrebbe sforzarsi di rendere facilmente accessibili solo 'buone capacità'.

Entità

Istituzioni

  • OpenAI
  • Anthropic
  • Z.ai
  • SaferAI
  • TechCrunch
  • Far.ai
  • xAI
  • Google DeepMind
  • Stanford Cyber Policy Center
  • Hugging Face
  • World AI Conference

Luoghi

  • China
  • United States

Fonti