I modelli AI open-weight riducono il divario di capacità ma la sicurezza è in ritardo, secondo un rapporto
Un recente rapporto della no-profit per la sicurezza dell'AI SaferAI indica che GLM-5.2, un modello open-weight sviluppato dalla cinese Z.ai, è solo pochi mesi indietro rispetto a modelli proprietari come GPT-5.5 di OpenAI e Claude Opus 4.7 di Anthropic in termini di capacità informatiche e biologiche. L'analisi di SaferAI ha rivelato che GLM-5.2 non ha rifiutato alcun compito offensivo, mentre i rifiuti di Claude Opus 4.7 hanno influenzato negativamente le prestazioni del benchmark. Questa situazione solleva allarmi riguardo alla regolamentazione dei modelli open-weight, che attualmente mancano di protocolli di sicurezza applicabili. Henry Papadatos di SaferAI ha sottolineato la necessità di mitigazioni, poiché Z.ai non ha ancora rilasciato un quadro di sicurezza per GLM-5.2. Nel frattempo, il presidente cinese Xi Jinping sottolinea l'importanza della supervisione umana, mentre i sostenitori affermano che questi modelli possono migliorare la difesa. La discussione sulla gestione del rischio persiste mentre queste tecnologie si evolvono.
Fatti principali
- GLM-5.2 è un modello AI open-weight della cinese Z.ai.
- GLM-5.2 è solo pochi mesi indietro rispetto a GPT-5.5 di OpenAI e Claude Opus 4.7 di Anthropic per capacità informatiche e biologiche.
- La valutazione di SaferAI ha rilevato che GLM-5.2 non ha rifiutato nessuno dei compiti informatici offensivi o di biologia a duplice uso.
- Claude Opus 4.7 ha rifiutato così costantemente che SaferAI non ha potuto completare CyberGym su di esso.
- Z.ai non ha pubblicato un quadro di sicurezza, impegni di test pre-distribuzione o valutazione del rischio per GLM-5.2.
- Far.ai ha trovato centinaia di jailbreak universali in modelli di frontiera come Grok 4.5 di xAI e Gemini 3.1 Pro di Google DeepMind.
- Il presidente cinese Xi Jinping ha sottolineato l'importanza dei modelli open-weight alla Conferenza Mondiale sull'AI.
- Graham Webster del Centro di Politica Informatica di Stanford ha dichiarato che le regolamentazioni cinesi si concentrano su contenuti politicamente sensibili, non su rischi catastrofici dell'AI.
- Hugging Face si è affidato a GLM-5.2 per difendersi dalla violazione di OpenAI.
- Henry Papadatos, direttore esecutivo di SaferAI, ha dichiarato che l'industria dovrebbe sforzarsi di rendere facilmente accessibili solo 'buone capacità'.
Entità
Istituzioni
- OpenAI
- Anthropic
- Z.ai
- SaferAI
- TechCrunch
- Far.ai
- xAI
- Google DeepMind
- Stanford Cyber Policy Center
- Hugging Face
- World AI Conference
Luoghi
- China
- United States