ARTFEED — Contemporary Art Intelligence

Niyam-AI: Sicurezza AI Dimostrabile tramite Prove a Conoscenza Zero

ai-technology · 2026-08-10

Il framework di nuova introduzione, Niyam-AI, mira a garantire la sicurezza degli agenti AI attraverso la verifica crittografica. All'inizio di ogni sessione, assicura gli strumenti consentiti e i vincoli all'interno di un Contratto di Intent, che viene impegnato utilizzando SHA-256. Un modello Giudice isolato intercetta e autentica ogni chiamata di strumento, generando una prova zk-SNARK tramite EZKL dopo una validazione riuscita. Lo strumento viene eseguito solo dopo che questa prova è stata verificata, consentendo a parti esterne di validare l'applicazione senza bisogno di accedere ai pesi del modello Giudice. Questo framework affronta problemi come l'iniezione di prompt, il ragionamento allucinato e l'uso non sicuro degli strumenti, vulnerabilità chiave per gli agenti LLM autonomi. Niyam-AI è stato testato su 2.000 scenari reali provenienti da una fonte non divulgata. Il relativo articolo è disponibile su arXiv con identificatore 2608.07167.

Fatti principali

  • Niyam-AI è un framework per l'applicazione dimostrabile della sicurezza dell'IA.
  • Utilizza un Contratto di Intent impegnato tramite SHA-256.
  • Un modello Giudice valida le chiamate agli strumenti.
  • Le prove zk-SNARK vengono generate tramite EZKL.
  • L'esecuzione dello strumento avviene solo dopo la verifica della prova.
  • Terze parti possono verificare l'applicazione senza accedere ai pesi del Giudice.
  • Valutato su 2.000 scenari reali.
  • Articolo disponibile su arXiv (2608.07167).

Entità

Istituzioni

  • arXiv

Fonti