ARTFEED — Contemporary Art Intelligence

HarnessSafe: Benchmarking della Sicurezza dei Vettori Persistenti nei Cablaggi degli Agenti

ai-technology · 2026-08-10

È stato introdotto un nuovo benchmark chiamato HarnessSafe per valutare la sicurezza attraverso i vettori persistenti nei cablaggi degli agenti. Il benchmark comprende 328 casi eseguibili che coprono sette famiglie di vettori persistenti ed è progettato per valutare i cablaggi degli agenti mainstream. Ogni caso è strutturato come un Ciclo di Vita del Rischio Persistente, tracciando l'influenza dell'attaccante dall'ingresso iniziale attraverso la persistenza attraverso i vettori e i confini di sistema, culminando in un trigger benigno e una violazione osservabile. Il metodo di valutazione è multi-fase e basato su tracce, basandosi su prove di esecuzione osservabili per identificare la propagazione del rischio. Questo lavoro affronta i rischi di sicurezza ritardati posti dallo stato persistente nei cablaggi degli agenti, che i benchmark esistenti spesso trascurano concentrandosi su pochi vettori o cablaggi. L'articolo è disponibile su arXiv con l'identificatore 2608.06984.

Fatti principali

  • HarnessSafe è un nuovo benchmark per valutare la sicurezza nei cablaggi degli agenti.
  • Include 328 casi eseguibili in sette famiglie di vettori persistenti.
  • Il benchmark copre la maggior parte dei cablaggi degli agenti mainstream.
  • Ogni caso è specificato come un Ciclo di Vita del Rischio Persistente.
  • La valutazione è multi-fase e basata su tracce.
  • Utilizza prove di esecuzione osservabili per valutare la propagazione del rischio.
  • Il lavoro affronta i rischi di sicurezza ritardati dallo stato persistente.
  • L'articolo è disponibile su arXiv (2608.06984).

Entità

Istituzioni

  • arXiv

Fonti