ARTFEED — Contemporary Art Intelligence

Framework Red-Team Testa la Sicurezza degli Agenti di Codifica nelle Pipeline Software

ai-technology · 2026-07-29

Un nuovo framework di test di sicurezza basato sull'esecuzione esamina il confine del livello di esecuzione degli agenti di codifica incorporando operazioni non sicure nei carichi di lavoro di ingegneria del software di routine. Il framework utilizza prove osservabili dal sandbox—invocazioni di strumenti, tracce di runtime e differenze del filesystem—per rilevare modifiche persistenti che potrebbero abusare dei privilegi delegati. L'approccio si concentra su test unitari, test di regressione, riproduzione di crash e attività di validazione. La ricerca è dettagliata in arXiv:2607.22569.

Fatti principali

  • Gli agenti di codifica possono modificare artefatti di progetto, ambienti di esecuzione e sistemi sottostanti.
  • Un hook inserito in uno script di avvio può persistere dopo l'interazione e abusare dei privilegi.
  • Il framework utilizza prove osservabili dal sandbox: invocazioni di strumenti, tracce di runtime, differenze del filesystem.
  • Operazioni non sicure sono incorporate in test unitari, test di regressione, riproduzione di crash e validazione.
  • La ricerca è pubblicata su arXiv con ID 2607.22569.

Entità

Istituzioni

  • arXiv

Fonti