MTGuard: framework di analisi ibrida per proteggere l'uso degli strumenti MCP negli agenti LLM
I ricercatori propongono MTGuard, un framework di difesa basato su analisi ibrida per proteggere l'uso degli strumenti Model Context Protocol (MCP) negli agenti basati su grandi modelli linguistici (LLM). Gli strumenti MCP sono diventati uno standard de facto per standardizzare le interazioni tra agenti LLM e ambienti esterni, ma introducono rischi per la sicurezza poiché gli agenti possono essere indotti a compiere azioni dannose. Le difese precedenti si basano sull'analisi statica di prompt e output, limitandone l'efficacia. MTGuard sfrutta una co-analisi statico-dinamica consapevole del ciclo di vita per superare queste limitazioni. Una valutazione approfondita mostra che MTGuard mitiga efficacemente le minacce.
Fatti principali
- L'articolo arXiv 2607.25297 introduce MTGuard
- MTGuard è un framework di difesa basato su analisi ibrida
- Protegge l'uso degli strumenti MCP negli agenti LLM
- Gli strumenti MCP sono uno standard de facto per l'interazione agente LLM-ambiente
- Le difese precedenti si basano solo sull'analisi statica
- MTGuard utilizza una co-analisi statico-dinamica consapevole del ciclo di vita
- Una valutazione approfondita mostra una mitigazione efficace delle minacce
Entità
Istituzioni
- arXiv