Esperti Privati con Mascheramento delle Policy: Controllo degli Accessi alle Capacità, Auditabile e Reversibile, in Modelli MoE Sparsi
Un recente articolo su arXiv (2608.06690) presenta Policy-Masked Private Experts, una tecnica innovativa per gestire l'accesso alle capacità in modelli sparsi Mixture-of-Experts (MoE). Questo metodo prevede il congelamento di un modello MoE pre-addestrato, lo sviluppo di un ramo esperto separato e la scelta tra pool pubblici e privati prima del routing top-k. Questo processo consente a un'autorizzazione fidata di determinare quali parametri appena addestrati possono essere accessibili durante il passaggio in avanti, garantendo che le richieste non autorizzate non coinvolgano esperti privati all'interno della base di calcolo fidata definita. Lo studio valuta questo controllo dell'esecuzione rispetto all'utilità del compito su Qwen3-30B-A3B e DeepSeek-V2-Lite. Nei test, tre seed Qwen BF16 hanno aggiornato tutti i 32 esperti privati, con l'impronta pubblica che rimane costante. In 64 scenari avversari e 96 eventi di negazione/chiusura su errore, l'esecuzione non autorizzata di esperti privati è stata bloccata con successo. Questa ricerca affronta un'indagine a livello di sistema: è possibile imporre il controllo degli accessi a livello di parametri invece di limitarsi a controllare il comportamento? L'articolo completo è disponibile su arXiv.
Fatti principali
- L'articolo arXiv:2608.06690 introduce Policy-Masked Private Experts.
- Il metodo congela il modello MoE sparso pre-addestrato e addestra un ramo esperto disgiunto.
- Il pool pubblico o privato viene selezionato prima del routing top-k.
- Le richieste non autorizzate non eseguono esperti privati sotto la TCB.
- Testato su Qwen3-30B-A3B e DeepSeek-V2-Lite.
- Tre seed Qwen BF16 aggiornano tutti i 32 esperti privati.
- L'impronta pubblica rimane invariata.
- Sono stati testati 64 scenari avversari e 96 eventi di negazione/chiusura su errore.
Entità
Istituzioni
- arXiv