Fragilità del Percorso di Attenzione come Segnale di Incertezza nei Modelli Linguistici di Grandi Dimensioni
Uno studio recente introduce una tecnica per valutare l'incertezza nei modelli linguistici di grandi dimensioni analizzando la vulnerabilità delle previsioni sicure quando i percorsi di attenzione vengono alterati. Questo metodo, chiamato ASMI (Attention-Subnetwork Mutual Information), funziona come uno stimatore senza addestramento che valuta l'informazione mutua BALD mascherando le teste di attenzione ed esaminando le sottoreti risultanti, impiegando un kernel di accordo semantico per mitigare le discrepanze superficiali. I risultati indicano che questo segnale fornisce ulteriori informazioni predittive di errore oltre alla semplice confidenza ed entropia, specialmente per previsioni 'sicure ma fragili', riducendo efficacemente l'errore residuo di un filtro di confidenza di circa la metà. La distintività di ASMI è graduata per regime, consentendogli di prevedere la propria applicabilità, in particolare quando le risposte sono guidate dal contesto fornito. La ricerca è disponibile su arXiv con identificativo 2608.11138.
Fatti principali
- L'articolo propone ASMI (Attention-Subnetwork Mutual Information) come stimatore di incertezza senza addestramento.
- ASMI maschera le teste di attenzione e misura l'informazione mutua BALD tra le sottoreti.
- Un kernel di accordo semantico viene utilizzato per scontare i disaccordi superficiali.
- Il segnale aggiunge informazioni predittive di errore oltre alla confidenza e all'entropia di una singola passata.
- È concentrato nelle previsioni 'sicure ma fragili'.
- Agire sul segnale riduce approssimativamente della metà l'errore residuo di un filtro di confidenza.
- La distintività è graduata per regime, quindi ASMI prevede il proprio dominio di applicabilità.
- L'articolo è disponibile su arXiv con identificativo 2608.11138.
Entità
—