Nuova Architettura di Sicurezza per il Supporto alla Salute Mentale tramite LLM
Un framework di governance della sicurezza indipendente dal modello è stato creato da ricercatori per i grandi modelli linguistici utilizzati nell'assistenza alla salute mentale. Questa architettura integra l'identificazione contestuale del rischio, la verifica tramite ragionamento e la generazione di risposte guidate da protocolli per dialoghi multi-turno. Valutata utilizzando GPT-5-chat e Qwen3.5-27B su dialoghi sintetici basati su storie autentiche di salute mentale, ha dimostrato eccellenti capacità di rilevamento del rischio (specificità: 0,85, IC 95%: 0,78-0,91; sensibilità: 0,92, IC 95%: 0,88-0,95) e ha aumentato le risposte di escalation preferite dai clinici di 25,6-59,2 punti percentuali, mantenendo al contempo il rapporto. Le prestazioni del sistema sono state costanti indipendentemente dalla lunghezza della conversazione e si sono generalizzate efficacemente su vari modelli.
Fatti principali
- L'architettura è indipendente dal modello
- Combina rilevamento del rischio, verifica e generazione di risposte
- Testata con GPT-5-chat e Qwen3.5-27B
- Specificità: 0,85 (IC 95%: 0,78-0,91)
- Sensibilità: 0,92 (IC 95%: 0,88-0,95)
- Aumento delle risposte di escalation preferite dai clinici di 25,6-59,2 punti percentuali
- Preservato il rapporto e la connessione
- Prestazioni stabili indipendentemente dalla lunghezza della conversazione
Entità
—