I LLM Mostrano un Ragionamento Morale Incoerente tra i Quadri Etici
Una recente indagine pubblicata su arXiv (2608.15354) esplora la coerenza dei principi etici applicati dai grandi modelli linguistici (LLM) attraverso diverse formulazioni di situazioni morali identiche. Questo studio enfatizza la stabilità del ragionamento morale creando insiemi di scenari moralmente equivalenti che mantengono lo stesso contesto mentre alterano la struttura per mostrare diverse prospettive etiche e variazioni stilistiche. Tra i modelli valutati c'è GPT. La ricerca nasce dalla crescente implementazione degli LLM in aree eticamente sensibili, dove le incoerenze potrebbero compromettere l'integrità epistemica dei sistemi di IA. I risultati indicano che, mentre gli LLM possono articolare un principio morale, possono contraddirlo quando lo scenario viene riformulato, sollevando dubbi sulla loro affidabilità nel processo decisionale morale. La ricerca comprende tre principali quadri filosofici: deontologia, utilitarismo ed etica della virtù. L'abstract del documento sottolinea il problema dell'incoerenza interna nei sistemi generativi e le sue conseguenze per il processo decisionale guidato dall'IA.
Fatti principali
- Lo studio è disponibile su arXiv con identificativo 2608.15354.
- Esamina la coerenza morale negli LLM attraverso deontologia, utilitarismo ed etica della virtù.
- La ricerca utilizza prompt controllati con scenari moralmente equivalenti che variano nella struttura.
- Sono stati valutati diversi modelli, incluso GPT.
- Lo studio rileva che gli LLM possono violare i principi morali dichiarati quando gli scenari vengono riformulati.
- L'incoerenza rappresenta un problema per i sistemi di IA utilizzati in contesti moralmente sensibili.
- Il documento mette in discussione l'integrità epistemica dei sistemi mediati dall'IA a causa di questa incoerenza.
- Il tipo di annuncio è 'nuovo'.
Entità
Istituzioni
- arXiv