ARTFEED — Contemporary Art Intelligence

Pre-addestramento con Persona Sintetica: Allineare i Valori dell'IA dal Token Zero

ai-technology · 2026-08-15

Un recente articolo di ricerca presenta il Pre-addestramento con Persona Sintetica (SPP), un nuovo approccio che incorpora le persone assistenti desiderate durante la fase di pre-addestramento dei modelli linguistici, invece di affidarsi a un allineamento successivo. Disponibile su arXiv (2608.13482), lo studio critica le tecniche di allineamento esistenti che impongono valori dopo il pre-addestramento, risultando in una sovrapposizione superficiale che può causare disallineamento. L'SPP arricchisce i documenti di pre-addestramento con riflessioni in prima persona allineate a valori normativi, seguite da un addestramento standard con perdita di entropia incrociata sia sui testi originali che sulle riflessioni. Questo metodo integra la persona con altre, mentre un successivo addestramento su dati di dialogo utente-assistente consolida la persona. L'obiettivo è garantire che i valori siano radicati fin dall'inizio, affrontando il problema di allineare l'IA con gli obiettivi umani in ambienti autonomi.

Fatti principali

  • Titolo dell'articolo: Pre-addestramento con Persona Sintetica: Allineamento dal Token Zero
  • ID arXiv: 2608.13482
  • Tipo di annuncio: cross
  • L'SPP installa la persona dal token zero nel pre-addestramento
  • Utilizza riflessioni in prima persona allineate ai valori derivanti da una costituzione di valori normativi
  • Pre-addestra con perdita di entropia incrociata standard su documenti standard e riflessioni
  • Post-addestra su dati di dialogo utente-assistente
  • Affronta l'allineamento in contesti di IA autonoma

Entità

Istituzioni

  • arXiv

Fonti