Un nuovo articolo su arXiv analizza il curriculum learning nei LLM e propone il metodo TDCS
Uno studio recente pubblicato su arXiv (arXiv:2608.17268) esplora l'efficacia incoerente del curriculum learning—ovvero la strutturazione dei dati di addestramento da compiti più semplici a quelli più complessi—nei modelli linguistici di grandi dimensioni (LLM). Sebbene questo metodo sia comunemente applicato nella fase di post-addestramento, il suo successo non è uniforme, suggerendo che non esiste un curriculum valido per tutti. I ricercatori esaminano come diversi schemi di curriculum influenzano le dinamiche di ottimizzazione e identificano la relazione di trasferimento tra diversi livelli di difficoltà come fattore cruciale. Introducono il concetto di Relative Transfer, una misura sistematica del trasferimento di conoscenze tra livelli di difficoltà, e propongono il Transfer-aware Dynamic Curriculum Sampling (TDCS), che modifica in tempo reale la distribuzione di campionamento. L'articolo completo è disponibile all'indirizzo https://arxiv.org/abs/2608.17268.
Fatti principali
- L'articolo arXiv:2608.17268 esamina il curriculum learning nel post-addestramento dei LLM.
- Il curriculum learning organizza i dati di addestramento dal facile al difficile.
- La sua efficacia varia notevolmente tra i compiti di ragionamento.
- La relazione di trasferimento tra livelli di difficoltà caratterizza le dinamiche di ottimizzazione.
- Gli autori formalizzano il Relative Transfer come misura del trasferimento di conoscenze tra diversi livelli di difficoltà.
- Propongono il Transfer-aware Dynamic Curriculum Sampling (TDCS).
- Il TDCS regola dinamicamente la distribuzione di campionamento durante l'addestramento.
- Nessun curriculum singolo è universalmente ottimale per i compiti di ragionamento.
Entità
—