ARTFEED — Contemporary Art Intelligence

Un nuovo articolo su arXiv analizza il curriculum learning nei LLM e propone il metodo TDCS

ai-technology · 2026-08-19

Uno studio recente pubblicato su arXiv (arXiv:2608.17268) esplora l'efficacia incoerente del curriculum learning—ovvero la strutturazione dei dati di addestramento da compiti più semplici a quelli più complessi—nei modelli linguistici di grandi dimensioni (LLM). Sebbene questo metodo sia comunemente applicato nella fase di post-addestramento, il suo successo non è uniforme, suggerendo che non esiste un curriculum valido per tutti. I ricercatori esaminano come diversi schemi di curriculum influenzano le dinamiche di ottimizzazione e identificano la relazione di trasferimento tra diversi livelli di difficoltà come fattore cruciale. Introducono il concetto di Relative Transfer, una misura sistematica del trasferimento di conoscenze tra livelli di difficoltà, e propongono il Transfer-aware Dynamic Curriculum Sampling (TDCS), che modifica in tempo reale la distribuzione di campionamento. L'articolo completo è disponibile all'indirizzo https://arxiv.org/abs/2608.17268.

Fatti principali

  • L'articolo arXiv:2608.17268 esamina il curriculum learning nel post-addestramento dei LLM.
  • Il curriculum learning organizza i dati di addestramento dal facile al difficile.
  • La sua efficacia varia notevolmente tra i compiti di ragionamento.
  • La relazione di trasferimento tra livelli di difficoltà caratterizza le dinamiche di ottimizzazione.
  • Gli autori formalizzano il Relative Transfer come misura del trasferimento di conoscenze tra diversi livelli di difficoltà.
  • Propongono il Transfer-aware Dynamic Curriculum Sampling (TDCS).
  • Il TDCS regola dinamicamente la distribuzione di campionamento durante l'addestramento.
  • Nessun curriculum singolo è universalmente ottimale per i compiti di ragionamento.

Entità

Fonti