ODYSSE: Un Nuovo Framework per il Ragionamento Agentico Personalizzato
I ricercatori hanno introdotto ODYSSE, un framework di Reinforced Fine-Tuning (RFT) progettato per affrontare il ragionamento agentico personalizzato, una sfida in cui gli agenti AI devono interpretare richieste ambigue degli utenti e interagire con gli ambienti per fornire servizi su misura. L'innovazione centrale del framework è Episode-wise GRPO (ESPO), un'estensione della Group Relative Policy Optimization (GRPO) che gestisce orizzonti di azione lunghi e forti dipendenze tra i passi. Questo lavoro, dettagliato in un preprint su arXiv (2607.25369), si concentra su scenari centrati sull'uomo in cui le istruzioni non sono ben definite, richiedendo agli agenti di decodificare le preferenze personali per restringere spazi di soluzione aperti. L'approccio mira a migliorare la capacità dei sistemi agentici di fornire servizi personalizzati in contesti reali.
Fatti principali
- ODYSSE è un framework di Reinforced Fine-Tuning (RFT) per il ragionamento agentico personalizzato.
- Introduce Episode-wise GRPO (ESPO), un'estensione della Group Relative Policy Optimization (GRPO).
- ESPO gestisce orizzonti di azione lunghi e forti dipendenze tra i passi.
- Il framework si concentra su scenari centrati sull'uomo con richieste ambigue degli utenti.
- Richiede che gli agenti interagiscano congiuntamente con utenti e ambienti.
- L'obiettivo è decodificare le preferenze personali per restringere gli spazi di soluzione.
- L'articolo è disponibile su arXiv con ID 2607.25369.
- Il lavoro si concentra sul miglioramento dei sistemi agentici per servizi personalizzati.
Entità
Istituzioni
- arXiv