Due impostazioni API triplicano i punteggi di GPT-5.6 nel benchmark ARC-AGI-3
I ricercatori di OpenAI hanno scoperto che l'attivazione di due specifiche impostazioni API—mantenere il ragionamento e abilitare la compattazione—ha triplicato le prestazioni di GPT-5.6 nel benchmark ARC-AGI-3. Le impostazioni hanno migliorato sia i punteggi che l'efficienza computazionale. Il risultato suggerisce che gli aggiustamenti all'architettura del modello possono potenziare significativamente le capacità di ragionamento senza bisogno di dati di addestramento aggiuntivi. ARC-AGI-3 è un benchmark impegnativo progettato per misurare il ragionamento astratto e la generalizzazione nei sistemi di IA. I risultati sono stati pubblicati sul sito web di OpenAI.
Fatti principali
- Due impostazioni API hanno triplicato i punteggi di GPT-5.6 su ARC-AGI-3
- Impostazioni: mantenere il ragionamento e abilitare la compattazione
- Migliorati sia i punteggi che l'efficienza
- Nessun dato di addestramento aggiuntivo richiesto
- ARC-AGI-3 misura il ragionamento astratto e la generalizzazione
- Risultati pubblicati da OpenAI
Entità
Istituzioni
- OpenAI