AutoThinkSQL: Ragionamento Dinamico per Text-to-SQL tramite SFT e DPO
AutoThinkSQL è un nuovo framework che incorpora un meccanismo di auto-pensiero nel Supervised Fine-Tuning (SFT) e nel Direct Preference Optimization (DPO) specificamente per compiti Text-to-SQL. Questo metodo evita abilmente il ragionamento complesso per query semplici, mentre impiega un approfondito Chain-of-Thought (CoT) per quelle più intricate. Testato su Qwen3-Coder-30B-A3B, AutoThinkSQL ha mostrato miglioramenti significativi sui benchmark Spider e BIRD, ottenendo una riduzione media dei token di output del 24,6% e del 18,3%, insieme a una diminuzione della latenza media del 17,1% e dell'11,5% rispetto alla generazione basata solo su CoT. Questa ricerca affronta le inefficienze associate al ragionamento non necessario per query reali semplici.
Fatti principali
- AutoThinkSQL integra l'auto-pensiero in SFT e DPO per Text-to-SQL.
- Bypassa dinamicamente il ragionamento per query semplici e usa CoT per quelle complesse.
- Testato sul modello Qwen3-Coder-30B-A3B.
- Ottiene miglioramenti sui benchmark Spider e BIRD.
- Riduce i token di output del 24,6% (Spider) e del 18,3% (BIRD).
- Riduce la latenza del 17,1% (Spider) e dell'11,5% (BIRD).
- Confrontato con la generazione basata solo su CoT.
- Affronta l'inefficienza del ragionamento forzato per query semplici.
Entità
—