Sicurezza del codice C generato da LLM migliorata dalla riparazione guidata da strumenti
Un nuovo flusso di lavoro per analisi e riparazione integra diagnostiche di compilazione, analisi statica CodeQL ed esecuzione simbolica KLEE, insieme al recupero di pattern di riparazione precedenti, per migliorare iterativamente il codice C generato da LLM. In uno studio che ha coinvolto 5.000 attività di programmazione C che includevano vulnerabilità rilevanti, i modelli di base hanno mostrato tassi di fallimento di compilazione fino al 46% e tassi di difetti di sicurezza fino al 49%. Per CodeLlama 7B, il tasso di difetti di sicurezza è migliorato significativamente, passando dal 49% al 19%, mentre gli errori totali di CodeQL sono stati ridotti da 15.088 a 2.463, con un calo dell'83,7%. I fallimenti di compilazione sono stati minimizzati anche per DeepSeek Coder 1.3B. Questa ricerca è dettagliata in arXiv:2607.21641.
Fatti principali
- arXiv:2607.21641
- Il flusso di lavoro utilizza diagnostiche di compilazione, CodeQL, KLEE e recupero
- Valutato su 5.000 attività di programmazione C
- Tassi di fallimento di compilazione di base fino al 46%
- Tassi di difetti di sicurezza di base fino al 49%
- CodeLlama 7B: difetti di sicurezza dal 49% al 19%
- CodeLlama 7B: errori CodeQL da 15.088 a 2.463 (83,7%)
- Ridotti i fallimenti di compilazione per DeepSeek Coder 1.3B
Entità
Istituzioni
- arXiv
- CodeQL
- KLEE
- CodeLlama
- DeepSeek Coder