ARTFEED — Contemporary Art Intelligence

Sicurezza del codice C generato da LLM migliorata dalla riparazione guidata da strumenti

ai-technology · 2026-07-27

Un nuovo flusso di lavoro per analisi e riparazione integra diagnostiche di compilazione, analisi statica CodeQL ed esecuzione simbolica KLEE, insieme al recupero di pattern di riparazione precedenti, per migliorare iterativamente il codice C generato da LLM. In uno studio che ha coinvolto 5.000 attività di programmazione C che includevano vulnerabilità rilevanti, i modelli di base hanno mostrato tassi di fallimento di compilazione fino al 46% e tassi di difetti di sicurezza fino al 49%. Per CodeLlama 7B, il tasso di difetti di sicurezza è migliorato significativamente, passando dal 49% al 19%, mentre gli errori totali di CodeQL sono stati ridotti da 15.088 a 2.463, con un calo dell'83,7%. I fallimenti di compilazione sono stati minimizzati anche per DeepSeek Coder 1.3B. Questa ricerca è dettagliata in arXiv:2607.21641.

Fatti principali

  • arXiv:2607.21641
  • Il flusso di lavoro utilizza diagnostiche di compilazione, CodeQL, KLEE e recupero
  • Valutato su 5.000 attività di programmazione C
  • Tassi di fallimento di compilazione di base fino al 46%
  • Tassi di difetti di sicurezza di base fino al 49%
  • CodeLlama 7B: difetti di sicurezza dal 49% al 19%
  • CodeLlama 7B: errori CodeQL da 15.088 a 2.463 (83,7%)
  • Ridotti i fallimenti di compilazione per DeepSeek Coder 1.3B

Entità

Istituzioni

  • arXiv
  • CodeQL
  • KLEE
  • CodeLlama
  • DeepSeek Coder

Fonti