ADMITBench: Framework per la Valutazione delle Advisory Industriali dei LLM
È stato lanciato un nuovo framework di valutazione chiamato ADMITBench per valutare l'ammissibilità delle advisory provenienti da modelli linguistici di grandi dimensioni (LLM) industriali. Questa iniziativa, descritta in un white paper su arXiv, enfatizza le azioni suggerite piuttosto che i modelli stessi. Presenta un contratto di valutazione versionato governato da protocolli di sicurezza per determinare se le raccomandazioni sono supportate da prove, autorizzate dalle autorità e adatte secondo criteri specifici dell'impianto. L'implementazione di riferimento pubblica, Release 0.1.0, è destinata alla valutazione tecnica, non all'autorizzazione all'esecuzione. Pur non essendo una certificazione di sicurezza, il framework funge da strumento prezioso per valutare le advisory industriali. Il white paper è disponibile su arXiv con l'identificatore 2608.03866 e invita alla collaborazione della comunità tramite arXivLabs.
Fatti principali
- ADMITBench è un framework di riferimento per la valutazione delle advisory industriali dei LLM.
- Il framework valuta a livello dell'azione proposta.
- Implementa un contratto di valutazione versionato e governato dalla sicurezza.
- I controlli includono supporto delle prove, autorità e procedura, e controlli delle conseguenze specifici dell'impianto.
- Governato dalla sicurezza significa ammissibilità tramite controlli espliciti e non compensativi da un profilo dell'impianto versionato.
- La Release 0.1.0 è un'implementazione di riferimento pubblica per la valutazione tecnica e di ricerca.
- Il white paper è categorizzato su arXiv come Informatica > Intelligenza Artificiale.
- L'identificatore arXiv è 2608.03866.
Entità
Istituzioni
- arXiv
- arXivLabs