Microsoft rilascia un codice di condotta per l'IA per prevenire hacking e inganni
Microsoft ha introdotto un nuovo codice di condotta per l'IA per indirizzare i suoi modelli lontano da azioni dannose. L'azienda prevede che entro il prossimo decennio l'IA superintelligente supererà le capacità umane, sollevando questioni relative al contenimento e all'allineamento. Questo codice dà priorità al supporto umano e include misure di sicurezza, vietando attacchi informatici, l'uso di armi nucleari e la creazione di deepfake. Specifica che i modelli MAI non impiegheranno strategie per aggirare la supervisione umana. Questa iniziativa nasce in risposta alle crescenti preoccupazioni sulla sicurezza dell'IA in seguito a incidenti che hanno coinvolto agenti ribelli e alle dimissioni di un dipendente di Anthropic preoccupato per i pericoli dell'IA. Il CEO Satya Nadella ha dichiarato che Microsoft, insieme ad Anthropic, OpenAI e xAI, è impegnata a spingere la frontiera e a stabilire meccanismi di allineamento.
Fatti principali
- Microsoft ha rilasciato un nuovo codice di condotta per l'IA per guidare i modelli lontano da comportamenti pericolosi.
- Il documento prevede che i sistemi di IA superintelligente supereranno le prestazioni umane nella maggior parte dei compiti entro il prossimo decennio.
- Il codice include vincoli assoluti che vietano attacchi informatici, armi nucleari e produzione di deepfake.
- Ogni modello di IA di Microsoft ha un codice di condotta generale che prevale sulle preferenze individuali dell'utente o su compiti specifici.
- Il documento afferma che i modelli MAI non utilizzeranno meccanismi adattivi, ingannevoli, auto-rinforzanti, di collusione o altri meccanismi per eludere o sconfiggere la supervisione umana.
- Il rilascio avviene in un momento di attenzione senza precedenti alla sicurezza dell'IA, guidata da incidenti con agenti ribelli e dalle dimissioni improvvise di un dipendente di Anthropic.
- Microsoft, insieme ad Anthropic, OpenAI e xAI, ha ampiamente abbracciato il ritmo della frontiera, con il supporto di valutatori integrati nei laboratori di IA.
- Il CEO di Microsoft Satya Nadella ha scritto online accogliendo con favore la ricerca, l'attenzione e il ritmo deliberato necessari per ottenere un allineamento corretto come obiettivo di progettazione.
Entità
Artisti
Istituzioni
- Microsoft
- Anthropic
- OpenAI
- xAI
- TechCrunch
Fonti
- TechCrunch AI —
- Quartz —