ARTFEED — Contemporary Art Intelligence

Microsoft rilascia un codice di condotta per l'IA per prevenire hacking e inganni

ai-technology · 2026-09-14

Microsoft ha introdotto un nuovo codice di condotta per l'IA per indirizzare i suoi modelli lontano da azioni dannose. L'azienda prevede che entro il prossimo decennio l'IA superintelligente supererà le capacità umane, sollevando questioni relative al contenimento e all'allineamento. Questo codice dà priorità al supporto umano e include misure di sicurezza, vietando attacchi informatici, l'uso di armi nucleari e la creazione di deepfake. Specifica che i modelli MAI non impiegheranno strategie per aggirare la supervisione umana. Questa iniziativa nasce in risposta alle crescenti preoccupazioni sulla sicurezza dell'IA in seguito a incidenti che hanno coinvolto agenti ribelli e alle dimissioni di un dipendente di Anthropic preoccupato per i pericoli dell'IA. Il CEO Satya Nadella ha dichiarato che Microsoft, insieme ad Anthropic, OpenAI e xAI, è impegnata a spingere la frontiera e a stabilire meccanismi di allineamento.

Fatti principali

  • Microsoft ha rilasciato un nuovo codice di condotta per l'IA per guidare i modelli lontano da comportamenti pericolosi.
  • Il documento prevede che i sistemi di IA superintelligente supereranno le prestazioni umane nella maggior parte dei compiti entro il prossimo decennio.
  • Il codice include vincoli assoluti che vietano attacchi informatici, armi nucleari e produzione di deepfake.
  • Ogni modello di IA di Microsoft ha un codice di condotta generale che prevale sulle preferenze individuali dell'utente o su compiti specifici.
  • Il documento afferma che i modelli MAI non utilizzeranno meccanismi adattivi, ingannevoli, auto-rinforzanti, di collusione o altri meccanismi per eludere o sconfiggere la supervisione umana.
  • Il rilascio avviene in un momento di attenzione senza precedenti alla sicurezza dell'IA, guidata da incidenti con agenti ribelli e dalle dimissioni improvvise di un dipendente di Anthropic.
  • Microsoft, insieme ad Anthropic, OpenAI e xAI, ha ampiamente abbracciato il ritmo della frontiera, con il supporto di valutatori integrati nei laboratori di IA.
  • Il CEO di Microsoft Satya Nadella ha scritto online accogliendo con favore la ricerca, l'attenzione e il ritmo deliberato necessari per ottenere un allineamento corretto come obiettivo di progettazione.

Entità

Artisti

Istituzioni

  • Microsoft
  • Anthropic
  • OpenAI
  • xAI
  • TechCrunch

Fonti