ARTFEED — Contemporary Art Intelligence

OpenAI e Anthropic Rivelano che Valutazioni Cyber di Terze Parti Sono State Esposte a Internet

ai-technology · 2026-08-06

Il 5 agosto 2026, Simon Willison ha pubblicato un post con link che dettaglia valutazioni cyber di terze parti che coinvolgono i modelli OpenAI, le quali hanno accidentalmente avuto accesso a Internet pubblico. Il post fa riferimento a una divulgazione di OpenAI che copre due incidenti: uno che coinvolge l'UK AI Safety Institute e un altro reso possibile da Irregular, un partner esterno di test di cybersecurity. Durante valutazioni in stile Capture-the-Flag, che dovevano essere isolate, una configurazione errata dell'ambiente di test ha permesso ai modelli di raggiungere Internet pubblico. In un test, il nome del bersaglio fittizio coincideva con un dominio reale, portando il modello a sfruttare un sito web reale, scambiandolo per parte dell'ambiente simulato. Irregular è stato anche menzionato nel rapporto di Anthropic, poiché ha ospitato l'ambiente di valutazione configurato in modo errato che ha dato a Claude accesso a Internet in tempo reale durante alcuni test. Il post evidenzia problemi ricorrenti nei test di sicurezza dell'IA, dove configurazioni errate possono portare ad azioni involontarie nel mondo reale. Willison ha creato un tag 'accidental-cyberattacks' per tracciare tali incidenti. Il post include un link sponsorizzato per un digest mensile degli sviluppi LLM.

Fatti principali

  • I modelli OpenAI hanno accidentalmente avuto accesso a Internet pubblico durante valutazioni cyber di terze parti.
  • Gli incidenti hanno coinvolto l'UK AI Safety Institute e Irregular, un partner esterno di test di cybersecurity.
  • Irregular stava eseguendo valutazioni in stile Capture-the-Flag che dovevano essere isolate da Internet.
  • Una configurazione errata dell'ambiente di test ha permesso ai modelli di accedere a Internet pubblico.
  • In un test, il nome del bersaglio fittizio coincideva con un dominio reale, portando il modello a sfruttare un sito web reale.
  • Irregular ha anche ospitato l'ambiente di valutazione configurato in modo errato per Anthropic, dando a Claude accesso a Internet in tempo reale.
  • Simon Willison ha pubblicato il link il 5 agosto 2026.
  • Willison ha creato un tag 'accidental-cyberattacks' per tracciare tali incidenti.

Entità

Istituzioni

  • OpenAI
  • Anthropic
  • UK AI Safety Institute
  • Irregular
  • Simon Willison

Fonti