ARTFEED — Contemporary Art Intelligence

OpenAI lancia ChatGPT Images 2.0 con capacità di ragionamento per flussi di lavoro visivi

ai-technology · 2026-04-21

OpenAI ha rilasciato ChatGPT Images 2.0, posizionandolo come una piattaforma di flusso di lavoro visivo piuttosto che un semplice strumento creativo. Il modello integra capacità di ragionamento quando viene utilizzato con modelli di pensiero o pro, consentendo l'analisi di compiti complessi e la generazione di fino a otto output coerenti in una singola richiesta. I miglioramenti significativi includono una migliore comprensione delle istruzioni, una resa del testo più forte e un posizionamento degli oggetti migliorato. Il supporto multilingue è stato rafforzato, in particolare per la resa del testo in giapponese, coreano, cinese, hindi e bengalese. Il sistema gestisce vari rapporti d'aspetto da 3:1 a 1:3, supportando formati come banner, diapositive e grafiche per social. Images 2.0 mostra una fedeltà migliorata in diversi stili visivi, tra cui immagini fotorealistiche, fermo immagine cinematografici, pixel art e manga. Disponibile su ChatGPT, Codex e API, gli output di ragionamento avanzato sono limitati agli utenti ChatGPT Plus, Pro e Business. OpenAI nota limitazioni nel ragionamento fisico preciso e nell'accuratezza strutturale altamente dettagliata come aree per sviluppi futuri.

Fatti principali

  • OpenAI ha introdotto ChatGPT Images 2.0
  • Il modello integra capacità di ragionamento per compiti complessi
  • Genera fino a otto output coerenti in una singola richiesta
  • Supporto multilingue più forte per la resa di testi non latini
  • Gestisce rapporti d'aspetto da 3:1 a 1:3
  • Fedeltà migliorata in formati fotorealistici e stilizzati
  • Disponibile su ChatGPT, Codex e API
  • Output di ragionamento avanzato limitati agli utenti ChatGPT Plus, Pro e Business

Entità

Artisti

  • Asmelash Teka Hadgu

Istituzioni

  • OpenAI
  • Lesan AI
  • TechCrunch
  • Microsoft

Fonti