Creare immagini con ChatGPT ha smesso di essere una funzione secondaria ed è diventato una delle cose che lo strumento fa meglio. Da aprile 2026, la generazione di immagini gira su ChatGPT Images 2.0, un modello nativo che ha sostituito definitivamente DALL·E — ritirato a maggio dello stesso anno — e che ha risolto il problema più persistente di ogni IA di immagini: scrivere testo dentro alla figura senza sbagliare le lettere.

Questo cambia il tipo di cose che si possono fare. Locandina con titolo leggibile, infografica con numeri corretti, copertina con il nome del marchio, pagina di fumetto con dialoghi, mockup di packaging con etichetta — tutto questo prima usciva storto e ora esce pulito nella maggior parte dei tentativi.

Questa guida copre il percorso completo: come generare la prima immagine, come scrivere il prompt nel modo in cui ChatGPT capisce meglio, come modificare senza rigenerare tutto, come mantenere lo stesso personaggio tra più immagini, cosa cambia tra il piano gratuito e quello a pagamento, e cosa lo strumento ancora non fa bene.

Cosa è cambiato nella generazione di immagini di ChatGPT

Fino al 2025, ChatGPT generava immagini richiamando DALL·E come sistema separato: scrivevi, lui traduceva la tua richiesta in un prompt interno e la inviava a un altro modello. Il risultato era irregolare, perché nel mezzo c'era una traduzione che non controllavi.

Oggi il modello di immagini è nativo e condivide il contesto con il modello linguistico. In pratica questo significa che capisce la richiesta allo stesso modo in cui capisce una domanda testuale: se dici "fai una locandina per una caffetteria che apre alle 7 a Milano", non ha bisogno che tu descriva ogni elemento visivo — deduce layout, gerarchia e contenuto.

Tre conseguenze pratiche contano più delle altre:

💡 Da sapere: i limiti di generazione di immagini nel piano gratuito non sono resi pubblici ufficialmente e cambiano in base alla domanda della piattaforma. Considerate qualsiasi numero che trovate in giro come una stima, non come una regola fissa.

Come generare la tua prima immagine, passo dopo passo

Il flusso è il più semplice possibile: non esiste un pannello separato né una configurazione preliminare obbligatoria.

  1. Apri una nuova conversazione. Non serve selezionare nessuna modalità speciale; basta chiedere.
  2. Descrivi l'immagine in linguaggio naturale. Scrivi come se stessi spiegando a un designer, con frasi complete. Non usare un elenco di parole separate da virgole: questo formato è di altri strumenti e qui rende meno.
  3. Indica le proporzioni. "Formato verticale per le storie", "quadrato per Instagram", "orizzontale 16:9". Se non lo dici, sceglie da solo.
  4. Attendi la generazione. Le immagini richiedono più tempo delle risposte testuali, specialmente quelle con layout denso.
  5. Chiedi le modifiche nella stessa conversazione. "Rendi lo sfondo più scuro", "ingrandisci il titolo", "cambia il colore del cappotto in rosso". Mantiene l'immagine e modifica solo ciò che hai chiesto.
  6. Scarica a piena risoluzione. Usa il pulsante di download, non lo screenshot: lo screenshot perde qualità ed esce nella dimensione della tua finestra.

Quest'ultimo punto è più importante di quanto sembri. Molte persone salvano l'immagine cliccando con il tasto destro sulla miniatura e finiscono con un file piccolo e ricompresso.

Le due modalità: istantanea e ragionamento

ChatGPT Images 2.0 funziona in due modalità, e capire la differenza evita frustrazioni.

La modalità istantanea genera direttamente dalla tua richiesta. È veloce, disponibile in tutti i piani incluso quello gratuito, e copre bene immagini semplici: una scena, un ritratto, un'illustrazione, uno sfondo.

La modalità con ragionamento — il "thinking" — fa sì che il modello pianifichi prima di disegnare: verifica la quantità di oggetti, controlla i vincoli richiesti, organizza il layout e, quando necessario, cerca sul web per portare informazioni aggiornate dentro l'immagine. È questa modalità che restituisce un'infografica corretta, una locandina con dati reali e una composizione con molti elementi allineati. È riservata ai piani a pagamento.

In pratica: se la tua richiesta ha una sola scena, la modalità istantanea basta. Se ha un conteggio ("esattamente cinque icone"), una gerarchia di testo o dati che devono essere corretti, il ragionamento fa una differenza reale.

Come scrivere prompt che ChatGPT capisce meglio

Ecco la differenza più grande tra ChatGPT e strumenti come Midjourney: preferisce la prosa a un elenco di tag. Scrivere "donna, 35 anni, blazer grigio, ufficio, 85mm, bokeh" funziona, ma rende meno della stessa informazione scritta in frasi.

Inizia dalla funzione dell'immagine, non dalla descrizione

Dire a cosa serve cambia completamente il risultato. "Una locandina promozionale per il workshop di fotografia del giorno 12" produce qualcosa di molto più utilizzabile di "un'immagine con una macchina fotografica e un testo". Il modello usa la finalità per decidere gerarchia, spazio e stile.

Scrivi il testo esatto tra virgolette

Quando l'immagine deve contenere parole, scrivile letteralmente e tra virgolette: il titolo "Colazione", il sottotitolo "tutti i sabati, dalle 8 alle 11". Senza virgolette, il modello può parafrasare o inventare. E indica dove va ogni testo: in alto, in basso, nell'angolo in basso a destra.

Descrivi la struttura prima dello stile

L'ordine che funziona è: cosa appare e dove → poi come appare. "Tre colonne uguali, un'icona in cima a ciascuna, titolo sotto e un breve paragrafo in fondo; stile minimalista con sfondo beige e tipografia senza grazie." Struttura prima significa molto meno lavoro da rifare.

Sii esplicito su cosa non vuoi

ChatGPT non ha un campo per il prompt negativo. Il vincolo va inserito dentro la stessa richiesta, e funziona meglio in forma affermativa: "composizione pulita, senza nessun testo oltre al titolo" rende di più di "senza testo".

Itera invece di riscrivere

È il vantaggio più grande dell'interfaccia conversazionale. Non riscrivere il prompt da zero quando qualcosa esce sbagliato: chiedi la correzione. "Mantieni tutto, ma cambia lo sfondo in blu navy" preserva ciò che era già buono. Riscrivere l'intero prompt genera un'immagine nuova senza relazione con quella precedente.

💡 Scorciatoia utile: chiedi a ChatGPT stesso di migliorare il tuo prompt prima di generare. "Riscrivi questa richiesta come un prompt dettagliato per un'immagine, senza generare ancora nulla" spesso rivela dettagli a cui non avevi pensato.

Proporzioni e risoluzione: cosa chiedere

Il modello accetta una gamma ampia di formati, da ultra-larghi a ultra-alti, e genera fino a 2K. Definire le proporzioni prima di generare evita il ritaglio dopo — e ritagliare dopo costa sempre qualcosa in composizione.

DestinazioneCome chiedereProporzione
Feed Instagramformato quadrato1:1
Feed verticale / ritrattoformato ritratto per il feed4:5
Storie e Reelsformato verticale per le storie9:16
Miniatura YouTubeformato orizzontale widescreen16:9
Banner del sitoformato panoramico largo3:1
Copertina e-bookformato verticale da copertina libro2:3
Sfondo desktopformato orizzontale widescreen16:9

Se ti serve una risoluzione specifica — 1920 per 1080, per esempio — genera nella proporzione giusta e sistema dopo con il ridimensionatore di immagini. Chiedere dimensioni esatte in pixel dentro il prompt raramente viene rispettato alla lettera.

Modificare le immagini: i comandi che funzionano

La modifica è dove ChatGPT si distingue rispetto agli strumenti di generazione pura. Non servono maschera, livello o selezione: si descrive a parole.

Modificare un elemento specifico

"Mantieni la composizione e cambia solo il colore della parete in verde salvia." Più sei esplicito su cosa deve rimanere uguale, meno il modello tocca il resto. La parola "mantieni" fa un lavoro sorprendentemente grande qui.

Aggiungere o rimuovere oggetti

"Rimuovi la pianta nell'angolo destro e lascia la parete liscia." Funziona bene con oggetti chiaramente delimitati. Le rimozioni in aree con molta texture di sfondo a volte lasciano tracce — in quel caso, rigenerare spesso viene meglio che insistere con la modifica.

Cambiare lo stile mantenendo la scena

"Stessa composizione, stessi elementi, ma in stile acquerello." È utile per testare linguaggi visivi diversi senza perdere l'inquadratura che hai già approvato.

Modificare a partire da una tua immagine

Puoi inviare una foto e chiedere modifiche: cambiare lo sfondo, regolare l'illuminazione, trasformarla in un'illustrazione, creare varianti. Vale la pena ricordare che il risultato è un'immagine nuova generata a partire dalla tua, non una modifica pixel per pixel dell'originale.

Espandere l'inquadratura

"Espandi questa immagine in formato orizzontale, continuando lo scenario in modo naturale ai lati." È l'equivalente conversazionale dell'outpainting, e risolve il caso classico di un'immagine verticale che deve diventare un banner.

Come mantenere lo stesso personaggio in più immagini

Era il problema più difficile delle IA di immagini ed è diventato molto più gestibile. Tre approcci, dal più semplice al più affidabile.

Continuare nella stessa conversazione. È il metodo più semplice e il più efficace nell'uso quotidiano. Dopo aver generato il personaggio, chiedi la scena successiva senza ridescriverlo: "ora mostra lo stesso personaggio seduto in un caffè". Il modello mantiene il contesto della conversazione e conserva i tratti.

Descrivere tratti fissi per iscritto. Crea una descrizione breve e immutabile — capelli, occhi, abbigliamento caratteristico, accessorio distintivo — e ripeti esattamente le stesse parole in ogni richiesta. I sinonimi disturbano: "cappotto beige" e "soprabito color sabbia" producono capi diversi.

Chiedere prima un foglio di riferimento. Genera una scheda personaggio con lo stesso volto in più angolazioni ed espressioni, e usa questa immagine come riferimento nelle generazioni successive. È il percorso più impegnativo e il più coerente, specialmente per serie lunghe.

Vale la stessa logica per prodotti e identità di marca: più fissa è la descrizione, più stabile è il risultato.

Gratuito o a pagamento: cosa cambia davvero

La generazione di immagini è disponibile in tutti i piani, incluso quello gratuito. Ciò che varia è il volume, la velocità e l'accesso alla modalità con ragionamento.

AspettoPiano gratuitoPiani a pagamento
Generazione di immaginiDisponibile, modalità istantaneaDisponibile, istantanea e ragionamento
VolumeLimitato, quota non pubblicataMolto più alto
VelocitàPiù lenta, soggetta a codaPriorità nelle ore di punta
Ricerca sul web durante la generazioneNoSì, in modalità ragionamento
Layout complessi e infograficheRisultato irregolareMolto più affidabile
Set di immagini coerentiLimitato

Per un uso personale occasionale — uno sfondo, un'illustrazione per un post, un'immagine di supporto — il piano gratuito basta. Per un lavoro ricorrente con layout, testo e volume, la differenza si nota subito. Se vuoi confrontare altre opzioni prima di abbonarti, la guida alle migliori IA per creare immagini mette a confronto i nomi principali, e la guida a Gemini per creare immagini copre la principale alternativa.

Cosa ChatGPT ancora non fa bene

Conoscere i limiti fa risparmiare tempo. Nessuno di questi è un difetto del prompt: sono limiti dello strumento.

Sette errori che ostacolano di più

  1. Scrivere in formato di tag. Un elenco di parole separate da virgole è il linguaggio di altri strumenti. Qui la prosa rende di più.
  2. Non indicare le proporzioni. Senza indicazione, il modello sceglie da solo — e quasi sempre sceglie il formato sbagliato per il tuo uso.
  3. Riscrivere il prompt a ogni tentativo. Perdi quello che avevi già ottenuto. Chiedi correzioni mirate.
  4. Lasciare il testo libero nella richiesta. Senza virgolette e senza posizione, il modello parafrasa o lo mette dove vuole.
  5. Salvare tramite screenshot. Perde risoluzione e aggiunge ricompressione. Usa il download.
  6. Chiedere tutto insieme. Prompt con dieci richieste simultanee spesso falliscono su due o tre. Genera la base e sistema per fasi.
  7. Pubblicare direttamente senza ottimizzare. Un'immagine 2K in PNG pesa diversi megabyte e rallenta il caricamento di qualsiasi pagina.

Cosa fare con l'immagine dopo averla generata

Quest'ultimo punto merita più dettaglio, perché è dove sbagliano la maggior parte delle persone. L'immagine che esce da ChatGPT è pronta per essere vista, non per essere pubblicata.

Converti nel formato giusto. PNG è ottimo per la trasparenza e pessimo per le foto sul web. Per il sito, WebP di solito riduce il peso della metà senza differenza visibile; per l'invio comune, JPG risolve. Il convertitore di immagini fa il cambio direttamente nel browser, e la guida ai formati immagine aiuta a scegliere.

Riduci il peso. Un'immagine in 2K può superare i 5 MB. Il compressore di immagini taglia gran parte di questo senza perdita visibile — e se il file è davvero grande, la guida su come ridurre un'immagine da MB a KB copre i dettagli.

Isola l'oggetto quando serve. Per loghi, prodotti ed elementi che vanno su sfondo colorato, rimuovere lo sfondo e salvare in PNG trasparente è il passaggio che manca.

Sistema risoluzione e inquadratura. Se l'immagine è uscita più piccola del necessario, è possibile aumentare la risoluzione senza perdere qualità. Se è uscita nella proporzione sbagliata, ritagliare preserva più che stirare.

Sfrutta la palette. Per mantenere coerenza visiva tra immagini generate in sessioni diverse, estrai i colori di quella riuscita meglio e cita quei toni nei prossimi prompt.

💡 Ordine che funziona: scarica a piena risoluzione → ritaglia o ridimensiona → converti il formato → comprimi per ultimo. Comprimere prima di ridimensionare spreca qualità.

Tre esempi di richieste complete

Per chiudere, tre richieste scritte nel modo in cui ChatGPT rende meglio — nota che tutte indicano la finalità, il testo esatto e le proporzioni.

Crea una locandina verticale promozionale per un workshop di fotografia. Il titolo deve essere "Luce Naturale" in lettere grandi in alto, e sotto, più piccolo, "sabato 12 luglio — dalle 14 alle 18". Sfondo in tono terroso con una silhouette di macchina fotografica a tratto sottile. Stile minimalista, tipografia senza grazie, molto spazio vuoto. Formato verticale per le storie.
Genera un'infografica orizzontale con tre colonne uguali che spiegano le fasi di un processo. Ogni colonna ha un'icona semplice in alto, un titolo breve e una frase di supporto. I titoli sono "Raccogliere", "Analizzare" e "Pubblicare". Palette in blu navy, bianco e un tono di arancione per l'accento. Stile editoriale pulito, senza ombre. Formato widescreen.
Crea una foto prodotto quadrata di un vasetto di crema bianco opaco su pietra chiara, con foglie verdi fresche intorno e sfondo beige tenue. Luce naturale diffusa da sinistra, primo piano frontale, estetica clean da skincare. Nessun testo nell'immagine.

Checklist prima di generare

Rendi le tue immagini pronte per la pubblicazione

Le immagini generate in 2K superano facilmente i 5 MB. Riduci il peso senza perdere qualità visibile, direttamente nel browser.

Comprimi immagine

Domande frequenti

Si possono creare immagini con ChatGPT gratuito?
Sì. La generazione di immagini è disponibile in tutti i piani, incluso quello gratuito, in modalità istantanea. Cambiano il volume consentito, la velocità nelle ore di punta e l'accesso alla modalità con ragionamento, riservata ai piani a pagamento. OpenAI non rende pubblico il numero esatto di immagini del piano gratuito, e questo limite varia in base alla domanda della piattaforma, quindi qualsiasi numero specifico che trovate in giro va considerato una stima.
ChatGPT usa ancora DALL·E?
No. Da aprile 2026, la generazione di immagini gira su ChatGPT Images 2.0, un modello nativo integrato direttamente in ChatGPT. DALL·E 2 e DALL·E 3 sono stati ritirati a maggio 2026. La differenza pratica è grande: poiché il modello di immagine condivide il contesto con il modello linguistico, capisce la richiesta direttamente, senza il passaggio intermedio di traduzione che esisteva prima e che rendeva il risultato irregolare.
Perché il testo nella mia immagine è uscito sbagliato?
Due cause coprono quasi tutti i casi. La prima è non aver scritto il testo tra virgolette: senza questo il modello interpreta la parola come tema e può parafrasare. La seconda è l'eccesso di testo: paragrafi lunghi e densi hanno ancora più probabilità di errore rispetto a titoli e frasi brevi. Se il testo è essenziale e continua a uscire sbagliato, la strada più affidabile è generare l'immagine senza testo e aggiungere le parole dopo in un editor.
Qual è la risoluzione massima delle immagini?
Il modello genera fino a 2K, con una gamma ampia di proporzioni che va da formati ultra-larghi a ultra-alti. Questo copre bene l'uso digitale: social media, sito, presentazione e miniatura. Per la stampa in grande formato o per uno sfondo di monitor 4K, è necessario ingrandire l'immagine dopo la generazione, il che funziona bene quando l'immagine è pulita e poco dettagliata.
Posso usare commercialmente le immagini che genero?
I termini di utilizzo di OpenAI permettono l'uso commerciale delle immagini generate, ma le regole possono cambiare e variano in base al piano e al paese. Inoltre, l'uso commerciale non equivale alla protezione legale: in molte giurisdizioni, le opere create interamente da una macchina incontrano restrizioni nella registrazione del diritto d'autore. Prima di usarle in materiale per un cliente o in un prodotto in vendita, controllate i termini vigenti ed evitate richieste che coinvolgano marchi registrati, personaggi con licenza o persone reali.
Come faccio a far generare a ChatGPT un'immagine con sfondo trasparente?
Anche chiedendolo esplicitamente, il risultato di solito arriva con uno sfondo solido invece di una trasparenza reale. Il modo più rapido è chiedere uno sfondo bianco uniforme, che è il più facile da ritagliare, e creare la trasparenza dopo rimuovendo lo sfondo e salvando in PNG. Questo passaggio richiede pochi secondi e dà un risultato più pulito rispetto a insistere con il modello, che tende a restituire uno sfondo a scacchi disegnato per imitare la trasparenza.