Creare immagini con ChatGPT ha smesso di essere una funzione secondaria ed è diventato una delle cose che lo strumento fa meglio. Da aprile 2026, la generazione di immagini gira su ChatGPT Images 2.0, un modello nativo che ha sostituito definitivamente DALL·E — ritirato a maggio dello stesso anno — e che ha risolto il problema più persistente di ogni IA di immagini: scrivere testo dentro alla figura senza sbagliare le lettere.
Questo cambia il tipo di cose che si possono fare. Locandina con titolo leggibile, infografica con numeri corretti, copertina con il nome del marchio, pagina di fumetto con dialoghi, mockup di packaging con etichetta — tutto questo prima usciva storto e ora esce pulito nella maggior parte dei tentativi.
Questa guida copre il percorso completo: come generare la prima immagine, come scrivere il prompt nel modo in cui ChatGPT capisce meglio, come modificare senza rigenerare tutto, come mantenere lo stesso personaggio tra più immagini, cosa cambia tra il piano gratuito e quello a pagamento, e cosa lo strumento ancora non fa bene.
Cosa è cambiato nella generazione di immagini di ChatGPT
Fino al 2025, ChatGPT generava immagini richiamando DALL·E come sistema separato: scrivevi, lui traduceva la tua richiesta in un prompt interno e la inviava a un altro modello. Il risultato era irregolare, perché nel mezzo c'era una traduzione che non controllavi.
Oggi il modello di immagini è nativo e condivide il contesto con il modello linguistico. In pratica questo significa che capisce la richiesta allo stesso modo in cui capisce una domanda testuale: se dici "fai una locandina per una caffetteria che apre alle 7 a Milano", non ha bisogno che tu descriva ogni elemento visivo — deduce layout, gerarchia e contenuto.
Tre conseguenze pratiche contano più delle altre:
- Il testo dentro l'immagine funziona. Titoli, paragrafi, etichette, didascalie e persino testo in più lingue escono leggibili. Era il tallone d'Achille più grande delle IA di immagini.
- Un layout complesso è possibile. Infografiche, doppie pagine di rivista, schede personaggio e pagine con più vignette non sono più questione di fortuna.
- La coerenza tra immagini è migliorata. È possibile generare un insieme di immagini mantenendo lo stesso personaggio o lo stesso prodotto.
💡 Da sapere: i limiti di generazione di immagini nel piano gratuito non sono resi pubblici ufficialmente e cambiano in base alla domanda della piattaforma. Considerate qualsiasi numero che trovate in giro come una stima, non come una regola fissa.
Come generare la tua prima immagine, passo dopo passo
Il flusso è il più semplice possibile: non esiste un pannello separato né una configurazione preliminare obbligatoria.
- Apri una nuova conversazione. Non serve selezionare nessuna modalità speciale; basta chiedere.
- Descrivi l'immagine in linguaggio naturale. Scrivi come se stessi spiegando a un designer, con frasi complete. Non usare un elenco di parole separate da virgole: questo formato è di altri strumenti e qui rende meno.
- Indica le proporzioni. "Formato verticale per le storie", "quadrato per Instagram", "orizzontale 16:9". Se non lo dici, sceglie da solo.
- Attendi la generazione. Le immagini richiedono più tempo delle risposte testuali, specialmente quelle con layout denso.
- Chiedi le modifiche nella stessa conversazione. "Rendi lo sfondo più scuro", "ingrandisci il titolo", "cambia il colore del cappotto in rosso". Mantiene l'immagine e modifica solo ciò che hai chiesto.
- Scarica a piena risoluzione. Usa il pulsante di download, non lo screenshot: lo screenshot perde qualità ed esce nella dimensione della tua finestra.
Quest'ultimo punto è più importante di quanto sembri. Molte persone salvano l'immagine cliccando con il tasto destro sulla miniatura e finiscono con un file piccolo e ricompresso.
Le due modalità: istantanea e ragionamento
ChatGPT Images 2.0 funziona in due modalità, e capire la differenza evita frustrazioni.
La modalità istantanea genera direttamente dalla tua richiesta. È veloce, disponibile in tutti i piani incluso quello gratuito, e copre bene immagini semplici: una scena, un ritratto, un'illustrazione, uno sfondo.
La modalità con ragionamento — il "thinking" — fa sì che il modello pianifichi prima di disegnare: verifica la quantità di oggetti, controlla i vincoli richiesti, organizza il layout e, quando necessario, cerca sul web per portare informazioni aggiornate dentro l'immagine. È questa modalità che restituisce un'infografica corretta, una locandina con dati reali e una composizione con molti elementi allineati. È riservata ai piani a pagamento.
In pratica: se la tua richiesta ha una sola scena, la modalità istantanea basta. Se ha un conteggio ("esattamente cinque icone"), una gerarchia di testo o dati che devono essere corretti, il ragionamento fa una differenza reale.
Come scrivere prompt che ChatGPT capisce meglio
Ecco la differenza più grande tra ChatGPT e strumenti come Midjourney: preferisce la prosa a un elenco di tag. Scrivere "donna, 35 anni, blazer grigio, ufficio, 85mm, bokeh" funziona, ma rende meno della stessa informazione scritta in frasi.
Inizia dalla funzione dell'immagine, non dalla descrizione
Dire a cosa serve cambia completamente il risultato. "Una locandina promozionale per il workshop di fotografia del giorno 12" produce qualcosa di molto più utilizzabile di "un'immagine con una macchina fotografica e un testo". Il modello usa la finalità per decidere gerarchia, spazio e stile.
Scrivi il testo esatto tra virgolette
Quando l'immagine deve contenere parole, scrivile letteralmente e tra virgolette: il titolo "Colazione", il sottotitolo "tutti i sabati, dalle 8 alle 11". Senza virgolette, il modello può parafrasare o inventare. E indica dove va ogni testo: in alto, in basso, nell'angolo in basso a destra.
Descrivi la struttura prima dello stile
L'ordine che funziona è: cosa appare e dove → poi come appare. "Tre colonne uguali, un'icona in cima a ciascuna, titolo sotto e un breve paragrafo in fondo; stile minimalista con sfondo beige e tipografia senza grazie." Struttura prima significa molto meno lavoro da rifare.
Sii esplicito su cosa non vuoi
ChatGPT non ha un campo per il prompt negativo. Il vincolo va inserito dentro la stessa richiesta, e funziona meglio in forma affermativa: "composizione pulita, senza nessun testo oltre al titolo" rende di più di "senza testo".
Itera invece di riscrivere
È il vantaggio più grande dell'interfaccia conversazionale. Non riscrivere il prompt da zero quando qualcosa esce sbagliato: chiedi la correzione. "Mantieni tutto, ma cambia lo sfondo in blu navy" preserva ciò che era già buono. Riscrivere l'intero prompt genera un'immagine nuova senza relazione con quella precedente.
💡 Scorciatoia utile: chiedi a ChatGPT stesso di migliorare il tuo prompt prima di generare. "Riscrivi questa richiesta come un prompt dettagliato per un'immagine, senza generare ancora nulla" spesso rivela dettagli a cui non avevi pensato.
Proporzioni e risoluzione: cosa chiedere
Il modello accetta una gamma ampia di formati, da ultra-larghi a ultra-alti, e genera fino a 2K. Definire le proporzioni prima di generare evita il ritaglio dopo — e ritagliare dopo costa sempre qualcosa in composizione.
| Destinazione | Come chiedere | Proporzione |
|---|---|---|
| Feed Instagram | formato quadrato | 1:1 |
| Feed verticale / ritratto | formato ritratto per il feed | 4:5 |
| Storie e Reels | formato verticale per le storie | 9:16 |
| Miniatura YouTube | formato orizzontale widescreen | 16:9 |
| Banner del sito | formato panoramico largo | 3:1 |
| Copertina e-book | formato verticale da copertina libro | 2:3 |
| Sfondo desktop | formato orizzontale widescreen | 16:9 |
Se ti serve una risoluzione specifica — 1920 per 1080, per esempio — genera nella proporzione giusta e sistema dopo con il ridimensionatore di immagini. Chiedere dimensioni esatte in pixel dentro il prompt raramente viene rispettato alla lettera.
Modificare le immagini: i comandi che funzionano
La modifica è dove ChatGPT si distingue rispetto agli strumenti di generazione pura. Non servono maschera, livello o selezione: si descrive a parole.
Modificare un elemento specifico
"Mantieni la composizione e cambia solo il colore della parete in verde salvia." Più sei esplicito su cosa deve rimanere uguale, meno il modello tocca il resto. La parola "mantieni" fa un lavoro sorprendentemente grande qui.
Aggiungere o rimuovere oggetti
"Rimuovi la pianta nell'angolo destro e lascia la parete liscia." Funziona bene con oggetti chiaramente delimitati. Le rimozioni in aree con molta texture di sfondo a volte lasciano tracce — in quel caso, rigenerare spesso viene meglio che insistere con la modifica.
Cambiare lo stile mantenendo la scena
"Stessa composizione, stessi elementi, ma in stile acquerello." È utile per testare linguaggi visivi diversi senza perdere l'inquadratura che hai già approvato.
Modificare a partire da una tua immagine
Puoi inviare una foto e chiedere modifiche: cambiare lo sfondo, regolare l'illuminazione, trasformarla in un'illustrazione, creare varianti. Vale la pena ricordare che il risultato è un'immagine nuova generata a partire dalla tua, non una modifica pixel per pixel dell'originale.
Espandere l'inquadratura
"Espandi questa immagine in formato orizzontale, continuando lo scenario in modo naturale ai lati." È l'equivalente conversazionale dell'outpainting, e risolve il caso classico di un'immagine verticale che deve diventare un banner.
Come mantenere lo stesso personaggio in più immagini
Era il problema più difficile delle IA di immagini ed è diventato molto più gestibile. Tre approcci, dal più semplice al più affidabile.
Continuare nella stessa conversazione. È il metodo più semplice e il più efficace nell'uso quotidiano. Dopo aver generato il personaggio, chiedi la scena successiva senza ridescriverlo: "ora mostra lo stesso personaggio seduto in un caffè". Il modello mantiene il contesto della conversazione e conserva i tratti.
Descrivere tratti fissi per iscritto. Crea una descrizione breve e immutabile — capelli, occhi, abbigliamento caratteristico, accessorio distintivo — e ripeti esattamente le stesse parole in ogni richiesta. I sinonimi disturbano: "cappotto beige" e "soprabito color sabbia" producono capi diversi.
Chiedere prima un foglio di riferimento. Genera una scheda personaggio con lo stesso volto in più angolazioni ed espressioni, e usa questa immagine come riferimento nelle generazioni successive. È il percorso più impegnativo e il più coerente, specialmente per serie lunghe.
Vale la stessa logica per prodotti e identità di marca: più fissa è la descrizione, più stabile è il risultato.
Gratuito o a pagamento: cosa cambia davvero
La generazione di immagini è disponibile in tutti i piani, incluso quello gratuito. Ciò che varia è il volume, la velocità e l'accesso alla modalità con ragionamento.
| Aspetto | Piano gratuito | Piani a pagamento |
|---|---|---|
| Generazione di immagini | Disponibile, modalità istantanea | Disponibile, istantanea e ragionamento |
| Volume | Limitato, quota non pubblicata | Molto più alto |
| Velocità | Più lenta, soggetta a coda | Priorità nelle ore di punta |
| Ricerca sul web durante la generazione | No | Sì, in modalità ragionamento |
| Layout complessi e infografiche | Risultato irregolare | Molto più affidabile |
| Set di immagini coerenti | Limitato | Sì |
Per un uso personale occasionale — uno sfondo, un'illustrazione per un post, un'immagine di supporto — il piano gratuito basta. Per un lavoro ricorrente con layout, testo e volume, la differenza si nota subito. Se vuoi confrontare altre opzioni prima di abbonarti, la guida alle migliori IA per creare immagini mette a confronto i nomi principali, e la guida a Gemini per creare immagini copre la principale alternativa.
Cosa ChatGPT ancora non fa bene
Conoscere i limiti fa risparmiare tempo. Nessuno di questi è un difetto del prompt: sono limiti dello strumento.
- Persone reali. Generare immagini di persone identificabili, specialmente personaggi pubblici, è bloccato. Non serve riformulare la richiesta.
- Marchi e personaggi con licenza. Anche i loghi di aziende esistenti e i personaggi protetti da diritto d'autore vengono rifiutati.
- Vettoriale vero. L'output è sempre rasterizzato, in pixel. Se ti serve un file modificabile in curve, il risultato serve come riferimento per ridisegnare, non come file finale.
- Sfondo trasparente affidabile. Anche chiedendolo, l'immagine di solito arriva con sfondo solido. La trasparenza si risolve più rapidamente dopo, rimuovendo lo sfondo.
- Risoluzione sopra i 2K. Per la stampa grande o per un monitor 4K, è necessario ingrandire dopo.
- Riproduzione esatta di una tua foto. Quando modifica un'immagine inviata, il modello rigenera la scena. I dettagli fini dell'originale cambiano.
Sette errori che ostacolano di più
- Scrivere in formato di tag. Un elenco di parole separate da virgole è il linguaggio di altri strumenti. Qui la prosa rende di più.
- Non indicare le proporzioni. Senza indicazione, il modello sceglie da solo — e quasi sempre sceglie il formato sbagliato per il tuo uso.
- Riscrivere il prompt a ogni tentativo. Perdi quello che avevi già ottenuto. Chiedi correzioni mirate.
- Lasciare il testo libero nella richiesta. Senza virgolette e senza posizione, il modello parafrasa o lo mette dove vuole.
- Salvare tramite screenshot. Perde risoluzione e aggiunge ricompressione. Usa il download.
- Chiedere tutto insieme. Prompt con dieci richieste simultanee spesso falliscono su due o tre. Genera la base e sistema per fasi.
- Pubblicare direttamente senza ottimizzare. Un'immagine 2K in PNG pesa diversi megabyte e rallenta il caricamento di qualsiasi pagina.
Cosa fare con l'immagine dopo averla generata
Quest'ultimo punto merita più dettaglio, perché è dove sbagliano la maggior parte delle persone. L'immagine che esce da ChatGPT è pronta per essere vista, non per essere pubblicata.
Converti nel formato giusto. PNG è ottimo per la trasparenza e pessimo per le foto sul web. Per il sito, WebP di solito riduce il peso della metà senza differenza visibile; per l'invio comune, JPG risolve. Il convertitore di immagini fa il cambio direttamente nel browser, e la guida ai formati immagine aiuta a scegliere.
Riduci il peso. Un'immagine in 2K può superare i 5 MB. Il compressore di immagini taglia gran parte di questo senza perdita visibile — e se il file è davvero grande, la guida su come ridurre un'immagine da MB a KB copre i dettagli.
Isola l'oggetto quando serve. Per loghi, prodotti ed elementi che vanno su sfondo colorato, rimuovere lo sfondo e salvare in PNG trasparente è il passaggio che manca.
Sistema risoluzione e inquadratura. Se l'immagine è uscita più piccola del necessario, è possibile aumentare la risoluzione senza perdere qualità. Se è uscita nella proporzione sbagliata, ritagliare preserva più che stirare.
Sfrutta la palette. Per mantenere coerenza visiva tra immagini generate in sessioni diverse, estrai i colori di quella riuscita meglio e cita quei toni nei prossimi prompt.
💡 Ordine che funziona: scarica a piena risoluzione → ritaglia o ridimensiona → converti il formato → comprimi per ultimo. Comprimere prima di ridimensionare spreca qualità.
Tre esempi di richieste complete
Per chiudere, tre richieste scritte nel modo in cui ChatGPT rende meglio — nota che tutte indicano la finalità, il testo esatto e le proporzioni.
Checklist prima di generare
- Hai detto a cosa serve l'immagine, non solo cosa mostra?
- Le proporzioni sono dichiarate?
- Il testo che deve apparire è tra virgolette, con posizione definita?
- La struttura è stata descritta prima dello stile?
- I vincoli sono scritti in forma affermativa?
- Stai chiedendo una correzione invece di riscrivere tutto?
- Scaricherai a piena risoluzione, e non con uno screenshot?
Rendi le tue immagini pronte per la pubblicazione
Le immagini generate in 2K superano facilmente i 5 MB. Riduci il peso senza perdere qualità visibile, direttamente nel browser.
Comprimi immagine