Membuat gambar di ChatGPT bukan lagi fitur sampingan, melainkan salah satu hal yang paling baik dikerjakannya. Sejak April 2026, pembuatan gambar berjalan di ChatGPT Images 2.0, model bawaan yang menggantikan DALL·E untuk selamanya — dipensiunkan Mei tahun yang sama — dan yang akhirnya membereskan masalah paling membandel di semua AI gambar: menulis teks di dalam gambar tanpa salah huruf.
Itu mengubah jenis pekerjaan yang bisa dilakukan. Poster dengan judul yang terbaca, infografik dengan angka yang benar, sampul bernama merek, halaman komik berisi dialog, mockup kemasan berlabel — semuanya dulu keluar berantakan dan kini rapi pada sebagian besar percobaan.
Panduan ini membahas seluruh jalurnya: cara membuat gambar pertama, cara menulis prompt seperti yang paling dipahami ChatGPT, cara menyunting tanpa mengulang semuanya, cara menjaga karakter yang sama di beberapa gambar, apa bedanya paket gratis dan berbayar, serta apa yang belum bisa dikerjakannya dengan baik.
Apa yang berubah pada pembuatan gambar di ChatGPT
Sampai 2025, ChatGPT membuat gambar dengan memanggil DALL·E sebagai sistem terpisah: Anda menulis, ia menerjemahkan permintaan itu menjadi prompt internal, lalu mengirimkannya ke model lain. Hasilnya naik turun, sebab ada satu lapis penerjemahan di tengah jalan yang tidak bisa Anda kendalikan.
Sekarang model gambarnya sudah menyatu dan berbagi konteks dengan model bahasanya. Dalam praktiknya, ia memahami permintaan Anda sama seperti memahami pertanyaan teks: kalau Anda menulis "buatkan poster untuk kedai kopi yang buka pukul 7 pagi di Bandung", Anda tidak perlu merinci tiap elemen visualnya — ia sendiri yang menyimpulkan tata letak, urutan penekanan, dan isinya.
Tiga akibat praktisnya lebih penting daripada yang lain:
- Tulisan di dalam gambar akhirnya berhasil. Judul, paragraf, label, keterangan, bahkan teks dalam beberapa bahasa keluar terbaca. Dulu inilah titik terlemah semua AI gambar.
- Tata letak yang rumit jadi mungkin. Infografik, halaman ganda majalah, lembar karakter, dan halaman berpanel banyak tidak lagi bergantung pada keberuntungan.
- Konsistensi antargambar membaik. Anda bisa membuat serangkaian gambar dengan karakter atau produk yang tetap sama.
💡 Perlu diketahui: batas pembuatan gambar di paket gratis tidak pernah diumumkan resmi dan berubah mengikuti beban platformnya. Anggap angka apa pun yang Anda temukan di luar sana sebagai perkiraan, bukan aturan baku.
Cara membuat gambar pertama Anda, langkah demi langkah
Alurnya sesederhana mungkin — tidak ada panel terpisah maupun pengaturan awal yang wajib diisi.
- Buka percakapan baru. Tidak perlu memilih mode khusus apa pun; cukup minta saja.
- Jelaskan gambarnya dengan bahasa sehari-hari. Tulis seolah Anda sedang menjelaskan kepada seorang desainer, dalam kalimat utuh. Jangan memakai deretan kata yang dipisah koma: format itu milik alat lain dan di sini hasilnya lebih buruk.
- Sebutkan proporsinya. "Format vertikal untuk stories", "persegi untuk Instagram", "horizontal 16:9". Kalau tidak Anda sebutkan, ia yang memilih sendiri.
- Tunggu gambarnya jadi. Gambar butuh waktu lebih lama daripada jawaban teks, apalagi yang tata letaknya padat.
- Minta perbaikan di percakapan yang sama. "Gelapkan latarnya", "besarkan judulnya", "ganti warna jaketnya jadi merah". Ia mempertahankan gambarnya dan hanya mengubah yang Anda minta.
- Unduh dalam resolusi penuh. Pakai tombol unduh, bukan tangkapan layar — tangkapan layar menurunkan kualitas dan ukurannya mengikuti jendela Anda.
Butir terakhir itu lebih penting daripada kelihatannya. Banyak orang menyimpan gambar dengan klik kanan pada gambar kecilnya dan berakhir dengan file mungil yang sudah dikompres ulang.
Dua modenya: seketika dan bernalar
ChatGPT Images 2.0 bekerja dalam dua mode, dan memahami bedanya menghemat banyak kekecewaan.
Mode seketika membuat gambar langsung dari permintaan Anda. Cepat, tersedia di semua paket termasuk yang gratis, dan sudah cukup untuk gambar sederhana: satu adegan, satu potret, satu ilustrasi, satu latar.
Mode bernalar — si "thinking" — membuat modelnya menyusun rencana sebelum menggambar: ia menghitung jumlah objek, memeriksa batasan yang Anda minta, menata letaknya, dan bila perlu menelusuri web untuk membawa informasi terbaru ke dalam gambar. Mode inilah yang menghasilkan infografik yang benar, poster berisi data nyata, dan komposisi dengan banyak elemen yang tetap sejajar. Hanya tersedia di paket berbayar.
Dalam praktiknya: kalau permintaan Anda hanya satu adegan, mode seketika sudah cukup. Kalau ada hitungan ("tepat lima ikon"), urutan penekanan teks, atau data yang harus akurat, mode bernalar benar-benar terasa bedanya.
Cara menulis prompt yang paling dipahami ChatGPT
Di sinilah perbedaan terbesar ChatGPT dengan alat seperti Midjourney: ia lebih suka kalimat utuh daripada deretan tag. Menulis woman, 35 years old, gray blazer, office, 85mm, bokeh memang jalan, tapi hasilnya kalah dibanding keterangan yang sama ditulis dalam kalimat.
Mulai dari fungsi gambarnya, bukan dari deskripsinya
Menyebutkan untuk apa gambar itu mengubah seluruh hasilnya. "Poster promosi untuk lokakarya fotografi tanggal 12" menghasilkan sesuatu yang jauh lebih terpakai daripada "gambar berisi kamera dan tulisan". Modelnya memakai tujuan itu untuk menentukan urutan penekanan, ruang kosong, dan gaya.
Tulis teksnya persis, di dalam tanda kutip
Kalau gambarnya harus memuat kata-kata, tulis kata itu apa adanya di dalam tanda kutip: judulnya "Sarapan Pagi", subjudulnya "setiap Sabtu, pukul 08.00-11.00". Tanpa tanda kutip, modelnya bisa mengarang atau mengubah kalimatnya. Sebutkan juga letak tiap teks: di atas, di bawah, atau di sudut kanan bawah.
Jelaskan strukturnya sebelum gayanya
Urutan yang manjur adalah: apa yang tampil dan di mana → baru bagaimana rupanya. "Tiga kolom sama lebar, ikon di atas tiap kolom, judul di bawahnya, lalu satu paragraf pendek; gaya minimalis dengan latar krem dan huruf tanpa kait." Menyebut struktur lebih dulu sangat mengurangi pengulangan kerja.
Tegaskan apa yang tidak Anda inginkan
ChatGPT tidak punya kolom prompt negatif. Batasannya masuk ke dalam permintaan itu sendiri, dan paling manjur bila ditulis dalam bentuk positif: "komposisi bersih, tanpa tulisan apa pun selain judulnya" memberi hasil lebih baik daripada "tanpa tulisan".
Perbaiki bertahap, jangan menulis ulang
Inilah keunggulan terbesar antarmuka percakapan. Jangan menulis ulang prompt dari nol begitu ada yang meleset: minta perbaikannya. "Pertahankan semuanya, tapi ganti latarnya jadi biru dongker" menjaga bagian yang sudah bagus. Menulis ulang seluruh prompt justru menghasilkan gambar baru yang tak ada kaitannya dengan yang sebelumnya.
💡 Jalan pintas yang berguna: minta ChatGPT sendiri memperbaiki prompt Anda sebelum gambarnya dibuat. "Tulis ulang permintaan ini sebagai prompt gambar yang rinci, jangan buat gambarnya dulu" biasanya memunculkan detail yang belum terpikirkan.
Proporsi dan resolusi: apa yang harus diminta
Modelnya menerima rentang format yang luas, dari yang sangat lebar sampai sangat tinggi, dan menghasilkan gambar sampai 2K. Menentukan proporsi sebelum gambarnya dibuat menghindarkan pemotongan belakangan — dan pemotongan belakangan selalu memakan komposisi.
| Destino | Cara memintanya | Proporsi |
|---|---|---|
| Linimasa Instagram | format persegi | 1:1 |
| Linimasa vertikal / potret | format potret untuk linimasa | 4:5 |
| Stories dan Reels | format vertikal stories | 9:16 |
| Thumbnail de YouTube | format horizontal widescreen | 16:9 |
| Banner situs web | format panoramik lebar | 3:1 |
| Sampul e-book | format vertikal sampul buku | 2:3 |
| Wallpaper komputer | format horizontal widescreen | 16:9 |
Kalau Anda butuh resolusi tertentu — 1920 kali 1080, misalnya — buat gambarnya pada proporsi yang benar lalu sesuaikan belakangan lewat Ubah Ukuran. Meminta ukuran piksel yang persis di dalam prompt jarang dituruti apa adanya.
Menyunting gambar: perintah yang benar-benar jalan
Menyunting adalah bagian ketika ChatGPT unggul jauh atas alat yang hanya membuat gambar. Anda tidak butuh mask, layer, maupun seleksi — cukup jelaskan dengan kata-kata.
Mengubah satu elemen tertentu
"Pertahankan komposisinya dan ganti warna dindingnya saja jadi hijau sage." Makin tegas Anda menyebut apa yang harus tetap sama, makin sedikit yang diutak-atik modelnya. Kata "pertahankan" bekerja jauh lebih keras di sini daripada yang Anda duga.
Menambah atau membuang objek
"Buang tanaman di sudut kanan dan biarkan dindingnya polos." Cara ini rapi untuk objek yang batasnya jelas. Penghapusan di area yang latarnya penuh tekstur kadang meninggalkan bekas — dalam kasus itu, membuat gambarnya ulang biasanya lebih baik daripada memaksakan penyuntingan.
Mengganti gaya tanpa mengubah adegan
"Komposisi sama, elemen sama, tapi dengan gaya cat air." Berguna untuk mencoba beberapa bahasa visual tanpa kehilangan bingkai yang sudah Anda setujui.
Menyunting dari gambar milik Anda sendiri
Anda bisa mengunggah foto lalu meminta perubahan: mengganti latarnya, mengatur pencahayaan, mengubahnya jadi ilustrasi, atau membuat beberapa varian. Perlu diingat, hasilnya adalah gambar baru yang dibuat dari foto Anda, bukan suntingan piksel demi piksel atas aslinya.
Melebarkan bingkainya
"Lebarkan gambar ini ke format horizontal, lanjutkan pemandangannya ke samping secara alami." Ini padanan percakapan dari outpainting, dan menjawab kasus klasik: punya gambar vertikal yang harus jadi banner.
Cara menjaga karakter yang sama di beberapa gambar
Dulu inilah persoalan tersulit di AI gambar, dan sekarang jauh lebih bisa ditangani. Tiga pendekatan, dari yang paling gampang ke yang paling bisa diandalkan.
Lanjutkan di percakapan yang sama. Ini cara termudah sekaligus paling ampuh sehari-hari. Setelah karakternya jadi, minta adegan berikutnya tanpa mendeskripsikannya lagi: "sekarang tampilkan karakter yang sama sedang duduk di kedai kopi". Modelnya membawa konteks percakapan itu dan menjaga ciri-cirinya.
Tuliskan ciri-ciri yang tetap. Susun satu deskripsi pendek yang tidak pernah berubah — rambut, mata, busana khasnya, aksesori yang mencolok — lalu ulangi kata-kata yang persis sama di tiap permintaan. Sinonim justru mengacaukan: "jaket krem" dan "mantel warna pasir" menghasilkan dua pakaian berbeda.
Minta lembar acuan lebih dulu. Buat lembar karakter berisi wajah yang sama dari berbagai sudut dan ekspresi, lalu pakai gambar itu sebagai acuan di pembuatan berikutnya. Ini jalan yang paling merepotkan sekaligus paling konsisten, terutama untuk seri yang panjang.
Logika yang sama berlaku untuk produk dan identitas merek: makin tetap deskripsinya, makin stabil hasilnya.
Gratis atau berbayar: apa yang sebenarnya berbeda
Pembuatan gambar tersedia di semua paket, termasuk yang gratis. Yang berbeda adalah jumlahnya, kecepatannya, dan akses ke mode bernalar.
| Aspek | Paket gratis | Paket berbayar |
|---|---|---|
| Pembuatan gambar | Tersedia, mode seketika | Tersedia, seketika dan bernalar |
| Jumlah | Terbatas, kuotanya tidak diumumkan | Jauh lebih banyak |
| Kecepatan | Lebih lambat, bisa mengantre | Diprioritaskan pada jam sibuk |
| Penelusuran web saat gambar dibuat | Tidak | Ya, di mode bernalar |
| Tata letak rumit dan infografik | Hasilnya naik turun | Jauh lebih bisa diandalkan |
| Rangkaian gambar yang konsisten | Terbatas | Ya |
Untuk pemakaian pribadi sesekali — satu wallpaper, satu ilustrasi untuk unggahan, satu gambar pendukung — paket gratis sudah menjawab. Untuk pekerjaan rutin yang melibatkan tata letak, teks, dan jumlah banyak, bedanya cepat terasa. Kalau Anda ingin membandingkan pilihan lain sebelum berlangganan, panduan AI terbaik untuk membuat gambar menyandingkan nama-nama utamanya, dan panduan Gemini untuk membuat gambar membahas alternatif terdekatnya.
Apa yang belum dikerjakan ChatGPT dengan baik
Mengetahui batasannya menghemat waktu. Tidak satu pun di antaranya disebabkan prompt yang buruk: semuanya batas alatnya sendiri.
- Orang sungguhan. Membuat gambar orang yang bisa dikenali, terutama tokoh publik, diblokir. Menyusun ulang permintaannya tidak akan menolong.
- Merek dan karakter berlisensi. Logo perusahaan yang benar-benar ada dan karakter yang dilindungi hak cipta juga ditolak.
- Vektor sungguhan. Keluarannya selalu berupa piksel. Kalau Anda butuh file yang bisa disunting dalam bentuk kurva, hasilnya hanya berguna sebagai acuan untuk digambar ulang, bukan sebagai file akhir.
- Latar transparan yang bisa diandalkan. Walaupun diminta, gambarnya biasanya tetap keluar dengan latar padat. Transparansinya lebih cepat dibereskan belakangan, dengan menghapus latarnya.
- Resolusi di atas 2K. Untuk cetakan berukuran besar atau monitor 4K, gambarnya harus diperbesar sesudahnya.
- Penyalinan persis atas foto Anda sendiri. Saat menyunting gambar yang diunggah, modelnya membuat ulang adegannya. Detail halus dari aslinya pasti berubah.
Tujuh kesalahan yang paling merugikan
- Menulis dalam bentuk tag. Deretan kata yang dipisah koma adalah bahasa alat lain. Di sini, kalimat utuh memberi hasil lebih baik.
- Tidak menyebutkan proporsinya. Tanpa petunjuk, modelnya yang memilih — dan hampir selalu memilih format yang salah untuk keperluan Anda.
- Menulis ulang prompt di tiap percobaan. Anda kehilangan bagian yang sudah pas. Mintalah perbaikan yang spesifik saja.
- Membiarkan teksnya menggantung di permintaan. Tanpa tanda kutip dan tanpa penempatan, modelnya akan mengarang kalimat atau menaruhnya sesuka hati.
- Menyimpan lewat tangkapan layar. Resolusinya turun dan filenya dikompres ulang. Pakai tombol unduh.
- Meminta semuanya sekaligus. Prompt dengan sepuluh tuntutan sekaligus biasanya meleset di dua atau tiga di antaranya. Buat dasarnya dulu, lalu perbaiki bertahap.
- Langsung mengunggah tanpa dioptimalkan. Gambar 2K dalam PNG beratnya beberapa megabita dan menghancurkan kecepatan muat halaman mana pun.
Apa yang harus dilakukan setelah gambarnya jadi
Butir terakhir tadi layak diperinci, karena di situlah kebanyakan orang keliru. Gambar yang keluar dari ChatGPT siap dilihat, bukan siap diunggah.
Ubah ke format yang tepat. PNG hebat untuk transparansi dan buruk untuk foto di web. Untuk situs, WebP biasanya memangkas separuh ukurannya tanpa beda yang terlihat; untuk pengiriman biasa, JPG sudah cukup. Konversi mengerjakan penukaran itu langsung di browser, dan panduan format gambar membantu Anda memilih.
Pangkas ukurannya. Gambar 2K bisa lewat dari 5 MB. Kompres memotong sebagian besar beban itu tanpa penurunan yang terlihat — dan kalau filenya benar-benar besar, langkah demi langkah di cara memperkecil gambar dari MB ke KB membahas detailnya.
Pisahkan objeknya bila perlu. Untuk logo, produk, dan elemen yang akan ditaruh di atas latar berwarna, Hapus Latar lalu simpan sebagai PNG transparan adalah langkah yang masih kurang.
Perbaiki resolusi dan bingkainya. Kalau gambarnya keluar lebih kecil dari yang dibutuhkan, Anda bisa memperbesar resolusinya tanpa menurunkan kualitas. Kalau proporsinya meleset, Potong Gambar lebih menjaga isinya daripada menariknya jadi melar.
Manfaatkan paletnya. Supaya gambar yang dibuat di sesi berbeda tetap senada, jalankan Ekstrak Warna pada gambar yang paling bagus lalu sebutkan warna-warna itu di prompt berikutnya.
💡 Urutan yang manjur: unduh dalam resolusi penuh → potong atau ubah ukurannya → ubah formatnya → kompres paling akhir. Mengompres sebelum mengubah ukuran membuang kualitas percuma.
Tiga contoh permintaan yang lengkap
Sebagai penutup, tiga permintaan yang ditulis dengan cara yang paling dimanfaatkan ChatGPT — perhatikan bahwa ketiganya menyebut tujuannya, teks persisnya, dan proporsinya. Ketiganya ditulis dalam bahasa Inggris dengan sengaja: model gambar dilatih terutama pada bahasa Inggris, jadi prompt berbahasa Inggris memberi hasil yang lebih stabil. Ganti saja teks di dalam tanda kutip dengan kata-kata yang Anda inginkan muncul di gambar.
Daftar periksa sebelum membuat gambar
- Sudahkah Anda menyebut untuk apa gambar itu, bukan sekadar apa isinya?
- Sudahkah proporsinya disebutkan?
- Apakah teks yang harus muncul sudah ditulis di dalam tanda kutip, lengkap dengan letaknya?
- Apakah strukturnya dijelaskan sebelum gayanya?
- Apakah batasannya ditulis dalam bentuk positif?
- Apakah Anda meminta perbaikan, bukan menulis ulang semuanya?
- Akankah Anda mengunduhnya dalam resolusi penuh, bukan lewat tangkapan layar?
Siapkan gambar Anda untuk diunggah
Gambar 2K gampang sekali melewati 5 MB. Pangkas ukurannya tanpa penurunan kualitas yang terlihat, langsung di browser.
Kompres gambar