Membuat gambar di ChatGPT bukan lagi fitur sampingan, melainkan salah satu hal yang paling baik dikerjakannya. Sejak April 2026, pembuatan gambar berjalan di ChatGPT Images 2.0, model bawaan yang menggantikan DALL·E untuk selamanya — dipensiunkan Mei tahun yang sama — dan yang akhirnya membereskan masalah paling membandel di semua AI gambar: menulis teks di dalam gambar tanpa salah huruf.

Itu mengubah jenis pekerjaan yang bisa dilakukan. Poster dengan judul yang terbaca, infografik dengan angka yang benar, sampul bernama merek, halaman komik berisi dialog, mockup kemasan berlabel — semuanya dulu keluar berantakan dan kini rapi pada sebagian besar percobaan.

Panduan ini membahas seluruh jalurnya: cara membuat gambar pertama, cara menulis prompt seperti yang paling dipahami ChatGPT, cara menyunting tanpa mengulang semuanya, cara menjaga karakter yang sama di beberapa gambar, apa bedanya paket gratis dan berbayar, serta apa yang belum bisa dikerjakannya dengan baik.

Apa yang berubah pada pembuatan gambar di ChatGPT

Sampai 2025, ChatGPT membuat gambar dengan memanggil DALL·E sebagai sistem terpisah: Anda menulis, ia menerjemahkan permintaan itu menjadi prompt internal, lalu mengirimkannya ke model lain. Hasilnya naik turun, sebab ada satu lapis penerjemahan di tengah jalan yang tidak bisa Anda kendalikan.

Sekarang model gambarnya sudah menyatu dan berbagi konteks dengan model bahasanya. Dalam praktiknya, ia memahami permintaan Anda sama seperti memahami pertanyaan teks: kalau Anda menulis "buatkan poster untuk kedai kopi yang buka pukul 7 pagi di Bandung", Anda tidak perlu merinci tiap elemen visualnya — ia sendiri yang menyimpulkan tata letak, urutan penekanan, dan isinya.

Tiga akibat praktisnya lebih penting daripada yang lain:

💡 Perlu diketahui: batas pembuatan gambar di paket gratis tidak pernah diumumkan resmi dan berubah mengikuti beban platformnya. Anggap angka apa pun yang Anda temukan di luar sana sebagai perkiraan, bukan aturan baku.

Cara membuat gambar pertama Anda, langkah demi langkah

Alurnya sesederhana mungkin — tidak ada panel terpisah maupun pengaturan awal yang wajib diisi.

  1. Buka percakapan baru. Tidak perlu memilih mode khusus apa pun; cukup minta saja.
  2. Jelaskan gambarnya dengan bahasa sehari-hari. Tulis seolah Anda sedang menjelaskan kepada seorang desainer, dalam kalimat utuh. Jangan memakai deretan kata yang dipisah koma: format itu milik alat lain dan di sini hasilnya lebih buruk.
  3. Sebutkan proporsinya. "Format vertikal untuk stories", "persegi untuk Instagram", "horizontal 16:9". Kalau tidak Anda sebutkan, ia yang memilih sendiri.
  4. Tunggu gambarnya jadi. Gambar butuh waktu lebih lama daripada jawaban teks, apalagi yang tata letaknya padat.
  5. Minta perbaikan di percakapan yang sama. "Gelapkan latarnya", "besarkan judulnya", "ganti warna jaketnya jadi merah". Ia mempertahankan gambarnya dan hanya mengubah yang Anda minta.
  6. Unduh dalam resolusi penuh. Pakai tombol unduh, bukan tangkapan layar — tangkapan layar menurunkan kualitas dan ukurannya mengikuti jendela Anda.

Butir terakhir itu lebih penting daripada kelihatannya. Banyak orang menyimpan gambar dengan klik kanan pada gambar kecilnya dan berakhir dengan file mungil yang sudah dikompres ulang.

Dua modenya: seketika dan bernalar

ChatGPT Images 2.0 bekerja dalam dua mode, dan memahami bedanya menghemat banyak kekecewaan.

Mode seketika membuat gambar langsung dari permintaan Anda. Cepat, tersedia di semua paket termasuk yang gratis, dan sudah cukup untuk gambar sederhana: satu adegan, satu potret, satu ilustrasi, satu latar.

Mode bernalar — si "thinking" — membuat modelnya menyusun rencana sebelum menggambar: ia menghitung jumlah objek, memeriksa batasan yang Anda minta, menata letaknya, dan bila perlu menelusuri web untuk membawa informasi terbaru ke dalam gambar. Mode inilah yang menghasilkan infografik yang benar, poster berisi data nyata, dan komposisi dengan banyak elemen yang tetap sejajar. Hanya tersedia di paket berbayar.

Dalam praktiknya: kalau permintaan Anda hanya satu adegan, mode seketika sudah cukup. Kalau ada hitungan ("tepat lima ikon"), urutan penekanan teks, atau data yang harus akurat, mode bernalar benar-benar terasa bedanya.

Cara menulis prompt yang paling dipahami ChatGPT

Di sinilah perbedaan terbesar ChatGPT dengan alat seperti Midjourney: ia lebih suka kalimat utuh daripada deretan tag. Menulis woman, 35 years old, gray blazer, office, 85mm, bokeh memang jalan, tapi hasilnya kalah dibanding keterangan yang sama ditulis dalam kalimat.

Mulai dari fungsi gambarnya, bukan dari deskripsinya

Menyebutkan untuk apa gambar itu mengubah seluruh hasilnya. "Poster promosi untuk lokakarya fotografi tanggal 12" menghasilkan sesuatu yang jauh lebih terpakai daripada "gambar berisi kamera dan tulisan". Modelnya memakai tujuan itu untuk menentukan urutan penekanan, ruang kosong, dan gaya.

Tulis teksnya persis, di dalam tanda kutip

Kalau gambarnya harus memuat kata-kata, tulis kata itu apa adanya di dalam tanda kutip: judulnya "Sarapan Pagi", subjudulnya "setiap Sabtu, pukul 08.00-11.00". Tanpa tanda kutip, modelnya bisa mengarang atau mengubah kalimatnya. Sebutkan juga letak tiap teks: di atas, di bawah, atau di sudut kanan bawah.

Jelaskan strukturnya sebelum gayanya

Urutan yang manjur adalah: apa yang tampil dan di mana → baru bagaimana rupanya. "Tiga kolom sama lebar, ikon di atas tiap kolom, judul di bawahnya, lalu satu paragraf pendek; gaya minimalis dengan latar krem dan huruf tanpa kait." Menyebut struktur lebih dulu sangat mengurangi pengulangan kerja.

Tegaskan apa yang tidak Anda inginkan

ChatGPT tidak punya kolom prompt negatif. Batasannya masuk ke dalam permintaan itu sendiri, dan paling manjur bila ditulis dalam bentuk positif: "komposisi bersih, tanpa tulisan apa pun selain judulnya" memberi hasil lebih baik daripada "tanpa tulisan".

Perbaiki bertahap, jangan menulis ulang

Inilah keunggulan terbesar antarmuka percakapan. Jangan menulis ulang prompt dari nol begitu ada yang meleset: minta perbaikannya. "Pertahankan semuanya, tapi ganti latarnya jadi biru dongker" menjaga bagian yang sudah bagus. Menulis ulang seluruh prompt justru menghasilkan gambar baru yang tak ada kaitannya dengan yang sebelumnya.

💡 Jalan pintas yang berguna: minta ChatGPT sendiri memperbaiki prompt Anda sebelum gambarnya dibuat. "Tulis ulang permintaan ini sebagai prompt gambar yang rinci, jangan buat gambarnya dulu" biasanya memunculkan detail yang belum terpikirkan.

Proporsi dan resolusi: apa yang harus diminta

Modelnya menerima rentang format yang luas, dari yang sangat lebar sampai sangat tinggi, dan menghasilkan gambar sampai 2K. Menentukan proporsi sebelum gambarnya dibuat menghindarkan pemotongan belakangan — dan pemotongan belakangan selalu memakan komposisi.

DestinoCara memintanyaProporsi
Linimasa Instagramformat persegi1:1
Linimasa vertikal / potretformat potret untuk linimasa4:5
Stories dan Reelsformat vertikal stories9:16
Thumbnail de YouTubeformat horizontal widescreen16:9
Banner situs webformat panoramik lebar3:1
Sampul e-bookformat vertikal sampul buku2:3
Wallpaper komputerformat horizontal widescreen16:9

Kalau Anda butuh resolusi tertentu — 1920 kali 1080, misalnya — buat gambarnya pada proporsi yang benar lalu sesuaikan belakangan lewat Ubah Ukuran. Meminta ukuran piksel yang persis di dalam prompt jarang dituruti apa adanya.

Menyunting gambar: perintah yang benar-benar jalan

Menyunting adalah bagian ketika ChatGPT unggul jauh atas alat yang hanya membuat gambar. Anda tidak butuh mask, layer, maupun seleksi — cukup jelaskan dengan kata-kata.

Mengubah satu elemen tertentu

"Pertahankan komposisinya dan ganti warna dindingnya saja jadi hijau sage." Makin tegas Anda menyebut apa yang harus tetap sama, makin sedikit yang diutak-atik modelnya. Kata "pertahankan" bekerja jauh lebih keras di sini daripada yang Anda duga.

Menambah atau membuang objek

"Buang tanaman di sudut kanan dan biarkan dindingnya polos." Cara ini rapi untuk objek yang batasnya jelas. Penghapusan di area yang latarnya penuh tekstur kadang meninggalkan bekas — dalam kasus itu, membuat gambarnya ulang biasanya lebih baik daripada memaksakan penyuntingan.

Mengganti gaya tanpa mengubah adegan

"Komposisi sama, elemen sama, tapi dengan gaya cat air." Berguna untuk mencoba beberapa bahasa visual tanpa kehilangan bingkai yang sudah Anda setujui.

Menyunting dari gambar milik Anda sendiri

Anda bisa mengunggah foto lalu meminta perubahan: mengganti latarnya, mengatur pencahayaan, mengubahnya jadi ilustrasi, atau membuat beberapa varian. Perlu diingat, hasilnya adalah gambar baru yang dibuat dari foto Anda, bukan suntingan piksel demi piksel atas aslinya.

Melebarkan bingkainya

"Lebarkan gambar ini ke format horizontal, lanjutkan pemandangannya ke samping secara alami." Ini padanan percakapan dari outpainting, dan menjawab kasus klasik: punya gambar vertikal yang harus jadi banner.

Cara menjaga karakter yang sama di beberapa gambar

Dulu inilah persoalan tersulit di AI gambar, dan sekarang jauh lebih bisa ditangani. Tiga pendekatan, dari yang paling gampang ke yang paling bisa diandalkan.

Lanjutkan di percakapan yang sama. Ini cara termudah sekaligus paling ampuh sehari-hari. Setelah karakternya jadi, minta adegan berikutnya tanpa mendeskripsikannya lagi: "sekarang tampilkan karakter yang sama sedang duduk di kedai kopi". Modelnya membawa konteks percakapan itu dan menjaga ciri-cirinya.

Tuliskan ciri-ciri yang tetap. Susun satu deskripsi pendek yang tidak pernah berubah — rambut, mata, busana khasnya, aksesori yang mencolok — lalu ulangi kata-kata yang persis sama di tiap permintaan. Sinonim justru mengacaukan: "jaket krem" dan "mantel warna pasir" menghasilkan dua pakaian berbeda.

Minta lembar acuan lebih dulu. Buat lembar karakter berisi wajah yang sama dari berbagai sudut dan ekspresi, lalu pakai gambar itu sebagai acuan di pembuatan berikutnya. Ini jalan yang paling merepotkan sekaligus paling konsisten, terutama untuk seri yang panjang.

Logika yang sama berlaku untuk produk dan identitas merek: makin tetap deskripsinya, makin stabil hasilnya.

Gratis atau berbayar: apa yang sebenarnya berbeda

Pembuatan gambar tersedia di semua paket, termasuk yang gratis. Yang berbeda adalah jumlahnya, kecepatannya, dan akses ke mode bernalar.

AspekPaket gratisPaket berbayar
Pembuatan gambarTersedia, mode seketikaTersedia, seketika dan bernalar
JumlahTerbatas, kuotanya tidak diumumkanJauh lebih banyak
KecepatanLebih lambat, bisa mengantreDiprioritaskan pada jam sibuk
Penelusuran web saat gambar dibuatTidakYa, di mode bernalar
Tata letak rumit dan infografikHasilnya naik turunJauh lebih bisa diandalkan
Rangkaian gambar yang konsistenTerbatasYa

Untuk pemakaian pribadi sesekali — satu wallpaper, satu ilustrasi untuk unggahan, satu gambar pendukung — paket gratis sudah menjawab. Untuk pekerjaan rutin yang melibatkan tata letak, teks, dan jumlah banyak, bedanya cepat terasa. Kalau Anda ingin membandingkan pilihan lain sebelum berlangganan, panduan AI terbaik untuk membuat gambar menyandingkan nama-nama utamanya, dan panduan Gemini untuk membuat gambar membahas alternatif terdekatnya.

Apa yang belum dikerjakan ChatGPT dengan baik

Mengetahui batasannya menghemat waktu. Tidak satu pun di antaranya disebabkan prompt yang buruk: semuanya batas alatnya sendiri.

Tujuh kesalahan yang paling merugikan

  1. Menulis dalam bentuk tag. Deretan kata yang dipisah koma adalah bahasa alat lain. Di sini, kalimat utuh memberi hasil lebih baik.
  2. Tidak menyebutkan proporsinya. Tanpa petunjuk, modelnya yang memilih — dan hampir selalu memilih format yang salah untuk keperluan Anda.
  3. Menulis ulang prompt di tiap percobaan. Anda kehilangan bagian yang sudah pas. Mintalah perbaikan yang spesifik saja.
  4. Membiarkan teksnya menggantung di permintaan. Tanpa tanda kutip dan tanpa penempatan, modelnya akan mengarang kalimat atau menaruhnya sesuka hati.
  5. Menyimpan lewat tangkapan layar. Resolusinya turun dan filenya dikompres ulang. Pakai tombol unduh.
  6. Meminta semuanya sekaligus. Prompt dengan sepuluh tuntutan sekaligus biasanya meleset di dua atau tiga di antaranya. Buat dasarnya dulu, lalu perbaiki bertahap.
  7. Langsung mengunggah tanpa dioptimalkan. Gambar 2K dalam PNG beratnya beberapa megabita dan menghancurkan kecepatan muat halaman mana pun.

Apa yang harus dilakukan setelah gambarnya jadi

Butir terakhir tadi layak diperinci, karena di situlah kebanyakan orang keliru. Gambar yang keluar dari ChatGPT siap dilihat, bukan siap diunggah.

Ubah ke format yang tepat. PNG hebat untuk transparansi dan buruk untuk foto di web. Untuk situs, WebP biasanya memangkas separuh ukurannya tanpa beda yang terlihat; untuk pengiriman biasa, JPG sudah cukup. Konversi mengerjakan penukaran itu langsung di browser, dan panduan format gambar membantu Anda memilih.

Pangkas ukurannya. Gambar 2K bisa lewat dari 5 MB. Kompres memotong sebagian besar beban itu tanpa penurunan yang terlihat — dan kalau filenya benar-benar besar, langkah demi langkah di cara memperkecil gambar dari MB ke KB membahas detailnya.

Pisahkan objeknya bila perlu. Untuk logo, produk, dan elemen yang akan ditaruh di atas latar berwarna, Hapus Latar lalu simpan sebagai PNG transparan adalah langkah yang masih kurang.

Perbaiki resolusi dan bingkainya. Kalau gambarnya keluar lebih kecil dari yang dibutuhkan, Anda bisa memperbesar resolusinya tanpa menurunkan kualitas. Kalau proporsinya meleset, Potong Gambar lebih menjaga isinya daripada menariknya jadi melar.

Manfaatkan paletnya. Supaya gambar yang dibuat di sesi berbeda tetap senada, jalankan Ekstrak Warna pada gambar yang paling bagus lalu sebutkan warna-warna itu di prompt berikutnya.

💡 Urutan yang manjur: unduh dalam resolusi penuh → potong atau ubah ukurannya → ubah formatnya → kompres paling akhir. Mengompres sebelum mengubah ukuran membuang kualitas percuma.

Tiga contoh permintaan yang lengkap

Sebagai penutup, tiga permintaan yang ditulis dengan cara yang paling dimanfaatkan ChatGPT — perhatikan bahwa ketiganya menyebut tujuannya, teks persisnya, dan proporsinya. Ketiganya ditulis dalam bahasa Inggris dengan sengaja: model gambar dilatih terutama pada bahasa Inggris, jadi prompt berbahasa Inggris memberi hasil yang lebih stabil. Ganti saja teks di dalam tanda kutip dengan kata-kata yang Anda inginkan muncul di gambar.

Create a vertical promotional poster for a photography workshop. The title should read "Natural Light" in large letters at the top, and below it, smaller, "Saturday, July 12 - 2pm to 6pm". Earthy-toned background with a thin-line camera silhouette. Minimalist style, sans-serif typography, plenty of empty space. Vertical stories format.
Generate a horizontal infographic with three equal columns explaining the stages of a process. Each column has a simple icon at the top, a short title and one supporting sentence. The titles are "Collect", "Analyze" and "Publish". Palette of navy blue, white and an orange accent. Clean editorial style, no shadows. Widescreen format.
Create a square product photo of a matte white cream jar on light stone, with fresh green leaves around it and a soft beige background. Diffused natural light coming from the left, frontal close-up, clean skincare aesthetic. No text in the image.

Daftar periksa sebelum membuat gambar

Siapkan gambar Anda untuk diunggah

Gambar 2K gampang sekali melewati 5 MB. Pangkas ukurannya tanpa penurunan kualitas yang terlihat, langsung di browser.

Kompres gambar

Pertanyaan yang sering diajukan

Bisakah membuat gambar di ChatGPT versi gratis?
Bisa. Pembuatan gambar tersedia di semua paket, termasuk yang gratis, lewat mode seketika. Yang berbeda adalah jumlah yang diizinkan, kecepatannya pada jam sibuk, dan akses ke mode bernalar yang hanya ada di paket berbayar. OpenAI tidak mengumumkan angka pasti untuk paket gratis, dan batas itu berubah mengikuti beban platformnya, jadi angka spesifik apa pun yang Anda temukan di luar sana sebaiknya dianggap perkiraan saja.
Apakah ChatGPT masih memakai DALL·E?
Tidak. Sejak April 2026, pembuatan gambar berjalan di ChatGPT Images 2.0, model bawaan yang menyatu dengan ChatGPT sendiri. DALL·E 2 dan DALL·E 3 dipensiunkan pada Mei 2026. Bedanya besar dalam praktik: karena model gambarnya berbagi konteks dengan model bahasanya, ia memahami permintaan Anda secara langsung, tanpa lapis penerjemahan di tengah jalan yang dulu membuat hasilnya naik turun.
Kenapa tulisan di gambar saya keluar salah?
Dua sebab menjelaskan hampir semua kasusnya. Pertama, teksnya tidak ditulis di dalam tanda kutip: tanpa itu modelnya membaca kata tersebut sebagai tema dan bisa mengubah kalimatnya. Kedua, teksnya kebanyakan — paragraf panjang dan padat masih lebih rawan meleset daripada judul dan kalimat pendek. Kalau teksnya memang penting dan tetap salah terus, jalan yang paling bisa diandalkan adalah membuat gambarnya tanpa tulisan lalu menambahkan kata-katanya belakangan di editor.
Berapa resolusi tertinggi gambarnya?
Modelnya menghasilkan gambar sampai 2K, dengan rentang proporsi yang luas, dari format sangat lebar sampai sangat tinggi. Itu sudah memadai untuk keperluan digital: media sosial, situs web, presentasi, dan thumbnail. Untuk cetakan berukuran besar atau wallpaper monitor 4K, gambarnya perlu diperbesar setelah jadi, dan itu berhasil baik selama gambarnya bersih dan tidak terlalu berdetail.
Bolehkah gambar yang saya buat dipakai untuk keperluan komersial?
Ketentuan pemakaian OpenAI mengizinkan gambar yang Anda buat dipakai secara komersial, tapi aturannya bisa berubah dan berbeda menurut paket serta negaranya. Lagi pula, boleh dipakai komersial tidak sama dengan terlindungi secara hukum: di banyak yurisdiksi, karya yang sepenuhnya dibuat mesin menghadapi batasan dalam pencatatan hak cipta. Sebelum memakainya di materi klien atau produk yang dijual, periksa ketentuan yang berlaku saat itu dan hindari permintaan yang menyangkut merek terdaftar, karakter berlisensi, atau orang sungguhan.
Bagaimana caranya agar ChatGPT membuat gambar berlatar transparan?
Sekalipun diminta dengan tegas, hasilnya biasanya tetap berlatar padat, bukan benar-benar transparan. Cara tercepat adalah meminta latar putih polos, yang paling mudah dipisahkan, lalu membuat transparansinya belakangan dengan menghapus latar itu dan menyimpannya sebagai PNG. Langkah itu hanya butuh beberapa detik dan hasilnya lebih bersih daripada memaksa modelnya, yang justru cenderung menggambar pola kotak-kotak untuk meniru transparansi.