Создание изображений в ChatGPT перестало быть второстепенной функцией и стало одной из сильных сторон инструмента. С апреля 2026 года генерация изображений работает на ChatGPT Images 2.0 — нативной модели, окончательно заменившей DALL·E (выведенный из эксплуатации в мае того же года), — которая решила самую упорную проблему всех ИИ для изображений: написание текста внутри картинки без ошибок в буквах.
Это меняет то, что можно сделать. Плакат с читаемым заголовком, инфографика с правильными числами, обложка с названием бренда, страница комикса с репликами, мокап упаковки с этикеткой — раньше всё это получалось криво, а теперь выходит чисто в большинстве попыток.
Это руководство охватывает весь путь: как создать первое изображение, как писать промпт так, чтобы ChatGPT лучше его понимал, как редактировать без полной регенерации, как сохранять одного и того же персонажа между изображениями, что меняется между бесплатным и платным планом, и что инструмент пока делает плохо.
Что изменилось в генерации изображений ChatGPT
До 2025 года ChatGPT генерировал изображения, вызывая DALL·E как отдельную систему: вы писали запрос, он переводил его во внутренний промпт и отправлял в другую модель. Результат был нестабильным, потому что посередине происходил перевод, который вы не контролировали.
Сегодня модель изображений нативна и разделяет контекст с языковой моделью. На практике это значит, что она понимает запрос так же, как понимает текстовый вопрос: если вы скажете «сделай плакат для кофейни, открывающейся в 7 утра в Порту-Алегри», ей не нужно, чтобы вы описывали каждый визуальный элемент — она сама выводит макет, иерархию и содержание.
Три практических следствия важнее остальных:
- Текст внутри изображения работает. Заголовки, абзацы, этикетки, подписи и даже текст на нескольких языках получаются читаемыми. Это было главной ахиллесовой пятой ИИ для изображений.
- Сложный макет стал возможен. Инфографика, развороты журналов, карточки персонажей и страницы с несколькими панелями перестали быть делом случая.
- Согласованность между изображениями улучшилась. Можно сгенерировать набор изображений, сохраняя одного и того же персонажа или один и тот же товар.
💡 Стоит знать: лимиты генерации изображений на бесплатном плане официально не раскрываются и меняются в зависимости от нагрузки на платформу. Относитесь к любому найденному числу как к оценке, а не как к жёсткому правилу.
Как сгенерировать первое изображение, шаг за шагом
Процесс максимально прост — нет отдельной панели или обязательной предварительной настройки.
- Откройте новый диалог. Не нужно выбирать никакой специальный режим — просто попросите.
- Опишите изображение на естественном языке. Пишите так, будто объясняете дизайнеру, полными предложениями. Не используйте список слов через запятую: этот формат для других инструментов, здесь он даёт худший результат.
- Укажите пропорции. «Вертикальный формат для сторис», «квадрат для Instagram», «горизонтальный 16:9». Если не укажете, модель выберет сама.
- Дождитесь генерации. Изображения занимают больше времени, чем текстовые ответы, особенно с плотным макетом.
- Просите правки прямо в диалоге. «Сделай фон темнее», «увеличь заголовок», «поменяй цвет пиджака на красный». Модель сохраняет изображение и меняет только то, что вы попросили.
- Скачивайте в полном разрешении. Используйте кнопку загрузки, а не скриншот — скриншот теряет качество и получается в размере вашего окна.
Этот последний пункт важнее, чем кажется. Многие сохраняют изображение, кликая правой кнопкой по миниатюре, и получают маленький пересжатый файл.
Два режима: мгновенный и с рассуждением
ChatGPT Images 2.0 работает в двух режимах, и понимание разницы избавляет от разочарования.
Мгновенный режим генерирует прямо из вашего запроса. Он быстрый, доступен на всех планах, включая бесплатный, и хорошо подходит для простых изображений: сцены, портрета, иллюстрации, фона.
Режим с рассуждением — «thinking» — заставляет модель планировать перед отрисовкой: она проверяет количество объектов, сверяет заданные вами ограничения, организует макет и, при необходимости, ищет в вебе, чтобы принести актуальную информацию в изображение. Именно этот режим даёт корректную инфографику, плакат с реальными данными и композицию с множеством выровненных элементов. Он ограничен платными планами.
На практике: если ваш запрос содержит одну сцену, достаточно мгновенного режима. Если есть подсчёт («ровно пять иконок»), иерархия текста или данные, которые должны быть точными, режим с рассуждением даёт реальную разницу.
Как писать промпты, которые ChatGPT понимает лучше
Вот главное отличие ChatGPT от таких инструментов, как Midjourney: он предпочитает прозу списку тегов. Написать «женщина, 35 лет, серый пиджак, офис, 85мм, боке» работает, но даёт худший результат, чем та же информация в виде предложений.
Начните с функции изображения, а не с описания
Указание назначения меняет весь результат. «Рекламный плакат для мастер-класса по фотографии 12 числа» даёт гораздо более пригодный результат, чем «изображение с камерой и текстом». Модель использует назначение, чтобы определить иерархию, пространство и стиль.
Пишите точный текст в кавычках
Когда изображению нужны слова, пишите их дословно и в кавычках: заголовок «Завтрак», подзаголовок «каждую субботу с 8 до 11 утра». Без кавычек модель может перефразировать или придумать своё. И укажите, где размещается каждый текст: сверху, внизу, в нижнем правом углу.
Опишите структуру прежде стиля
Рабочий порядок: что появляется и где → затем как это выглядит. «Три одинаковые колонки, иконка сверху в каждой, заголовок под ней и короткий абзац внизу; минималистичный стиль с бежевым фоном и шрифтом без засечек». Структура в первую очередь даёт гораздо меньше переделок.
Явно указывайте, чего не хотите
У ChatGPT нет поля для негативного промпта. Ограничение включается прямо в сам запрос, и лучше всего работает в утвердительной форме: «чистая композиция, без какого-либо текста, кроме заголовка» даёт лучший результат, чем «без текста».
Дорабатывайте, а не переписывайте заново
Это главное преимущество диалогового интерфейса. Не переписывайте промпт с нуля, когда что-то получилось не так: попросите исправление. «Оставь всё, но поменяй фон на тёмно-синий» сохраняет то, что уже было хорошо. Переписывание всего промпта заново создаёт новое изображение, не связанное с предыдущим.
💡 Полезный приём: попросите сам ChatGPT улучшить ваш промпт перед генерацией. «Перепиши этот запрос как подробный промпт для изображения, пока ничего не генерируя» часто раскрывает детали, о которых вы не подумали.
Пропорции и разрешение: что указывать
Модель принимает широкий диапазон форматов — от сверхширокоформатных до сверхвысоких — и генерирует до 2K. Указание пропорций до генерации избавляет от обрезки потом, а обрезка всегда стоит части композиции.
| Назначение | Как указать | Пропорции |
|---|---|---|
| Лента Instagram | квадратный формат | 1:1 |
| Вертикальная лента / портрет | портретный формат для ленты | 4:5 |
| Сторис и Reels | вертикальный формат сторис | 9:16 |
| Превью YouTube | широкоформатный горизонтальный | 16:9 |
| Баннер сайта | широкий панорамный формат | 3:1 |
| Обложка электронной книги | вертикальный формат обложки книги | 2:3 |
| Обои для рабочего стола | широкоформатный горизонтальный | 16:9 |
Если вам нужно конкретное разрешение — например, 1920 на 1080 — сгенерируйте в правильных пропорциях и настройте потом с помощью инструмента изменения размера изображения. Запрос точных размеров в пикселях внутри промпта редко соблюдается буквально.
Редактирование изображений: работающие команды
Редактирование — область, где ChatGPT выделяется на фоне инструментов чистой генерации. Не нужна маска, слой или выделение — просто опишите словами.
Изменить конкретный элемент
«Сохрани композицию и поменяй только цвет стены на шалфейно-зелёный». Чем явнее вы укажете, что должно остаться прежним, тем меньше модель тронет остальное. Слово «сохрани» здесь делает удивительно много.
Добавить или убрать объекты
«Убери растение в правом углу и оставь стену гладкой». Хорошо работает с чётко очерченными объектами. Удаление в областях с сильной фоновой текстурой иногда оставляет следы — в этом случае генерация заново обычно даёт лучший результат, чем настаивать на правке.
Поменять стиль, сохранив сцену
«Та же композиция, те же элементы, но в стиле акварели». Полезно для тестирования разных визуальных языков, не теряя кадрирование, которое вы уже одобрили.
Редактировать на основе вашего изображения
Вы можете отправить фото и попросить изменения: сменить фон, настроить освещение, превратить в иллюстрацию, создать вариации. Стоит помнить, что результат — новое изображение, сгенерированное на основе вашего, а не попиксельная правка оригинала.
Расширить кадр
«Расширь это изображение до горизонтального формата, естественно продолжив сцену по бокам». Это диалоговый эквивалент аутпейнтинга, решающий классический случай, когда вертикальное изображение нужно превратить в баннер.
Как сохранить одного и того же персонажа в нескольких изображениях
Это была самая сложная проблема ИИ для изображений, и теперь она стала гораздо более решаемой. Три подхода, от самого простого до самого надёжного.
Продолжать в том же диалоге. Самый простой и самый эффективный в повседневном использовании метод. После создания персонажа попросите следующую сцену, не переописывая его: «теперь покажи того же персонажа сидящим в кафе». Модель загружает контекст диалога и сохраняет черты.
Описать фиксированные черты письменно. Составьте короткое неизменное описание — волосы, глаза, характерная одежда, заметный аксессуар — и повторяйте точно те же слова в каждом запросе. Синонимы мешают: «бежевое пальто» и «пальто цвета песка» дадут разные вещи.
Сначала запросить референс-лист. Сгенерируйте карточку персонажа с одним и тем же лицом под разными углами и с разными выражениями и используйте это изображение как референс в последующих генерациях. Это самый трудоёмкий и самый согласованный путь, особенно для длинных серий.
Та же логика применима к товарам и фирменному стилю: чем более фиксировано описание, тем стабильнее результат.
Бесплатно или платно: что на самом деле меняется
Генерация изображений доступна на всех планах, включая бесплатный. Меняется объём, скорость и доступ к режиму с рассуждением.
| Аспект | Бесплатный план | Платные планы |
|---|---|---|
| Генерация изображений | Доступна, мгновенный режим | Доступна, мгновенный и с рассуждением |
| Объём | Ограничен, квота не раскрывается | Значительно выше |
| Скорость | Медленнее, возможна очередь | Приоритет в часы пик |
| Поиск в вебе во время генерации | Нет | Да, в режиме с рассуждением |
| Сложные макеты и инфографика | Нестабильный результат | Значительно надёжнее |
| Согласованные наборы изображений | Ограниченно | Да |
Для случайного личного использования — обои, иллюстрация для поста, вспомогательное изображение — бесплатного плана достаточно. Для постоянной работы с макетом, текстом и объёмом разница проявляется быстро. Если хотите сравнить с другими вариантами перед подпиской, руководство по лучшим ИИ для создания изображений ставит главные имена рядом друг с другом, а руководство по Gemini для создания изображений охватывает главную альтернативу.
Что ChatGPT пока делает плохо
Знание ограничений экономит время. Ни одно из них не является дефектом промпта — это границы инструмента.
- Реальные люди. Генерация изображений узнаваемых людей, особенно публичных фигур, заблокирована. Переформулировка запроса не поможет.
- Бренды и лицензированные персонажи. Логотипы существующих компаний и персонажи, защищённые авторским правом, тоже отклоняются.
- Настоящий вектор. Вывод всегда растровый, в пикселях. Если нужен редактируемый файл в кривых, результат служит референсом для перерисовки, а не финальным файлом.
- Надёжный прозрачный фон. Даже при запросе изображение обычно приходит со сплошным фоном. Прозрачность быстрее решить потом, удалив фон.
- Разрешение выше 2K. Для крупной печати или монитора 4K нужно увеличивать изображение потом.
- Точное воспроизведение вашего фото. При редактировании отправленного изображения модель пересоздаёт сцену. Тонкие детали оригинала меняются.
Семь ошибок, мешающих больше всего
- Писать в формате тегов. Список слов через запятую — язык других инструментов. Здесь проза даёт лучший результат.
- Не указывать пропорции. Без указания модель выбирает сама — и почти всегда выбирает неправильный формат для вашей задачи.
- Переписывать промпт при каждой попытке. Вы теряете то, что уже получилось хорошо. Просите точечные исправления.
- Оставлять текст без оформления в запросе. Без кавычек и позиции модель перефразирует или размещает где захочет.
- Сохранять через скриншот. Теряется разрешение и добавляется пересжатие. Используйте загрузку.
- Просить всё сразу. Промпты с десятью одновременными требованиями обычно проваливают два-три из них. Сгенерируйте основу и дорабатывайте поэтапно.
- Публиковать напрямую без оптимизации. Изображение 2K в PNG весит несколько мегабайт и замедляет загрузку любой страницы.
Что делать с изображением после генерации
Этот последний пункт заслуживает подробностей, потому что именно здесь большинство ошибается. Изображение, полученное из ChatGPT, готово к просмотру, но не к публикации.
Конвертируйте в правильный формат. PNG отлично подходит для прозрачности и плохо для фото в вебе. Для сайта WebP обычно сокращает вес вдвое без заметной разницы; для обычной отправки подойдёт JPG. Инструмент конвертации изображений делает замену прямо в браузере, а руководство по форматам изображений поможет выбрать.
Уменьшите вес. Изображение в 2K может превышать 5 МБ. Инструмент сжатия изображений убирает значительную часть этого веса без заметной потери качества — а если файл действительно большой, пошаговое руководство как уменьшить изображение с МБ до КБ раскрывает детали.
Выделите объект при необходимости. Для логотипов, товаров и элементов, размещаемых на цветном фоне, удаление фона и сохранение в прозрачном PNG — недостающий шаг.
Настройте разрешение и кадрирование. Если изображение получилось меньше нужного, можно увеличить разрешение без потери качества. Если пропорции неправильные, обрезка сохраняет больше деталей, чем растягивание.
Используйте палитру. Чтобы сохранить визуальную согласованность между изображениями, созданными в разных сессиях, извлеките цвета из лучшего варианта и указывайте эти тона в следующих промптах.
💡 Рабочий порядок действий: скачайте в полном разрешении → обрежьте или измените размер → конвертируйте формат → сожмите в последнюю очередь. Сжатие перед изменением размера впустую тратит качество.
Три примера полных запросов
В завершение — три запроса, написанные так, как ChatGPT использует их лучше всего: обратите внимание, что все они указывают назначение, точный текст и пропорции.
Чек-лист перед генерацией
- Вы указали назначение изображения, а не только то, что на нём изображено?
- Пропорции указаны?
- Текст, который должен появиться, в кавычках, с указанной позицией?
- Структура описана прежде стиля?
- Ограничения написаны в утвердительной форме?
- Вы просите исправление, а не переписываете всё заново?
- Собираетесь скачивать в полном разрешении, а не через скриншот?
Подготовьте изображения к публикации
Изображения, созданные в 2K, легко превышают 5 МБ. Уменьшите вес без заметной потери качества прямо в браузере.
Сжать изображение