Почти каждый, кто начинает создавать изображения с помощью ИИ, месяцами пытается улучшить результат одним лишь текстом промпта: меняет «красивый» на «потрясающий», добавляет «8K», «ультрадетализированно», «шедевр». А результат остаётся примерно тем же. Причина проста: значительная часть того, что определяет финальное изображение, находится не в тексте, а в параметрах.
Параметры — это числовые регуляторы, которые говорят модели, как рисовать, а не что рисовать. Соотношение сторон, насколько строго она следует вашему тексту, сколько этапов уточнения выполняет, какое случайное зерно использует, сколько эстетической свободы получает. Именно они отделяют того, кто генерирует десять случайных вариантов, от того, кто умеет осознанно повторять, корректировать и развивать изображение.
Это руководство — техническая справка по пяти параметрам, которые встречаются практически в каждом инструменте: соотношение сторон, seed, CFG, stylize и steps, — а также по нескольким смежным настройкам, которые стоит знать. Идея в том, чтобы вы могли возвращаться сюда всякий раз, когда нужно вспомнить, что делает каждое значение, в каком диапазоне его менять и что ломается при перегибе.
Почему параметры важнее прилагательных
Диффузионная модель начинает с чистого шума и шаг за шагом «очищает» его, пока не появится изображение. Промпт работает как карта до пункта назначения; параметры определяют дорогу, скорость и то, насколько водителю позволено импровизировать по пути.
Это объясняет, почему два одинаковых промпта дают совершенно разные изображения и почему добавление прилагательных часто ничего не меняет. Если модель и так слабо следует тексту (низкий CFG), новые слова не помогут — она попросту не уделяет им особого внимания. Если steps слишком мало, никакое прилагательное не спасёт текстуру изображения, потому что у модели не хватило итераций, чтобы проработать детали.
Привычка, которая отличает новичков от опытных пользователей, звучит так: меняйте по одному параметру за раз. Если вы меняете промпт, seed и CFG в одной попытке, вы не узнаете, что именно дало улучшение. Зафиксировав seed и меняя только CFG, вы изолируете переменную и действительно учитесь понимать поведение конкретной модели.
💡 Совет: прежде чем что-либо оптимизировать, сгенерируйте четыре изображения с одним промптом и настройками по умолчанию. Они показывают исходную точку модели. Только после этого начинайте менять значения — и всегда по одному.
Соотношение сторон: пропорция, определяющая кадр
Соотношение сторон — это отношение ширины к высоте изображения. В Midjourney оно записывается как --ar 16:9; в Stable Diffusion и производных вы задаёте ширину и высоту в пикселях; в ChatGPT и Gemini обычно достаточно попросить обычными словами («вертикальный формат 9:16»).
Это выглядит самым банальным параметром списка, но именно он сильнее всего влияет на композицию. Модель не просто кадрирует одну и ту же сцену в разные форматы — она перестраивает её. Портрет, запрошенный в 16:9, обычно превращается в средний план с широким фоном; тот же промпт в 2:3 даёт классический вертикальный крупный план. Пропорция меняет то, что ИИ считает «естественным кадром» для этой сцены.
Самые используемые значения и их назначение
| Пропорция | Типичное применение | Что обычно делает модель |
|---|---|---|
| 1:1 | Аватар, лента Instagram, иконка, превью товара | Центрирует объект, упрощает фон |
| 4:5 | Вертикальный пост в Instagram и Facebook | Средний план, объект хорошо заметен |
| 2:3 | Фотографический портрет, постер, обложка книги | Крупный или американский план, редакционный стиль |
| 9:16 | Stories, Reels, TikTok, обои для телефона | Вертикальная композиция, много места сверху и снизу |
| 16:9 | Превью YouTube, баннер, кинематографичная сцена | Общий план, пейзаж, окружающий контекст |
| 21:9 | Сверхширокий кинокадр, шапка сайта | Панорама, объект мелкий в кадре |
| 3:1 | Верхний баннер, обложка LinkedIn | Горизонтальная полоса; обычно требует очень точного промпта |
Частая ловушка: очень экстремальные пропорции (вроде 3:1 или 1:3) сбивают с толку модели, обученные преимущественно на изображениях, близких к квадрату. Типично появляется дублирование — два лица, две головы, повторяющиеся элементы по краям, — потому что модель пытается «заполнить» пространство, для которого у неё нет надёжного образца. В таких случаях безопаснее сгенерировать в 16:9, а затем воспользоваться обрезкой или расширением через outpainting, чтобы получить нужный формат.
Ещё один практический момент: генерировать сразу в правильной пропорции всегда лучше, чем обрезать потом. Обрезка отбрасывает пиксели и снижает полезное разрешение. Если вам нужно одно изображение в нескольких форматах, генерируйте в самом узком (обычно вертикальном) и адаптируйте остальные через контролируемое изменение размера.
Seed: число, которое делает результат воспроизводимым
Seed — это целое число, инициализирующее случайный шум, из которого рождается изображение. Тот же промпт + тот же seed + те же параметры + та же модель = то же изображение, пиксель в пиксель. Изменили seed — изменилось всё.
Вероятно, это самый недооценённый параметр среди новичков и самый важный для тех, кто работает с ИИ профессионально. Без контроля над seed вы не можете итеративно улучшать — вы можете только бросать кубик заново.
Практических применений три:
- Доработать почти удачный результат. Композиция идеальна, но цвет не тот. Зафиксируйте seed, поменяйте в промпте только слово, обозначающее цвет, и сгенерируйте снова. Структура изображения в основном сохранится, изменится лишь заменённый элемент.
- Честно сравнивать параметры. Хотите узнать, лучше ли CFG 7, чем CFG 11, для вашего промпта? Зафиксируйте seed и сгенерируйте оба варианта. Без фиксированного seed вы сравниваете два разных изображения, а не два значения CFG.
- Единообразие внутри серии. В каталоге товаров, серии иллюстраций или фирменном стиле сохранение seed помогает удержать визуальный «почерк» набора.
Важно понимать одно ограничение: seed привязан к конкретной модели и её версии. Seed 42 в SDXL не даст ничего похожего на seed 42 в Flux. Сменили модель — старые seed превращаются в бессмысленные числа. Поэтому всегда записывайте модель + версию + seed вместе, никогда только seed.
💡 Совет: когда генерация удалась, сразу сохраните полный набор: промпт, негативный промпт, seed, CFG, steps, сэмплер, модель и пропорцию. Простая таблица с этими столбцами ценнее любой коллекции разрозненных изображений — без этих данных отличный результат невоспроизводим.
Шкала CFG: насколько строго ИИ следует вашему промпту
CFG расшифровывается как Classifier-Free Guidance, и шкала CFG определяет вес, который модель придаёт вашему тексту по сравнению с тем, что она «хотела бы» нарисовать сама. На практике это регулятор послушания.
Низкие значения оставляют модель свободной и творческой, но она начинает игнорировать части промпта. Высокие значения заставляют следовать тексту буквально, но изображение становится перенасыщенным, с жёсткими контурами, преувеличенным контрастом и искусственным видом — так называемый «пережаренный» результат.
| Диапазон CFG | Поведение | Когда использовать |
|---|---|---|
| 1–3 | Почти игнорирует промпт; непредсказуемо и эфемерно | Художественный поиск, абстрактные текстуры |
| 4–6 | Свободная интерпретация, мягкие цвета, естественный вид | Фотореализм, портреты, органичные сцены |
| 7–9 | Баланс послушания и естественности — диапазон по умолчанию | Общее применение; рекомендуемая отправная точка |
| 10–14 | Сильное следование тексту, более насыщенные цвета | Иллюстрация, графический дизайн, точные композиции |
| 15+ | Перенасыщение, артефакты, жёсткие края, искажения | Редко полезно; только в особых случаях |
Деталь, которая многих сбивает: у новых моделей другие диапазоны. Flux, например, работает по собственной шкале guidance, где нормальны значения от 2 до 4 — поставить там 7 уже много. Turbo- и дистиллированные модели, рассчитанные на малое число steps, обычно требуют CFG от 1 до 2. То есть универсального числа не существует, есть правильное число для конкретной модели. Всегда сверяйтесь с рекомендацией того, кто опубликовал чекпоинт, прежде чем считать 7 значением по умолчанию.
Практический признак слишком высокого CFG: пластиковая кожа, неоновые цвета, тёмный ореол вокруг контуров, агрессивно повторяющийся текст или узоры. Признак слишком низкого CFG: изображение красивое, но половины того, что вы просили, в нём нет.
Stylize: собственная эстетика модели
Параметр --stylize (или --s) характерен для Midjourney и определяет, насколько сильно модель накладывает собственное художественное чутьё на ваш запрос. Концептуально это почти противоположность CFG: вместо послушания тексту он измеряет эстетическую свободу.
Шкала идёт от 0 до 1000, значение по умолчанию — 100. На практике:
- 0–50: буквально. Модель рисует ровно то, что вы описали, ничего не «улучшая». Полезно для схем, технических референсов, макетов и всего, где точность важнее красоты.
- 100–250: баланс. Хорошая композиция и палитра без отклонения от задания. Этот диапазон закрывает большинство задач.
- 250–750: модель берёт инициативу. Драматичный свет, смелые палитры, более художественные композиции. Отлично для постеров, концепт-арта и обложек.
- 750–1000: стиль превыше всего. Изображение получается красивым и часто далёким от вашего запроса. Хорошо для творческого поиска, плохо при жёстком задании.
Есть родственный параметр, который часто путают с этим: --chaos (или --c, от 0 до 100). Он управляет разнообразием между четырьмя изображениями одной выдачи, а не стилем каждого. Высокий chaos даёт четыре радикально разные трактовки одного промпта — отлично для первичного мозгового штурма, плохо, когда вы уже знаете, чего хотите. Есть ещё --weird, который добавляет намеренную странность и подходит скорее для экспериментов, чем для клиентской работы.
За пределами Midjourney прямого аналога stylize нет. Похожего эффекта добиваются иначе: стилевые LoRA, эстетические ключевые слова в промпте или тонкая настройка CFG. Понятие всё равно стоит знать, потому что логика «сколько собственного характера может добавить модель» проявляется в том или ином виде почти в каждом инструменте.
Steps: сколько итераций выполняет модель
Steps (шаги сэмплирования) — это количество этапов удаления шума. Каждый шаг приближает изображение к финальному результату. Больше steps означает больше времени обработки и — до определённого предела — больше детализации.
Ключевое здесь — до определённого предела. У этого параметра очень наглядная убывающая отдача: разница между 10 и 25 steps огромна; между 30 и 60 — едва заметна; выше 80 практически неразличима, и вы просто тратите время и энергию.
| Steps | Результат | Примечание |
|---|---|---|
| 1–8 | Работает только на turbo/дистиллированных моделях | На обычных получается размыто и незавершённо |
| 10–20 | Быстрый черновик, чёткие формы, слабая детализация | Хорошо для проверки композиции и промпта |
| 25–35 | Качество для публикации в большинстве случаев | Рекомендуемый диапазон по умолчанию |
| 40–60 | Незначительный выигрыш на очень сложных сценах | Оправданно только при множестве элементов |
| 80+ | Заметного выигрыша нет | Пустая трата времени и вычислений |
Steps и сэмплер связаны напрямую. Сэмплеры типа DPM++ 2M Karras сходятся быстро и дают хороший результат примерно на 25 steps. Сэмплеры вроде Euler a (ancestral) не сходятся полностью: изображение продолжает меняться по мере роста steps, что может быть хорошо (больше вариаций для поиска) или плохо (мешает воспроизводимости). Если цель — стабильность, выбирайте не-ancestral сэмплеры.
Практическое решение для рабочего процесса: ведите первичный поиск на малых steps (15–20), чтобы быстро проверить десятки промптов, и пересоздавайте только финальную версию с победившим seed на 30–40 steps. Это экономит много времени по сравнению с генерацией всего сразу в максимальном качестве.
Смежные параметры, которые тоже стоит знать
Помимо пяти основных, часто встречаются настройки, решающие конкретные задачи:
- Негативный промпт: список того, чего вы не хотите видеть (деформированные руки, водяной знак, текст, низкое качество). Есть в Stable Diffusion и производных; в Midjourney существует как
--no. Одна из самых результативных настроек при минимуме усилий — стоит прочитать отдельное руководство по негативным промптам. - Denoising strength: в режиме image-to-image определяет, насколько сильно изменится исходное изображение. Значения около 0,2 дают тонкую ретушь; выше 0,7 от оригинала остаётся лишь смутная подсказка композиции.
- Вес референсного изображения (
--iwв Midjourney): насколько загруженное изображение весит по сравнению с текстом. Критично для консистентности персонажа. - Сэмплер / планировщик: алгоритм, выполняющий удаление шума. Меняет скорость сходимости и финальную текстуру; DPM++ 2M Karras и DDIM — безопасный выбор.
- Tile / seamless: создаёт текстуры, повторяющиеся без швов, для узоров и фонов.
- Версия модели (
--vв Midjourney): у разных версий своя эстетика и свои диапазоны параметров. Смена версии обесценивает прежние seed.
Какие параметры доступны в каждом инструменте
Названия сильно различаются между платформами, и это источник большей части путаницы. Таблица сопоставляет эквиваленты:
| Инструмент | Соотношение сторон | Seed | CFG / guidance | Steps | Stylize |
|---|---|---|---|---|---|
| Midjourney | --ar 16:9 | --seed 1234 | Недоступен | Недоступен | --s 100 |
| Stable Diffusion / ComfyUI | Ширина × высота | Поле Seed | CFG Scale | Sampling steps | Через LoRA или промпт |
| Flux | Ширина × высота | Поле Seed | Guidance (2–4) | Обычно 20–30 | Через LoRA или промпт |
| ChatGPT / GPT Image | Обычный язык | Недоступен | Недоступен | Недоступен | Через промпт |
| Gemini / Nano Banana | Обычный язык | Недоступен | Недоступен | Недоступен | Через промпт |
| Leonardo AI | Пресеты + свои значения | Поле Seed | Guidance Scale | Да | Пресеты стиля |
Обратите внимание на закономерность: чем больше инструмент ориентирован на конечного пользователя (ChatGPT, Gemini), тем меньше параметров он открывает — платформа решает за вас. Чем ближе к «сырой» модели (ComfyUI, Automatic1111), тем больше контроля. Ни один из подходов не лучше: они решают разные задачи. Если ваша работа зависит от повторяемости результатов, вам в итоге понадобится инструмент, открывающий seed и CFG.
Как параметры взаимодействуют: рецепты по задачам
Параметры не работают изолированно. Эти сочетания — проверенные отправные точки, подстраивайте их под свою модель:
| Задача | Пропорция | CFG | Steps | Примечание |
|---|---|---|---|---|
| Фотореалистичный портрет | 2:3 или 4:5 | 4–6 | 30 | Низкий CFG спасает от пластиковой кожи |
| Фото товара | 1:1 | 7–9 | 30–35 | Нейтральный фон в промпте |
| Превью для YouTube | 16:9 | 9–12 | 25 | Высокий CFG для насыщенных цветов |
| Иллюстрация / концепт-арт | 16:9 или 21:9 | 7–10 | 30 | Высокий stylize в Midjourney |
| Логотип и бренд | 1:1 | 8–12 | 30 | Низкий stylize ради точности |
| Обои для телефона | 9:16 | 6–9 | 35 | Оставьте место под иконки |
| Быстрая проверка промпта | 1:1 | 7 | 15 | Только чтобы проверить идею |
Логика за этими решениями единая: фотореализм требует низкого CFG (модель и так знает, как выглядит фотография, а принуждение всё портит); графический дизайн и рекламные материалы требуют высокого CFG (вам нужны именно эти элементы именно в этих цветах); а steps растут только тогда, когда в сцене много мелких деталей, конкурирующих за место.
Частые ошибки и как их исправить
- Менять всё сразу. Новый промпт, новый seed, новый CFG. Результат стал лучше, но вы не знаете почему — и не сможете это повторить. Одна переменная на тест.
- Повышать steps, чтобы решить задачу, которая к steps не относится. Деформированная рука, неверная анатомия или пропавший объект не лечатся итерациями; это проблемы промпта, модели или экстремальной пропорции.
- Копировать CFG из старого руководства. Значение, рекомендованное для SD 1.5 в 2023 году, может быть катастрофой во Flux или SDXL. У каждого семейства моделей свой диапазон.
- Игнорировать seed. Без него каждая попытка — новый бросок кубика, и вы никогда не строите на том, что уже сработало.
- Сразу брать экстремальные пропорции. Вместо 3:1 напрямую сгенерируйте 16:9 и расширьте через outpainting: меньше дублирования и артефактов.
- Путать разрешение с качеством. Генерация значительно выше разрешения обучения обычно приводит к дублированию объектов. Лучше генерировать в родном разрешении и увеличивать потом.
- Ничего не записывать. Идеальное изображение, которое вы не можете воспроизвести, — это случайность, а не результат.
Короткий чек-лист перед генерацией
- Выбирайте пропорцию по конечному назначению изображения, а не по настройке инструмента по умолчанию.
- Начинайте со значений модели по умолчанию — и проверяйте, какие они, потому что они различаются.
- Сделайте дешёвый тест: мало steps, четыре варианта, только чтобы проверить направление.
- Выберите лучший вариант и запишите seed.
- С зафиксированным seed меняйте по одному параметру, пока не попадёте в цель.
- Пересоздайте финальную версию с рабочими steps (30–40).
- Зафиксируйте промпт, негатив, seed, CFG, steps, сэмплер, модель и пропорцию.
- Выполните постобработку: апскейл, обрезку, повышение резкости и сжатие для веба.
После генерации: этап, который почти все пропускают
Изображение, созданное ИИ, редко готово к публикации. Обычно это тяжёлый PNG в родном разрешении модели, без точной обрезки под ваш канал. Именно этот финальный этап отделяет картинку, которая «выглядит как ИИ», от изображения, которое просто работает на вашем сайте или в профиле.
Базовый порядок постобработки короткий: поправьте кадр обрезкой, если финальная пропорция не совпадает точно; приведите к нужным размерам через изменение размера; верните мелкие детали повышением резкости, если изображение увеличивалось; и напоследок переведите в WebP и сожмите сжатием изображений, потому что PNG весом 4 МБ вверху страницы обрушивает PageSpeed независимо от того, насколько хороша сама картинка.
Если изображение станет частью фирменного стиля, путь продолжается в других инструментах: извлеките палитру через генератор палитры цветов, чтобы сохранить согласованность между элементами, и воспользуйтесь созданием логотипа с ИИ, когда речь идёт о бренде.
Приведите изображения ИИ к нужному формату
Когда параметры подобраны, задайте изображению точные размеры под его назначение — бесплатно, прямо в браузере и без отправки на сервер.
Изменить размер изображения