Почти каждый, кто начинает создавать изображения с помощью ИИ, месяцами пытается улучшить результат одним лишь текстом промпта: меняет «красивый» на «потрясающий», добавляет «8K», «ультрадетализированно», «шедевр». А результат остаётся примерно тем же. Причина проста: значительная часть того, что определяет финальное изображение, находится не в тексте, а в параметрах.

Параметры — это числовые регуляторы, которые говорят модели, как рисовать, а не что рисовать. Соотношение сторон, насколько строго она следует вашему тексту, сколько этапов уточнения выполняет, какое случайное зерно использует, сколько эстетической свободы получает. Именно они отделяют того, кто генерирует десять случайных вариантов, от того, кто умеет осознанно повторять, корректировать и развивать изображение.

Это руководство — техническая справка по пяти параметрам, которые встречаются практически в каждом инструменте: соотношение сторон, seed, CFG, stylize и steps, — а также по нескольким смежным настройкам, которые стоит знать. Идея в том, чтобы вы могли возвращаться сюда всякий раз, когда нужно вспомнить, что делает каждое значение, в каком диапазоне его менять и что ломается при перегибе.

Почему параметры важнее прилагательных

Диффузионная модель начинает с чистого шума и шаг за шагом «очищает» его, пока не появится изображение. Промпт работает как карта до пункта назначения; параметры определяют дорогу, скорость и то, насколько водителю позволено импровизировать по пути.

Это объясняет, почему два одинаковых промпта дают совершенно разные изображения и почему добавление прилагательных часто ничего не меняет. Если модель и так слабо следует тексту (низкий CFG), новые слова не помогут — она попросту не уделяет им особого внимания. Если steps слишком мало, никакое прилагательное не спасёт текстуру изображения, потому что у модели не хватило итераций, чтобы проработать детали.

Привычка, которая отличает новичков от опытных пользователей, звучит так: меняйте по одному параметру за раз. Если вы меняете промпт, seed и CFG в одной попытке, вы не узнаете, что именно дало улучшение. Зафиксировав seed и меняя только CFG, вы изолируете переменную и действительно учитесь понимать поведение конкретной модели.

💡 Совет: прежде чем что-либо оптимизировать, сгенерируйте четыре изображения с одним промптом и настройками по умолчанию. Они показывают исходную точку модели. Только после этого начинайте менять значения — и всегда по одному.

Соотношение сторон: пропорция, определяющая кадр

Соотношение сторон — это отношение ширины к высоте изображения. В Midjourney оно записывается как --ar 16:9; в Stable Diffusion и производных вы задаёте ширину и высоту в пикселях; в ChatGPT и Gemini обычно достаточно попросить обычными словами («вертикальный формат 9:16»).

Это выглядит самым банальным параметром списка, но именно он сильнее всего влияет на композицию. Модель не просто кадрирует одну и ту же сцену в разные форматы — она перестраивает её. Портрет, запрошенный в 16:9, обычно превращается в средний план с широким фоном; тот же промпт в 2:3 даёт классический вертикальный крупный план. Пропорция меняет то, что ИИ считает «естественным кадром» для этой сцены.

Самые используемые значения и их назначение

ПропорцияТипичное применениеЧто обычно делает модель
1:1Аватар, лента Instagram, иконка, превью товараЦентрирует объект, упрощает фон
4:5Вертикальный пост в Instagram и FacebookСредний план, объект хорошо заметен
2:3Фотографический портрет, постер, обложка книгиКрупный или американский план, редакционный стиль
9:16Stories, Reels, TikTok, обои для телефонаВертикальная композиция, много места сверху и снизу
16:9Превью YouTube, баннер, кинематографичная сценаОбщий план, пейзаж, окружающий контекст
21:9Сверхширокий кинокадр, шапка сайтаПанорама, объект мелкий в кадре
3:1Верхний баннер, обложка LinkedInГоризонтальная полоса; обычно требует очень точного промпта

Частая ловушка: очень экстремальные пропорции (вроде 3:1 или 1:3) сбивают с толку модели, обученные преимущественно на изображениях, близких к квадрату. Типично появляется дублирование — два лица, две головы, повторяющиеся элементы по краям, — потому что модель пытается «заполнить» пространство, для которого у неё нет надёжного образца. В таких случаях безопаснее сгенерировать в 16:9, а затем воспользоваться обрезкой или расширением через outpainting, чтобы получить нужный формат.

Ещё один практический момент: генерировать сразу в правильной пропорции всегда лучше, чем обрезать потом. Обрезка отбрасывает пиксели и снижает полезное разрешение. Если вам нужно одно изображение в нескольких форматах, генерируйте в самом узком (обычно вертикальном) и адаптируйте остальные через контролируемое изменение размера.

Seed: число, которое делает результат воспроизводимым

Seed — это целое число, инициализирующее случайный шум, из которого рождается изображение. Тот же промпт + тот же seed + те же параметры + та же модель = то же изображение, пиксель в пиксель. Изменили seed — изменилось всё.

Вероятно, это самый недооценённый параметр среди новичков и самый важный для тех, кто работает с ИИ профессионально. Без контроля над seed вы не можете итеративно улучшать — вы можете только бросать кубик заново.

Практических применений три:

Важно понимать одно ограничение: seed привязан к конкретной модели и её версии. Seed 42 в SDXL не даст ничего похожего на seed 42 в Flux. Сменили модель — старые seed превращаются в бессмысленные числа. Поэтому всегда записывайте модель + версию + seed вместе, никогда только seed.

💡 Совет: когда генерация удалась, сразу сохраните полный набор: промпт, негативный промпт, seed, CFG, steps, сэмплер, модель и пропорцию. Простая таблица с этими столбцами ценнее любой коллекции разрозненных изображений — без этих данных отличный результат невоспроизводим.

Шкала CFG: насколько строго ИИ следует вашему промпту

CFG расшифровывается как Classifier-Free Guidance, и шкала CFG определяет вес, который модель придаёт вашему тексту по сравнению с тем, что она «хотела бы» нарисовать сама. На практике это регулятор послушания.

Низкие значения оставляют модель свободной и творческой, но она начинает игнорировать части промпта. Высокие значения заставляют следовать тексту буквально, но изображение становится перенасыщенным, с жёсткими контурами, преувеличенным контрастом и искусственным видом — так называемый «пережаренный» результат.

Диапазон CFGПоведениеКогда использовать
1–3Почти игнорирует промпт; непредсказуемо и эфемерноХудожественный поиск, абстрактные текстуры
4–6Свободная интерпретация, мягкие цвета, естественный видФотореализм, портреты, органичные сцены
7–9Баланс послушания и естественности — диапазон по умолчаниюОбщее применение; рекомендуемая отправная точка
10–14Сильное следование тексту, более насыщенные цветаИллюстрация, графический дизайн, точные композиции
15+Перенасыщение, артефакты, жёсткие края, искаженияРедко полезно; только в особых случаях

Деталь, которая многих сбивает: у новых моделей другие диапазоны. Flux, например, работает по собственной шкале guidance, где нормальны значения от 2 до 4 — поставить там 7 уже много. Turbo- и дистиллированные модели, рассчитанные на малое число steps, обычно требуют CFG от 1 до 2. То есть универсального числа не существует, есть правильное число для конкретной модели. Всегда сверяйтесь с рекомендацией того, кто опубликовал чекпоинт, прежде чем считать 7 значением по умолчанию.

Практический признак слишком высокого CFG: пластиковая кожа, неоновые цвета, тёмный ореол вокруг контуров, агрессивно повторяющийся текст или узоры. Признак слишком низкого CFG: изображение красивое, но половины того, что вы просили, в нём нет.

Stylize: собственная эстетика модели

Параметр --stylize (или --s) характерен для Midjourney и определяет, насколько сильно модель накладывает собственное художественное чутьё на ваш запрос. Концептуально это почти противоположность CFG: вместо послушания тексту он измеряет эстетическую свободу.

Шкала идёт от 0 до 1000, значение по умолчанию — 100. На практике:

Есть родственный параметр, который часто путают с этим: --chaos (или --c, от 0 до 100). Он управляет разнообразием между четырьмя изображениями одной выдачи, а не стилем каждого. Высокий chaos даёт четыре радикально разные трактовки одного промпта — отлично для первичного мозгового штурма, плохо, когда вы уже знаете, чего хотите. Есть ещё --weird, который добавляет намеренную странность и подходит скорее для экспериментов, чем для клиентской работы.

За пределами Midjourney прямого аналога stylize нет. Похожего эффекта добиваются иначе: стилевые LoRA, эстетические ключевые слова в промпте или тонкая настройка CFG. Понятие всё равно стоит знать, потому что логика «сколько собственного характера может добавить модель» проявляется в том или ином виде почти в каждом инструменте.

Steps: сколько итераций выполняет модель

Steps (шаги сэмплирования) — это количество этапов удаления шума. Каждый шаг приближает изображение к финальному результату. Больше steps означает больше времени обработки и — до определённого предела — больше детализации.

Ключевое здесь — до определённого предела. У этого параметра очень наглядная убывающая отдача: разница между 10 и 25 steps огромна; между 30 и 60 — едва заметна; выше 80 практически неразличима, и вы просто тратите время и энергию.

StepsРезультатПримечание
1–8Работает только на turbo/дистиллированных моделяхНа обычных получается размыто и незавершённо
10–20Быстрый черновик, чёткие формы, слабая детализацияХорошо для проверки композиции и промпта
25–35Качество для публикации в большинстве случаевРекомендуемый диапазон по умолчанию
40–60Незначительный выигрыш на очень сложных сценахОправданно только при множестве элементов
80+Заметного выигрыша нетПустая трата времени и вычислений

Steps и сэмплер связаны напрямую. Сэмплеры типа DPM++ 2M Karras сходятся быстро и дают хороший результат примерно на 25 steps. Сэмплеры вроде Euler a (ancestral) не сходятся полностью: изображение продолжает меняться по мере роста steps, что может быть хорошо (больше вариаций для поиска) или плохо (мешает воспроизводимости). Если цель — стабильность, выбирайте не-ancestral сэмплеры.

Практическое решение для рабочего процесса: ведите первичный поиск на малых steps (15–20), чтобы быстро проверить десятки промптов, и пересоздавайте только финальную версию с победившим seed на 30–40 steps. Это экономит много времени по сравнению с генерацией всего сразу в максимальном качестве.

Смежные параметры, которые тоже стоит знать

Помимо пяти основных, часто встречаются настройки, решающие конкретные задачи:

Какие параметры доступны в каждом инструменте

Названия сильно различаются между платформами, и это источник большей части путаницы. Таблица сопоставляет эквиваленты:

ИнструментСоотношение сторонSeedCFG / guidanceStepsStylize
Midjourney--ar 16:9--seed 1234НедоступенНедоступен--s 100
Stable Diffusion / ComfyUIШирина × высотаПоле SeedCFG ScaleSampling stepsЧерез LoRA или промпт
FluxШирина × высотаПоле SeedGuidance (2–4)Обычно 20–30Через LoRA или промпт
ChatGPT / GPT ImageОбычный языкНедоступенНедоступенНедоступенЧерез промпт
Gemini / Nano BananaОбычный языкНедоступенНедоступенНедоступенЧерез промпт
Leonardo AIПресеты + свои значенияПоле SeedGuidance ScaleДаПресеты стиля

Обратите внимание на закономерность: чем больше инструмент ориентирован на конечного пользователя (ChatGPT, Gemini), тем меньше параметров он открывает — платформа решает за вас. Чем ближе к «сырой» модели (ComfyUI, Automatic1111), тем больше контроля. Ни один из подходов не лучше: они решают разные задачи. Если ваша работа зависит от повторяемости результатов, вам в итоге понадобится инструмент, открывающий seed и CFG.

Как параметры взаимодействуют: рецепты по задачам

Параметры не работают изолированно. Эти сочетания — проверенные отправные точки, подстраивайте их под свою модель:

ЗадачаПропорцияCFGStepsПримечание
Фотореалистичный портрет2:3 или 4:54–630Низкий CFG спасает от пластиковой кожи
Фото товара1:17–930–35Нейтральный фон в промпте
Превью для YouTube16:99–1225Высокий CFG для насыщенных цветов
Иллюстрация / концепт-арт16:9 или 21:97–1030Высокий stylize в Midjourney
Логотип и бренд1:18–1230Низкий stylize ради точности
Обои для телефона9:166–935Оставьте место под иконки
Быстрая проверка промпта1:1715Только чтобы проверить идею

Логика за этими решениями единая: фотореализм требует низкого CFG (модель и так знает, как выглядит фотография, а принуждение всё портит); графический дизайн и рекламные материалы требуют высокого CFG (вам нужны именно эти элементы именно в этих цветах); а steps растут только тогда, когда в сцене много мелких деталей, конкурирующих за место.

Частые ошибки и как их исправить

Короткий чек-лист перед генерацией

  1. Выбирайте пропорцию по конечному назначению изображения, а не по настройке инструмента по умолчанию.
  2. Начинайте со значений модели по умолчанию — и проверяйте, какие они, потому что они различаются.
  3. Сделайте дешёвый тест: мало steps, четыре варианта, только чтобы проверить направление.
  4. Выберите лучший вариант и запишите seed.
  5. С зафиксированным seed меняйте по одному параметру, пока не попадёте в цель.
  6. Пересоздайте финальную версию с рабочими steps (30–40).
  7. Зафиксируйте промпт, негатив, seed, CFG, steps, сэмплер, модель и пропорцию.
  8. Выполните постобработку: апскейл, обрезку, повышение резкости и сжатие для веба.

После генерации: этап, который почти все пропускают

Изображение, созданное ИИ, редко готово к публикации. Обычно это тяжёлый PNG в родном разрешении модели, без точной обрезки под ваш канал. Именно этот финальный этап отделяет картинку, которая «выглядит как ИИ», от изображения, которое просто работает на вашем сайте или в профиле.

Базовый порядок постобработки короткий: поправьте кадр обрезкой, если финальная пропорция не совпадает точно; приведите к нужным размерам через изменение размера; верните мелкие детали повышением резкости, если изображение увеличивалось; и напоследок переведите в WebP и сожмите сжатием изображений, потому что PNG весом 4 МБ вверху страницы обрушивает PageSpeed независимо от того, насколько хороша сама картинка.

Если изображение станет частью фирменного стиля, путь продолжается в других инструментах: извлеките палитру через генератор палитры цветов, чтобы сохранить согласованность между элементами, и воспользуйтесь созданием логотипа с ИИ, когда речь идёт о бренде.

Приведите изображения ИИ к нужному формату

Когда параметры подобраны, задайте изображению точные размеры под его назначение — бесплатно, прямо в браузере и без отправки на сервер.

Изменить размер изображения

Частые вопросы

Какое значение CFG идеально для реалистичных изображений?
В большинстве моделей, производных от Stable Diffusion, диапазон от 4 до 6 даёт самый естественный результат для фотореализма, потому что высокие значения создают пластиковую кожу и преувеличенный контраст. Во Flux, использующем другую шкалу guidance, эквивалент обычно находится между 2 и 4. Всегда сверяйтесь с рекомендацией конкретной модели, прежде чем принимать какое-либо значение за стандартное.
Даёт ли один и тот же seed одинаковое изображение в разных инструментах?
Нет. Seed воспроизводим только внутри одной модели, одной версии и при одинаковых параметрах. Seed 12345 в SDXL не имеет никакого отношения к seed 12345 во Flux или Midjourney. Поэтому важно записывать модель и версию вместе с числом — сам по себе seed не несёт полезной информации.
Всегда ли увеличение steps улучшает качество изображения?
Нет. Выигрыш очень велик примерно до 25–30 steps, а затем быстро сходит на нет. Выше 60 разница практически неразличима, а выше 80 вы лишь расходуете вычислительное время. Если у изображения проблемы с анатомией или недостающими элементами, виноват промпт или модель, а не количество steps.
В чём разница между stylize и chaos в Midjourney?
Stylize управляет тем, насколько сильно модель накладывает собственную художественную эстетику на ваш запрос, влияя на свет, палитру и композицию каждого изображения. Chaos управляет разнообразием между четырьмя изображениями одной выдачи: при высоком chaos вы получаете четыре очень разные трактовки одного промпта. Используйте высокий chaos на этапе поиска и низкий, когда направление уже понятно.
Почему на изображении появляются дублированные люди или объекты?
Обычно это происходит, когда пропорция слишком экстремальна или разрешение значительно превышает то, на котором обучалась модель. Модель пытается заполнить лишнее пространство, повторяя уже узнанные элементы. Решение — генерировать в пропорции ближе к квадрату или 16:9, в родном разрешении модели, а затем расширять через outpainting или увеличивать апскейлом.
Как управлять параметрами в ChatGPT или Gemini, где этих полей нет?
Эти инструменты скрывают числовые регуляторы и определяют значения внутри себя, поэтому настройка идёт обычным языком в самом промпте: укажите формат явно, опишите уровень детализации и обозначьте, хотите ли вы более буквальное или более художественное прочтение сцены. Если ваша работа требует точной воспроизводимости, стоит перейти на инструмент, открывающий seed и CFG, например ComfyUI, Automatic1111 или Leonardo AI.