Вы генерируете идеального персонажа. На втором изображении он похож. На третьем — уже дальний родственник. На пятом — незнакомец в похожем пальто. Этот дрейф — проблема, которая больше всего мешает тем, кто пытается использовать ИИ для создания комикса, детской книги, маскота бренда, серии постов или сториборда.

Причина проста, и её стоит понять прежде любых техник: модели изображений не имеют памяти. Каждая генерация начинается с нуля, из случайного шума, руководствуясь только тем, что вы написали в данный момент. Модель не знает, что она делала две минуты назад. Консистентность, таким образом, — это не то, что делает ИИ, а то, что вы вынуждаете его делать.

Хорошая новость — существует четыре конкретных метода добиться этого, и разрыв между ними сильно сократился в течение 2026 года. То, что раньше требовало обучения собственной модели, сегодня в большинстве случаев решается референсным изображением и дисциплиной письма. Это руководство рассматривает все четыре, когда использовать каждый, и практический процесс, который работает.

Почему персонаж «исчезает» между изображениями

Каждая генерация независима. Даже с идентичным промтом небольшие вариации в процессе создают разные лица — а лицо это именно то, где человеческий глаз замечает разницу точнее всего. Вы принимаете слегка другой стул, не замечая; нос на два миллиметра шире вы заметите сразу.

Это значит, что текстовое описание само по себе имеет потолок. Никакое количество слов не описывает лицо достаточно точно, чтобы воспроизвести его в точности. «Рыжие волосы, зелёные глаза, веснушки» очерчивает большой набор возможных лиц, и ИИ каждый раз выбирает разные.

Отсюда методы делятся на две группы: те, что улучшают описание, и те, что дают модели изображение для копирования. Первые быстрые и неточные; вторые точные и требуют подготовки.

💡 Золотое правило: консистентность общего вида решается текстом. Консистентность лица требует референсного изображения. Если в вашем проекте есть крупные планы, вам понадобится референс.

Четыре метода в сравнении

МетодУсилияТочностьЛучше всего для
Библия персонажа (только текст)Очень низкиеСредняяОбщие планы, стилизованная иллюстрация, мало ассетов
Референсное изображениеНизкиеВысокаяБольшинство проектов: посты, кампании, комиксы
Лист turnaroundСредниеОчень высокаяДлинные серии, комиксы, иллюстрированная книга
Обучение модели (LoRA)ВысокиеМаксимальнаяСотни изображений, персонаж на годы вперёд

Важная деталь текущей ситуации: разрыв между референсом и обучением сильно сократился. Для маркетинга, соцсетей и обычного коммерческого контента хорошо выстроенная система референсов даёт производственный результат без нагрузки обучения чего-либо. Обучение по-прежнему оправдано, когда объём очень большой или точность должна быть абсолютной.

Метод 1: библия персонажа

Это основа всех остальных методов, и этап, который большинство пропускает. Библия персонажа — это фиксированный текстовый блок, описывающий всё, что не может меняться, и который вы вставляете слово в слово во все промты.

Что включить

Только то, что постоянно и видимо: примерный возраст, форма лица, цвет и стрижка волос, цвет глаз, оттенок кожи, отличительная черта, характерная одежда и уникальный аксессуар. Аксессуар недооценивается больше всего — шрам, круглые очки, красный шарф или татуировка работают как визуальный якорь и помогают зрителю узнать персонажа, даже когда лицо немного варьируется.

Что оставить за скобками

Всё, что меняется от сцены к сцене: поза, выражение, обстановка, освещение, угол. Если вы смешаете это в библии, все изображения окажутся одинаковыми — противоположная проблема.

Готовый шаблон

Луна, женщина 28 лет, овальное лицо, рыжие кудрявые волосы до плеч, зелёные глаза, светлая кожа с веснушками на носу, потёртая коричневая кожаная куртка поверх белой футболки, золотые авиаторы, висящие в кармане куртки

Заметьте, что здесь нет ничего о том, где она находится или что делает. Этот блок входит в каждый промт без изменений, а сцена добавляется после:

[блок Луны] — сидит в кафе вечером, смотрит в окно, средний план, тёплый внутренний свет, стиль мягкой цифровой иллюстрации

Ошибка, разрушающая метод

Переписывание синонимами. «Коричневая кожаная куртка» и «пальто цвета карамели из кожи» дают разные вещи. Стабильность языка — это то, на чём держится стабильность изображения: копируйте и вставляйте, не переписывайте.

Метод 2: референсное изображение

Это самый используемый метод сегодня и лучшее соотношение усилий и результата. Вы отправляете изображение персонажа, и модель извлекает визуальные характеристики для воспроизведения в новых сценах.

Как выбрать якорное изображение

Не любое изображение подходит. Идеальный якорь имеет крупное и чёткое лицо, фронтальное или слегка боковое освещение без жёстких теней, нейтральное выражение и простой фон. Драматичный крупный план с половиной лица в тени — ужасный референс, каким бы красивым он ни был: половина нужной модели информации не видна.

Одно изображение или несколько

Одного референса достаточно. Два-три, показывающие разные ракурсы, работают значительно лучше — разница проявляется в основном, когда вы просите позы или углы, которых нет в исходном референсе. Если инструмент принимает несколько входных изображений, используйте это.

Как писать промт с референсом

Структура, которая работает, всегда одна: зафиксировать то, что не меняется, описать только то, что меняется.

Используйте референсное изображение. Сохраните лицо, волосы и одежду точно такими же. Новая сцена: мокрая городская улица ночью, средний план, неоновые отражения на асфальте, мелкий дождь, кинематографичная эстетика

Фраза «сохраните точно такими же» делает больше работы, чем кажется. Без неё модель интерпретирует референс как вдохновение, а не как ограничение.

Технические требования к референсу

Если у вашего лучшего изображения захламлённый фон, стоит удалить фон перед использованием как референса. Изоляция персонажа снижает шанс того, что модель захватит элементы обстановки вместе с ним.

Метод 3: лист turnaround

Это техника, заимствованная из анимации и игровой индустрии, и самая эффективная для длинных серий. Вместо одного изображения вы генерируете лист с одним и тем же персонажем в нескольких ракурсах и выражениях, и используете этот лист как референс для всего последующего.

Запрос для генерации листа:

Референсный лист персонажа: [блок Луны] показана в четырёх видах в полный рост рядом — спереди, три четверти, профиль и со спины — нейтральная поза, ровный светло-серый фон, равномерное фронтальное освещение без драматичных теней, единообразный стиль цифровой иллюстрации

Стоит также сгенерировать вторую доску только с выражениями лица: нейтральное, улыбающееся, удивлённое, сердитое, задумчивое. С обеими в руках персонаж перестаёт дрейфовать даже в сценах, требующих необычных ракурсов.

Вложение — полчаса, а окупает весь остальной проект. Для комиксов, иллюстрированных книг и любой серии более двадцати изображений это метод, экономящий больше всего времени в итоге.

Метод 4: обучить собственную модель

Обучение адаптера — на практике обычно означающее LoRA — это путь максимальной точности. Вы собираете от 15 до 30 изображений персонажа в разных ракурсах, выражениях и освещении, запускаете обучение и получаете персонажа, встроенного в модель. После этого он появляется в любой сцене, позе или стиле, сохраняя идентичность.

Две честные оговорки. Первая — усилия: подготовка набора изображений, подписи и обучение занимают часы, а результат сильно зависит от качества исходного материала. Вторая — преимущество перед методом референса сильно сократилось в современных моделях: то, что раньше оправдывало эту работу, сегодня оправдано только при большом объёме.

Стоит того, когда: вы будете генерировать сотни изображений одного персонажа, он нужен вам в очень разных стилях, или вы создаёте маскота бренда на годы вперёд. Не стоит того для: серии из десяти постов, теста концепции или разового проекта.

Процесс, работающий на практике

Объединяя методы, вот путь, который даёт меньше всего переделок — подходит для комикса, серии постов, маскота или сториборда.

  1. Напишите библию. Прежде чем что-либо генерировать, составьте фиксированный текстовый блок персонажа. Пять минут здесь экономят часы позже.
  2. Генерируйте пакетами, пока не найдёте якорь. Генерируйте по четыре изображения за раз и выберите одно как окончательное. Не двигайтесь дальше, пока у вас нет изображения, которое вы приняли бы как обложку проекта.
  3. Создайте лист turnaround. Используйте якорь как референс и сгенерируйте виды в разных ракурсах и выражениях.
  4. Сохраните набор. Библия текстом, якорь, turnaround и точный промт, который всё это создал. Этот набор — актив проекта.
  5. Генерируйте сцены. Для каждого нового изображения: прикрепите референс, вставьте библию, опишите только то, что меняется.
  6. Исправляйте редактированием, а не перегенерацией. Если что-то вышло слегка неправильно, попросите точечную корректировку вместо генерации с нуля.

Шаг 6 — место, где больше всего людей теряют консистентность, не замечая этого. Перегенерация с нуля выбрасывает всё, что уже было правильным. Просьба «сохраните всё и поменяйте только цвет света» сохраняет идентичность.

💡 Работайте в одном разговоре. В диалоговых инструментах оставаться в одной ветке разговора — самый дешёвый способ сохранить консистентность: модель несёт контекст того, что уже сгенерировала. Открытие нового разговора для каждого изображения — это перезапуск с нуля.

Какой подход использовать в каждой ситуации

ПроектРекомендуемый метод
Короткая серия постов (до 10 изображений)Библия + одно референсное изображение
Маркетинговая кампания (50+ материалов)Множественный референс + turnaround
Иллюстрированная детская книгаTurnaround + референс на каждой странице
КомиксTurnaround + лист выражений
Постоянный маскот брендаTurnaround сейчас, обучение модели при росте объёма
Видео-сторибордРеференс + пакетная генерация в одном разговоре
Быстрый тест концепцииТолько библия

Об инструментах: диалоговые варианты хорошо работают, когда вы остаётесь в одной ветке и просите корректировки, а инструменты, принимающие несколько входных изображений, лучше справляются, когда нужно объединить персонажа и обстановку. Поскольку это быстро меняется, практический критерий — протестировать на своём якоре и сравнить. Гайд по лучшим ИИ для создания изображений помогает выбрать, с чего начать, а гайд по ChatGPT для создания изображений подробно описывает диалоговый процесс.

Консистентность — это не только лицо

Три других элемента дрейфуют с той же лёгкостью, и почти никто их не контролирует.

Одежда. Это то, что меняется чаще всего незаметно: количество пуговиц, крой воротника, точный оттенок ткани. Опишите вещь двумя-тремя конкретными деталями и повторяйте всегда. Если на одежде есть узор, упростите его — сложные паттерны никогда не повторяются одинаково.

Характерный предмет. Меч, рюкзак, инструмент. Относитесь к предмету как ко второму персонажу: он заслуживает собственного фиксированного описания и, в длинных проектах, собственного референсного листа.

Визуальный стиль. Если графический язык меняется между изображениями, персонаж кажется несогласованным даже с одинаковым лицом. Зафиксируйте стиль одной и той же фразой всегда — «мягкая цифровая иллюстрация с тонким штрихом» — и не варьируйте термины. Чтобы усилить цветовую согласованность между изображениями, созданными в разных сессиях, стоит извлечь палитру из якорного изображения и указывать эти оттенки в последующих промтах.

Пять готовых промтов сцен для повторного использования

С готовым набором генерация новых сцен становится механической работой. Пять шаблонов ниже покрывают большинство потребностей серии. Во всех замените часть в квадратных скобках своим фиксированным блоком и оставьте остальное неизменным.

Портрет-представление

Используйте референсное изображение. Сохраните лицо, волосы и одежду точно такими же. [блок персонажа] — фронтальный средний план, нейтральное и уверенное выражение, ровный светло-серый фон, мягкое и равномерное освещение, тот же визуальный стиль, что и в референсе

Сцена действия

Используйте референсное изображение. Сохраните идентичность и одежду неизменными. [блок персонажа] — бежит по узкому коридору, движение с лёгким размытием по краям, низкий угол, жёсткий боковой свет, тот же визуальный стиль, что и в референсе

Сцена диалога

Используйте референсное изображение. Сохраните идентичность неизменной. [блок персонажа] — сидит за столом, разговаривая с кем-то за кадром, средний план в профиль, внимательное выражение, тёплый интерьерный свет, тот же визуальный стиль, что и в референсе

Общий план окружения

Используйте референсное изображение. Сохраните идентичность и одежду неизменными. [блок персонажа] — маленькая фигура идёт по широкому пейзажу на закате, очень общий план, силуэт узнаваем по одежде, тот же визуальный стиль, что и в референсе

Эмоциональный крупный план

Используйте референсное изображение. Сохраните лицо, волосы и черты лица точно такими же. [блок персонажа] — крупный план лица, взгляд опущен и рот закрыт, мягкий боковой свет создаёт лёгкую тень, тёмный размытый фон, тот же визуальный стиль, что и в референсе

Заметьте закономерность: первые три фразы всегда идентичны, меняется только описание сцены. Это повторение — не лень, это именно то, на чём держится консистентность.

Ошибки, которые чаще всего вызывают дрейф

  1. Переписывание описания синонимами. Причина номер один. Всегда копируйте и вставляйте один и тот же блок.
  2. Использование плохого якоря. Драматичный крупный план, лицо в тени или изображение низкого разрешения портят всё, что идёт дальше.
  3. Открытие нового разговора для каждого изображения. Вы теряете накопленный контекст.
  4. Перегенерация вместо редактирования. Каждая генерация с нуля — это новая лотерея.
  5. Описание эмоции вместо выражения. «Грустный» сильно варьируется; «взгляд опущен и рот закрыт» воспроизводимо.
  6. Просьба ракурсов, которых нет в референсе. Без вида в профиль в референсе профиль — это выдумка.
  7. Смешивание стилей. Смена визуального языка в середине проекта разрушает ощущение непрерывности.
  8. Слишком много персонажей в одной сцене. Процент ошибок быстро растёт с количеством лиц.

Как восстановиться, когда персонаж уже разъехался

Если у вас уже есть двадцать изображений и половина не похожа на одного и того же человека, не начинайте с нуля. Вот путь:

Выберите изображение, лучше всего представляющее персонажа — то, которое вы бы использовали как обложку. Оно становится новым официальным якорем. Сгенерируйте из него лист turnaround, даже если проект уже в середине. Перепишите библию, глядя на это изображение, описывая то, что там реально есть, а не то, что вы представляли в начале.

Затем перегенерируйте только наиболее выбивающиеся изображения, используя новый референс. Часто три-четыре переделки решают восприятие всего набора — глаз принимает небольшие вариации, когда большинство изображений согласуются друг с другом.

После генерации: подготовка изображений к использованию

Набор персонажа редко используется таким, каким вышел из ИИ. Три корректировки покрывают почти все назначения.

Изолировать персонажа. Чтобы разместить его на других фонах, собрать маркетинговые материалы или создать стикеры, удаление фона и сохранение в прозрачном PNG — обязательный шаг.

Стандартизировать размер и вес. Серии нужны изображения в одном формате. Используйте изменение размера для унификации и компрессор, чтобы облегчить файлы перед публикацией.

Настроить кадрирование. Если сцена вышла хорошей, но плохо скадрированной, обрезка сохраняет больше качества, чем генерация заново в надежде на удачу.

Чек-лист набора персонажа

Если все пункты готовы, дрейф практически исчезает. А когда он появится, вы будете точно знать, какой части набора не хватает.

Изолируйте своего персонажа в прозрачном PNG

Вырежьте персонажа из фона для использования в обложках, стикерах, маркетинговых материалах и новых сценах прямо в браузере.

Удалить фон

Часто задаваемые вопросы

Почему ИИ не помнит персонажа, которого только что сгенерировал?
Потому что каждая генерация независима и начинается с нуля, из случайного шума, руководствуясь только текстом в данный момент. Модель не хранит визуальную память между изображениями. В диалоговых инструментах есть частичное исключение: внутри одной ветки разговора учитывается предыдущий контекст, что сильно помогает. Но открытие нового разговора всё сбрасывает.
Достаточно ли просто хорошо описать персонажа?
Решает частично. Текстовое описание сохраняет общий вид — цвет волос, одежду, тип телосложения — и этого достаточно для общих планов и стилизованной иллюстрации. Недостаточно для лица крупным планом, потому что не существует такого количества слов, которое описало бы лицо достаточно точно, чтобы воспроизвести его одинаковым. Если в вашем проекте есть крупные планы, вам понадобится референсное изображение.
Сколько референсных изображений оптимально?
Одного уже достаточно, и это решает большинство случаев. Два-три, показывающие разные ракурсы, значительно улучшают результат — особенно когда вы просите позы или углы, которых нет в исходном референсе. Наибольший скачок качества даёт лист turnaround, объединяющий несколько видов одного персонажа в одном изображении и служащий референсом для всего остального проекта.
Стоит ли обучать собственную модель?
Только при большом объёме. Обучение адаптера на 15–30 изображениях даёт максимальную точность и позволяет поместить персонажа в любой стиль, но требует часов подготовки и сильно зависит от качества исходного материала. В современных моделях разрыв между этим путём и хорошей системой референсов сильно сократился. Для серии постов, кампании или разового проекта референс плюс turnaround дают производственный результат без нагрузки обучения.
Как сохранить двух консистентных персонажей в одной сцене?
Это самый сложный сценарий, и процент ошибок быстро растёт с количеством лиц. Помогают три вещи: дать каждому персонажу чётко отличающийся визуальный якорь — явно разные цвета волос и одежды —, явно описать положение каждого в сцене, и использовать инструменты, принимающие несколько референсных изображений. Когда ничего не помогает, практический путь — сгенерировать персонажей отдельно и скомпоновать сцену позже в редакторе.
Можно ли использовать своё лицо как персонажа?
Технически работает хорошо — ваши фото являются отличными референсами, поскольку у вас есть материал под разными углами и с разным освещением. Но проверьте условия инструмента: некоторые платформы ограничивают генерацию узнаваемых людей, а некоторые требуют подтверждения, что у вас есть право на загруженное изображение. Для коммерческого использования добавьте к этому вопрос права на изображение, которое действует даже когда изображённый человек — вы сами в материале третьей стороны.