GUIDES · July 27, 2026 · 9 MIN READ

Как сохранить согласованность персонажей и локаций в AI-кадрах

Согласованность между кадрами ИИ — это проблема памяти: создайте один лист персонажа, передавайте его как референс в каждом кадре, дословно повторяйте описания, остальное исправляйте при монтаже.

Каждое повествовательное видео с ИИ сталкивается с одной и той же проблемой: первый кадр дает вам идеального персонажа, а к четвертому кадру у нее уже другое лицо, куртка и линия волос. Видеомодели не имеют памяти между генерациями. Согласованность — это не то, что вы просите, это система, которую вы строите вокруг модели: одно референсное изображение, один замороженный блок описаний и этап редактирования, который поглощает последние двадцать процентов.

Это руководство строит такую систему. В качестве примера используется полевой ботаник, который появляется в двух локациях — пещере с биолюминесцентным мхом и тропе в джунглях — сгенерированных из одного и того же листа персонажа. Вам нужна модель изображений для референсного листа и видеоинструмент, который принимает референсы изображений, например, /studio.

Референсный лист — ваша память

Прежде чем генерировать какие-либо кадры, один раз создайте персонажа в виде полноростового статичного изображения. Это единственное изображение передается в качестве референса в каждом последующем кадре, что гораздо лучше закрепляет идентичность, чем любое прилагательное в запросе. Напишите запрос для листа, как объявление о кастинге: гардероб, прическа, аксессуары, поза, фон.

Full-body character design of a woman in her thirties,
a field botanist: olive field jacket with rolled sleeves,
round glasses, dark hair in a single braid, canvas satchel,
standing relaxed pose facing camera, neutral light-grey
studio background, soft even lighting, consistent character
reference sheet look.

Три правила для самого листа. Нейтральный серый студийный фон, чтобы окружение не проникало в референс. Плоское равномерное освещение, чтобы видеомодель считывала форму, а не настроение. Расслабленная стоячая поза лицом к камере, потому что экстремальные позы загрязняют каждую последующую генерацию. Сгенерируйте двух или трех кандидатов и выберите одного, прежде чем двигаться дальше; никогда не меняйте листы в середине проекта.

Один референс, две локации

ONE REFERENCE, TWO LOCATIONS

INPUT

Character sheet passed as reference
Character sheet passed as reference

PROMPT

The botanist kneels in a bioluminescent moss cave at night, lifting a glowing fern leaf toward her lantern, awe on her face, medium shot, cool teal glow against warm lantern light, gentle handheld drift.

OUTPUT — GENERATED WITH MANIFOLDGEN

Кадр 1 — пещера с мхом · 4s

Кадр 2 — тропа в джунглях · 4s

Оба кадра используют один и тот же лист персонажа в качестве референса изображения, в то время как запросы меняют только локацию, действие и свет. Запрос для кадра 2: "Ботаник пробирается по залитой солнцем тропе в джунглях, одной рукой раздвигая листья, съемка спереди в темпе ходьбы, пятнистый зеленый свет, документальный реализм, тот же персонаж, что и в референсе." Идентичность сохраняется, потому что она исходит от изображения, а не от текста.

Обратите внимание, что изменилось между кадрами, а что нет. Локация, действие, движение камеры и освещение — все это новое для каждого кадра. Гардероб, очки, коса и сумка нигде не упоминаются ни в одном из запросов к кадрам — они приходят с референсным изображением. Такое разделение труда — это вся техника: изображение отвечает за идентичность, запрос — за постановку.

Повторяйте описания дословно

Референс выполняет большую часть работы, но текст все еще проникает. Когда персонаж должен быть описан прозой — крупные планы, где лист плохо обрезается, или модели без поддержки референсов — копируйте точный блок фраз каждый раз:

  • Создайте одну каноническую строку описания для каждого персонажа ("женщина лет тридцати, оливковая полевая куртка с закатанными рукавами, круглые очки, темные волосы, заплетенные в одну косу, холщовая сумка") и вставляйте ее без изменений в каждый запрос, который ее называет.
  • Никогда не перефразируйте. "Темные заплетенные волосы" и "одна коса" создают разных людей в масштабе.
  • Поместите дескриптор сразу после имени персонажа или местоимения, перед глаголами действия — раннее расположение в запросе имеет больший вес.
  • Сделайте то же самое для повторяющихся реквизитов: фонарь, ранец, папоротник. Именованные реквизиты также получают фиксированные фразы.
  • Храните все фиксированные строки в одном файле заметок для каждого проекта. Когда вы пересматриваете персонажа, пересмотрите файл один раз и сгенерируйте заново.

Ведите «библию» локаций

Персонажи получают референсные изображения; локации получают именованные детали. «Библия» локаций — это короткий список конкретных, повторяющихся особенностей для каждого набора: моховая пещера имеет узкий входной шахту, неглубокий бассейн, отражающий свечение, и скопления папоротников на многоуровневых каменных полках. Каждый кадр, снятый там, повторно использует эти существительные дословно, точно так же, как дескрипторы персонажей.

Именованные детали превосходят атмосферные слова, потому что они выживают при сжатии запроса. «Биолюминесцентная пещера» каждый раз генерируется по-разному; «неглубокий бассейн, отражающий сине-зеленое свечение под многоуровневыми каменными полками» реконструирует узнаваемо то же самое пространство. Для ключевых локаций генерируйте один установочный кадр для каждого угла и используйте его в качестве референсного изображения так же, как вы используете лист персонажа — тот же механизм, примененный к наборам.

[Character name], [frozen descriptor block verbatim],
[action], [location with bible details],
[shot size], [camera move], [lighting],
[reference image attached].
Примите восемьдесят процентов

Ни один пайплайн не дает идентичных персонажей в каждом кадре. Стремитесь к восьмидесятипроцентной согласованности на основе референсов плюс дословных дескрипторов, затем сосредоточьте свои усилия на монтаже: обрезайте до того, как дрейф станет заметным, располагайте кадры так, чтобы более слабые совпадения находились между сильными, и обрабатывайте все клипы в одном цветовом решении. Погоня за совершенством при каждой генерации обходится дороже, чем исправление на постпродакшене.

Когда идентичность все равно дрейфует

  • Лицо меняется, но гардероб остается — референсное изображение было слишком сильно обрезано. Сгенерируйте лист персонажа в полный рост с четким пространством над головой и видимыми руками.
  • Гардероб меняется посреди сцены — блок дескрипторов был перефразирован или опущен. Восстановите дословную строку рядом с именем персонажа.
  • Персонаж выглядит правильно, но возраст меняется от кадра к кадру — добавьте фразу о возрасте в фиксированный блок («ей за тридцать»), а не полагайтесь только на референс.
  • Стиль освещения подавляет идентичность — экстремальный цветовой контраст (бирюзовый на теплом фоне) может размыть детали лица. Смягчите основной свет или сократите время удержания на этих кадрах.
  • Локация выглядит по-другому после отъезда камеры — детали «библии» были утеряны. Вставьте список именованных деталей обратно в запрос для возвращающегося кадра.
  • Все почти работает — прекратите регенерацию. Обрезайте раньше, чередуйте кадры и обрабатывайте; аудитория читает последовательность, а не отдельные кадры.

Создайте лист персонажа один раз, зафиксируйте строки дескрипторов, запишите свои локации, затем сгенерируйте тестовые кадры бок о бок в Studio, чтобы проверить совпадение, прежде чем создавать полную сцену. Кинематографические предустановки камеры в /tools/cinematic-cameras поддерживают язык движения таким же дисциплинированным, как и система идентификации.

Try these prompts on your own shot.

Every example on this page was generated with ManifoldGen. Open the Studio and run the same structure on your idea.

Open Studio