Seedance 2.5 - это новое поколение видеомодели от ByteDance, предназначенное для создания продолжительных и цельных видеороликов в рамках одной генерации. Модель способна самостоятельно выстраивать развитие сцены, менять ракурсы, окружение и динамику происходящего.

Одной из ключевых особенностей Seedance 2.5 является расширенная работа с референсами. Модель поддерживает одновременное использование до 30 изображений, 10 видео и 10 аудио, что позволяет точнее передавать внешность персонажей, особенности локации, визуальный стиль и другие элементы исходных материалов. Также модель отличается улучшенным пониманием текстовых запросов, более реалистичной передачей движения и физики объектов.


🎥 Видео YouTube

Seedance 2.5 генерирует 30 секунд видео за раз и принимает до 50 референсов. Звучит как серьёзный шаг вперёд - но так ли это на деле, или перед нами просто красивая цифра для рекламы? Я прогнал новую модель через реальные тесты и сравнил с Seedance 2.0 на одинаковых промптах.

Переходите по ссылке ниже 👇

Seedance 2.5 против прошлой версии: 30 секунд, 50 референсов и честный итог (это реально?)


🎛 Навигация

🏠Главное меню > 🎬 Видео > 🧿 Seedance 2.0/2.5


💥 Пошаговое руководство по использованию Seedance 2.5 «Текст в видео»

Первым делом при работе с функцией «Текст в видео», вам необходимо открыть «Настройки». Там можно добавить текстовый запрос и настроить параметры будущего видео.

Настройки модели

Промпт

Качественная генерация напрямую зависит от того, насколько точно и последовательно описана сцена. Важно не просто задать идею, а зафиксировать персонажа, окружение и поведение, чтобы избежать искажений и случайных изменений в процессе генерации.

Хороший промпт должен включать в себя:

  1. Описание персонажа/объекта

На этом этапе необходимо максимально подробно зафиксировать внешний вид персонажа или объекта. Важно указать ключевые черты: лицо, телосложение, причёску, одежду, материалы, форму, цвет и другие визуальные особенности. Если в видео участвует один и тот же персонаж или объект, это нужно обозначить отдельно, чтобы модель сохраняла его внешний вид на протяжении всей генерации, например:

«Same person in all shots. Preserve exact appearance throughout. Stable face throughout.»

  1. Действие

Необходимо чётко описать, что именно делает персонаж или объект, в какой последовательности происходят действия и как они взаимодействуют с окружением. Лучше использовать конкретные формулировки: не «идёт красиво», а «идёт вперёд уверенным шагом, поворачивает голову в камеру, поправляет воротник». Чем точнее заданы движения и их логика, тем стабильнее и понятнее результат.

  1. Локация

Необходимо подробно описать и зафиксировать пространство, в котором происходит сцена: интерьер или экстерьер, расположение объектов, атмосферу, фон и важные детали окружения.

  1. Освещение

Освещение задаёт настроение и глубину сцены, поэтому его желательно указывать отдельно. Можно описывать источник света, его характер и цвет: мягкий дневной свет, жёсткий контровой свет, тёплое объёмное освещение, неоновые акценты и т.д.

  1. Движение камеры

Важно указать тип съёмки и движение камеры, так как именно они определяют динамику видео. Можно комбинировать разные подходы: плавные пролёты, резкие приближения, смену ракурсов и т.д.

  1. Ограничения и стабильность

В завершении запроса рекомендуется зафиксировать технические ограничения, которые помогают сделать результат чище и стабильнее. Обычно здесь указывают отсутствие искажений, мерцания, деформаций, случайных изменений лица, одежды или сцены, например:

«No deformation. No flickering. No ghosting. Stable face throughout. Realistic physics.»

Дополнительные рекомендации:

  • Избегайте размытых формулировок («красиво», «интересно», «круто») - они не дают модели чёткого понимания результата
  • При необходимости разбивайте сценарий по времени (например: [0–3s], [3–6s]) для более точного контроля динамики и последовательности действий
  • При работе с персонажами фиксируйте их внешний вид и поведение, чтобы избежать случайных изменений
  • Рекомендуется писать запросы на английском языке, так модель точнее интерпретирует формулировки и лучше понимает детали, стили и движения камеры. Это особенно важно для сложных сцен и динамики, где требуется высокая точность результата
  • Чем подробнее и точнее описан запрос, тем более качественным и предсказуемым будет результат.

Например:

«POV first-person futuristic motorcycle chase through a neon megacity, nighttime after heavy rain. The camera is strictly first-person, rigidly positioned at the rider’s eye level behind the motorcycle handlebars, and never cuts to an external third-person angle. Duration 10 seconds. Pure cinematic video, no text, no subtitles, no interface elements, no background music, no visual distortions.

Global settings: Photorealistic futuristic realism, extremely high clarity, sharp environmental details, realistic high-speed motion blur, wet reflective surfaces, cinematic HDR lighting. The city is illuminated by intense neon signs, streetlights, vehicle headlights and colorful architectural lighting reflected across rain-soaked asphalt. Deep blacks, saturated neon reds, blues, magentas and warm orange highlights. One continuous uninterrupted shot with aggressive realistic camera vibration caused by the motorcycle engine, road surface, acceleration, braking and impacts. Camera shake intensifies during sharp turns, near collisions and the final jump.

Location map: The entire sequence takes place on the lower streets of an enormous futuristic Asian megacity at night. Towering skyscrapers rise on both sides, covered with enormous holographic advertisements, glowing signs, glass façades, ventilation systems, elevated highways and dense architectural details. Narrow streets connect into larger multi-lane roads. The pavement is completely wet after rain, creating sharp reflections of neon lights and passing vehicles.

In the constant foreground are the motorcycle handlebars, digital instrument cluster, black fuel tank and parts of the rider’s arms. Two male hands wearing black leather motorcycle gloves remain firmly positioned on the handlebars. The right hand controls the throttle. The rider wears a dark motorcycle jacket visible around the lower edges of the frame. The motorcycle is a powerful futuristic black sport bike with realistic suspension, acceleration and steering physics.

Traffic remains physically present throughout the sequence: autonomous cars, taxis, delivery vehicles and motorcycles move naturally through intersections. Nothing disappears randomly. Vehicles maintain consistent trajectories and realistic momentum.

The rider is being pursued by two black futuristic police motorcycles visible primarily through mirrors and brief backward glances. They have intense red-and-blue emergency lights reflecting across surrounding buildings and wet pavement.

00:00–00:01.5 (HOOK — full-speed traffic split): The very first frame begins already at extreme speed. No acceleration ramp-up. The motorcycle races directly between two moving cars with only centimeters of clearance on either side. The camera violently vibrates from speed and engine power. Neon reflections streak across the wet road beneath the motorcycle.

Both gloved hands grip the handlebars tightly. The digital speedometer rapidly climbs. The rider aggressively twists the throttle.

The motorcycle shoots through the narrowing gap just before the two cars move closer together.

A side mirror nearly clips the rider’s left hand.

The camera instinctively jerks right at the last possible moment.

00:01.5–00:03 (intersection + near collision): The motorcycle bursts from between the cars directly into a large intersection.

A futuristic autonomous taxi suddenly crosses from right to left directly ahead.

The rider immediately leans extremely hard to the left.

The entire first-person horizon tilts dramatically with the motorcycle.

The bike slides around the front bumper of the taxi with almost no clearance. Water explodes outward from both tires and sprays across the lower part of the lens.

The rear tire briefly loses traction on the wet asphalt before gripping again.

Through the left mirror, two pursuing police motorcycles appear entering the intersection behind.

Their flashing emergency lights rapidly alternate red and blue across the rider’s gloves, motorcycle tank and surrounding wet surfaces.

00:03–00:04 (macro slow-motion near miss): Immediately after clearing the taxi, the motorcycle passes extremely close beside a large delivery truck.

The truck’s metallic side mirror approaches directly toward the rider’s head.

For a fraction of a second, time dramatically slows.

The camera passes only centimeters beneath the mirror.

Extreme photorealistic macro detail becomes visible: tiny rain droplets vibrating across the metal housing, microscopic scratches, reflected neon advertisements, individual droplets suspended in the air between the mirror and camera.

The rider instinctively lowers their head.

The mirror passes directly above.

Time instantly snaps back to full speed.

00:04–00:05.5 (stairs shortcut): Directly ahead, the main road is suddenly blocked by several stopped vehicles.

The rider sharply turns right toward a narrow pedestrian passage between two buildings.

The handlebars rotate aggressively.

The motorcycle jumps over the sidewalk curb.

The front suspension compresses violently on impact.

The passage immediately reveals a long concrete staircase descending toward a lower street.

Without slowing down, the rider commits to the descent.

The motorcycle launches down the stairs at extreme speed.

Every individual step creates brutal rhythmic camera vibration. The handlebars shake violently in the rider’s hands while the suspension rapidly compresses and rebounds.

Pedestrians ahead jump aside.

Small puddles explode beneath the wheels.

00:05.5–00:07 (market destruction + pursuit): The motorcycle reaches the bottom of the staircase and immediately enters a narrow nighttime street market.

Food stalls, hanging lanterns, plastic curtains, steaming cooking stations and pedestrians fill both sides of the passage.

The rider accelerates straight through the center.

The camera violently weaves left and right between obstacles.

A hanging fabric banner hits the camera and sweeps completely across the lens before flying backward.

The motorcycle clips the edge of a fruit stand.

Oranges and small fruit explode into the air and roll across the wet street behind.

Steam from a cooking stall blasts across the frame.

Through the steam, one police motorcycle suddenly appears extremely close behind.

Its headlights and emergency lights fill the mirrors.

The rider twists the throttle fully.

00:07–00:08 (truck ramp): The market passage suddenly opens onto a construction zone.

Directly ahead, a large transport truck is moving slowly across the road with its rear loading ramp lowered diagonally toward the pavement.

There is no time to brake.

The rider aims directly toward the ramp.

Both hands tighten around the handlebars.

The motorcycle accelerates.

The camera races up the metal ramp.

The front wheel hits the incline.

The suspension compresses.

The camera pitches violently upward.

The motorcycle launches into open air.

00:08–00:09 (BULLET-TIME JUMP): At the exact instant both motorcycle wheels leave the ramp, time nearly freezes.

The motorcycle is suspended high above a massive lower intersection.

The camera remains strictly first-person.

Both gloved hands remain visible gripping the handlebars while the front wheel hangs in open air ahead.

The city expands dramatically beneath the rider.

Hundreds of headlights move across the intersection far below.

For one breathtaking moment, individual rain droplets remain suspended around the camera.

Tiny shards of glass, droplets of water, pieces of paper and several oranges from the destroyed market stall drift through the air around the motorcycle.

The camera subtly rotates during the frozen jump, revealing the enormous vertical scale of the neon city.

A police motorcycle launches from the same ramp behind and becomes briefly visible through the side mirror, suspended in mid-air.

Neon advertisements reflect inside individual floating droplets.

The rider’s leather gloves, stitching, motorcycle controls, carbon-fiber surfaces, water droplets and tiny scratches become razor sharp in extreme macro detail.

00:09–00:10 (LANDING + ESCAPE): Time violently snaps back to full speed.

Gravity immediately takes over.

The motorcycle drops toward the roof of a moving autonomous cargo truck below.

The front wheel hits first.

Massive suspension compression.

The entire camera violently shakes from impact.

The rear wheel slams down immediately after.

Metal sparks burst outward as part of the motorcycle briefly scrapes against the truck roof.

The rider instantly accelerates again.

The motorcycle races forward across the moving truck’s roof.

At the final moment, the rider launches from the front edge of the truck toward the wet road ahead.

The camera pitches downward.

The road rushes violently toward the lens.

Final frame occurs milliseconds before the motorcycle touches the asphalt again.

One seamless continuous first-person camera move built through relentless forward acceleration, aggressive motorcycle movement, realistic obstacle avoidance, extreme near misses, wet-surface physics, one brief macro slow-motion moment and one spectacular first-person bullet-time jump.

Sound design: powerful high-revving motorcycle engine constantly changing under acceleration and load, aggressive wind noise, realistic tire noise across wet asphalt, water splashes, vehicle horns, distant police sirens, metallic suspension impacts, stair impacts, market objects crashing, fabric striking the rider, brief reduction of environmental sound during slow motion, deep cinematic low-frequency impact during the jump and landing. No music.

Camera behavior: strictly first-person POV from beginning to end. Never show the rider externally. Never detach the camera from the rider. Never switch to drone view, third-person tracking, side view or cinematic exterior angle. The camera follows realistic head and body movement while remaining spatially connected to the motorcycle.

Realistic motorcycle physics are essential. The motorcycle must lean naturally during turns, suspension must respond physically to curbs, stairs, ramps and landing, wheels must maintain believable contact with surfaces, acceleration must create realistic body movement, and wet asphalt must affect traction naturally.

Ultra-photorealistic materials: wet asphalt, painted metal, carbon fiber, leather gloves, glass skyscrapers, rain droplets, vehicle surfaces, steam, fruit, fabric and reflective road markings. High-speed environmental detail remains readable despite motion.

No cuts. No edits. No teleportation. No impossible camera relocation. No third-person angles. No random vehicle disappearance. No morphing motorcycle. No changing gloves. No extra fingers. No distorted hands. No warped architecture. No object duplication. No flickering. No ghosting. No unstable geometry.

One continuous take. Relentless forward momentum. Realistic first-person motorcycle physics. Extreme cinematic speed. Photorealistic neon city. High motion clarity. Cinematic HDR. Ultra-detailed 4K.»

Модель

В данной Базе Знаний описана работа с моделью «Seedance 2.5».

Узнать как работать с моделью «Seedance 2.0» можно тут: Seedance 2.0

Режим

При работе в модели Seedance 2.5 вам доступно 4 режима на выбор. Для работы только по текстовому запросу необходимо выбрать режим «Omni Reference».

Omni Reference – основной режим, позволяющий одновременно использовать несколько референсов: изображения, видео и аудио. Они помогают модели сохранять внешность персонажей, объекты, локации, стиль, движения и звуковое сопровождение. Единственный режим, который допускает работу только по текстовому запросу.

Разрешение

При работе по текстовому запросу вам доступно три варианта разрешения:

  • 480p

Базовое разрешение видео. Оно идеально подходит для просмотра на небольших экранах мобильных устройств и экономит интернет-трафик. Видео может выглядеть немного размытым, а мелкие детали будут не очень четкими.

  • 720p

Среднее разрешение видео. Обеспечивает хороший баланс между качеством видео и размером файла. Этот формат стал популярным стандартом для онлайн-видео, включая YouTube, и обеспечивает четкую картинку, комфортную для просмотра на телевизорах среднего размера и большинстве современных устройств.

  • 1080p

Представляет собой высококачественный формат видео, обеспечивающий превосходную детализацию и четкость. Этот формат идеально подходит для просмотра на больших экранах и телевизорах, хотя требует более быстрого интернет-соединения и занимает значительно больше места на устройстве хранения, но взамен предоставляет максимально четкое и детализированное видео.

Аудио

При работе в нейросети Seedance 2.5 у вас есть возможность создавать видео с аудио.

Чтобы добавить звуковые эффекты, включите ползунок - нейросеть автоматически подберёт и наложит аудио.

Если вы предпочитаете генерацию без звука - необходимо выключить ползунок.

Соотношение сторон

При работе в режиме «Omni Reference» с функционалом «Текст в Видео» вам доступно 7 вариантов соотношения сторон на выбор:

Автоматическая длительность

Автоматическая длительность – это режим, при котором нейросеть самостоятельно определяет оптимальную продолжительность видео от 4 до 30 секунд в зависимости от сложности и содержания запроса.

❣️Итоговая длительность может отличаться между генерациями, поэтому количество списываемых токенов также может меняться.

Длительность

У вас есть возможность установить длительность будущего видео от 4 до 30 секунд.

❣️Обратите внимание, что по умолчанию длительность в настройках выставлена на 5 секунды.

После того как вы написали текстовой запрос и проставили верные настройки, необходимо нажать кнопку «Сгенерировать».

Пример генерации

«A fast-paced cinematic morning routine featuring a young woman in her mid-20s with long brown hair, expressive facial features and a slim build. Same woman throughout. Preserve exact face and appearance. The sequence feels energetic, slightly chaotic and humorous.

[0:00–0:01] Extreme close-up of a digital alarm clock. Her hand suddenly enters frame and aggressively hits the alarm.

[0:01–0:02] Hard cut overhead: she instantly sits upright in bed, realizes she is late and throws the blanket aside.

[0:02–0:03] Bathroom mirror shot. She rapidly brushes her teeth while fixing her hair with the other hand, visibly stressed.

[0:03–0:04] Match cut to her pulling a white shirt over her head while rushing through the bedroom.

[0:04–0:05] Close-up of coffee pouring into a cup. She immediately grabs it before the machine finishes.

[0:05–0:06] Low-angle shot of her running through the apartment while putting on one shoe.

[0:06–0:07] She grabs her handbag and jacket from a chair without stopping. Fast whip-pan follows her movement.

[0:07–0:08] She runs toward the front door, takes a sip of coffee and suddenly freezes.

[0:08–0:09] Close-up. She looks down and realizes she is still wearing pajama pants with her formal shirt and blazer.

[0:09–0:10] She slowly looks directly into the camera with a completely defeated expression. Freeze-like comedic final frame.

Fast lifestyle commercial editing, snap cuts, whip pans, overhead shots, macro inserts, natural motion blur. Warm morning sunlight, realistic apartment environment, natural fabric and hair movement. Stable face throughout, no morphing, no deformation, cinematic 4K.»


💥 Пошаговое руководство по использованию Seedance 2.5 «Работа с референсами»

Первым делом при работе с изображениями вам необходимо открыть «Настройки». Там можно загрузить все материалы, добавить текстовый запрос и настроить параметры будущего видео.

Работа по одному изображению

Настройки модели

Загрузка изображения

Технические требования к изображениям:

  • Вы можете добавлять изображения в формате JPG и PNG.
  • Максимальный вес файла: до 10 MB.
  • Максимальное количество загружаемых изображений: 30.

Например:

Промпт

Качественная генерация напрямую зависит от того, насколько точно и последовательно описана сцена. Важно не просто задать идею, а зафиксировать персонажа, окружение и поведение, чтобы избежать искажений и случайных изменений в процессе генерации.

Хороший промпт должен включать в себя:

  1. Описание персонажа/объекта

На этом этапе необходимо максимально подробно зафиксировать внешний вид персонажа или объекта. Важно указать ключевые черты: лицо, телосложение, причёску, одежду, материалы, форму, цвет и другие визуальные особенности. Если в видео участвует один и тот же персонаж или объект, это нужно обозначить отдельно, чтобы модель сохраняла его внешний вид на протяжении всей генерации, например:

«Same person in all shots. Preserve exact appearance throughout. Stable face throughout.»

  1. Действие

Необходимо чётко описать, что именно делает персонаж или объект, в какой последовательности происходят действия и как они взаимодействуют с окружением. Лучше использовать конкретные формулировки: не «идёт красиво», а «идёт вперёд уверенным шагом, поворачивает голову в камеру, поправляет воротник». Чем точнее заданы движения и их логика, тем стабильнее и понятнее результат.

  1. Локация

Необходимо подробно описать и зафиксировать пространство, в котором происходит сцена: интерьер или экстерьер, расположение объектов, атмосферу, фон и важные детали окружения.

  1. Освещение

Освещение задаёт настроение и глубину сцены, поэтому его желательно указывать отдельно. Можно описывать источник света, его характер и цвет: мягкий дневной свет, жёсткий контровой свет, тёплое объёмное освещение, неоновые акценты и т.д.

  1. Движение камеры

Важно указать тип съёмки и движение камеры, так как именно они определяют динамику видео. Можно комбинировать разные подходы: плавные пролёты, резкие приближения, смену ракурсов и т.д.

  1. Ограничения и стабильность

В завершении запроса рекомендуется зафиксировать технические ограничения, которые помогают сделать результат чище и стабильнее. Обычно здесь указывают отсутствие искажений, мерцания, деформаций, случайных изменений лица, одежды или сцены, например:

«No deformation. No flickering. No ghosting. Stable face throughout. Realistic physics.»

Дополнительные рекомендации:

  • Избегайте размытых формулировок («красиво», «интересно», «круто») - они не дают модели чёткого понимания результата
  • При необходимости разбивайте сценарий по времени (например: [0–3s], [3–6s]) для более точного контроля динамики и последовательности действий
  • При работе с персонажами фиксируйте их внешний вид и поведение, чтобы избежать случайных изменений
  • Рекомендуется писать запросы на английском языке, так модель точнее интерпретирует формулировки и лучше понимает детали, стили и движения камеры. Это особенно важно для сложных сцен и динамики, где требуется высокая точность результата
  • Чем подробнее и точнее описан запрос, тем более качественным и предсказуемым будет результат.
Система тегов

Главной особенностью при работе с референсами в данном инструменте является система тегов. Чтобы добавить тег в запрос, нажмите на миниатюру нужного изображения - тег будет автоматически вставлен в поле запроса.

Это помогает нейросети точнее понимать, какое изображение необходимо использовать в определённой части запроса.

Например:

«Use the uploaded reference image @ref1 as the primary character reference. The woman from the reference image is the only main character in the video. Preserve her exact facial features, face shape, skin tone, hairstyle, hair color, body proportions, clothing and overall appearance throughout the entire sequence. Same woman in all shots. Preserve exact appearance throughout. Stable face and identity throughout.

Key Concept: A cinematic fashion sequence of the woman walking confidently across the rooftop of a modern skyscraper during a dramatic sunset. The scene combines elegant character movement, strong wind, changing camera angles and a vast city skyline. The overall mood is sophisticated, powerful and cinematic.

Setting: The rooftop of a tall modern skyscraper overlooking a dense metropolitan skyline. Concrete rooftop surface, minimal architectural structures, glass elements and safety barriers around the edges. Tall skyscrapers stretch into the distance. The environment remains consistent throughout the entire sequence.

Lighting: Warm golden-hour sunset with a dramatic orange, pink and soft purple sky. Strong warm sunlight comes from behind and beside the woman, creating natural rim light around her silhouette, hair and dress. Long realistic shadows stretch across the rooftop. Subtle reflections appear on surrounding glass buildings.

[0:00–0:02] Close-up portrait shot. The woman stands on the rooftop with the city softly blurred behind her. She looks directly into the camera with a calm, confident expression. Strong wind gently moves strands of her hair across her face and causes the fabric of her dress to move naturally. The camera slowly pushes closer toward her eyes.

[0:02–0:04] Hard cut to a low-angle full-body shot. She turns away from the camera and begins walking confidently across the rooftop. Her dress flows dynamically behind her in the wind. The camera tracks backward in front of her while maintaining a low perspective, making the surrounding skyscrapers appear enormous.

[0:04–0:06] Side tracking shot. The camera moves parallel to the woman as she continues walking. A stronger gust of wind suddenly catches her hair and dress, creating dramatic flowing movement. She briefly turns her head toward the city while continuing forward without stopping.

[0:06–0:08] The camera moves into a smooth orbital shot, rotating around her while she walks. The perspective shifts from her side toward her back, revealing the glowing sunset and vast skyline directly ahead. Her hair and dress continue moving naturally in the wind while sunlight creates bright highlights along their edges.

[0:08–0:09] Medium front-facing shot. She stops walking, turns toward the camera and slightly adjusts her hair with one hand. The camera performs a subtle push-in while she maintains direct eye contact with a composed, confident expression.

[0:09–0:10] The camera rapidly pulls backward and rises into a dramatic wide shot, revealing the woman standing alone on the enormous rooftop surrounded by the city skyline. Her dress continues flowing in the wind as the sun sets behind the skyscrapers.

Visual style: luxury fashion campaign, photorealistic cinematic realism, elegant editorial aesthetic, warm sunset color palette, high contrast, realistic skin texture, detailed fabric and hair movement, natural atmospheric depth.

Camera: close-up push-in, low-angle tracking, side tracking, smooth orbital movement, medium portrait shot and dramatic final crane pull-back. Controlled cinematic motion with natural motion blur and high motion clarity.

Realistic wind physics affecting hair and fabric. Natural walking movement and body mechanics. Preserve the exact clothing from the reference image. Do not randomly change hairstyle, outfit, accessories or facial features between shots.

No identity drift. No face changes. No morphing. No deformation. No flickering. No ghosting. No duplicated character. No distorted hands or limbs. Stable face throughout. Stable clothing throughout. Realistic anatomy and physics. Smooth cinematic movement, high detail, sharp focus, cinematic 4K quality.»

Модель

В данной Базе Знаний описана работа с моделью «Seedance 2.5».

Узнать как работать с моделью «Seedance 2.0» можно тут: Seedance 2.0

Режим

При работе в модели Seedance 2.5 вам доступно 4 режима на выбор. Для работы по одному изображению вам необходимо выбрать режим «Omni Reference».

Omni Reference – основной режим, позволяющий одновременно использовать несколько референсов: изображения, видео и аудио. Они помогают модели сохранять внешность персонажей, объекты, локации, стиль, движения и звуковое сопровождение.

Разрешение

При работе по одному изображению вам доступно три варианта разрешения:

  • 480p

Базовое разрешение видео. Оно идеально подходит для просмотра на небольших экранах мобильных устройств и экономит интернет-трафик. Видео может выглядеть немного размытым, а мелкие детали будут не очень четкими.

  • 720p

Среднее разрешение видео. Обеспечивает хороший баланс между качеством видео и размером файла. Этот формат стал популярным стандартом для онлайн-видео, включая YouTube, и обеспечивает четкую картинку, комфортную для просмотра на телевизорах среднего размера и большинстве современных устройств.

  • 1080p

Представляет собой высококачественный формат видео, обеспечивающий превосходную детализацию и четкость. Этот формат идеально подходит для просмотра на больших экранах и телевизорах, хотя требует более быстрого интернет-соединения и занимает значительно больше места на устройстве хранения, но взамен предоставляет максимально четкое и детализированное видео.

Аудио

При работе в нейросети Seedance 2.5 у вас есть возможность создавать видео с аудио.

Чтобы добавить звуковые эффекты, включите ползунок - нейросеть автоматически подберёт и наложит аудио.

Если вы предпочитаете генерацию без звука - необходимо выключить ползунок.

Соотношение сторон

При работе в режиме «Omni Reference» вам доступно 7 вариантов соотношения сторон на выбор:

Автоматическая длительность

Автоматическая длительность – это режим, при котором нейросеть самостоятельно определяет оптимальную продолжительность видео от 4 до 30 секунд в зависимости от сложности и содержания запроса.

❣️Итоговая длительность может отличаться между генерациями, поэтому количество списываемых токенов также может меняться.

Длительность

У вас есть возможность установить длительность будущего видео от 4 до 30 секунд.

❣️Обратите внимание, что по умолчанию длительность в настройках выставлена на 5 секунды.

После того как вы написали запрос и проставили верные настройки, необходимо нажать кнопку «Сгенерировать».

Результат

Работа с двумя изображениями (Keyframes)

Настройки модели

Загрузка изображений

Технические требования к изображениям:

  • Вы можете добавлять изображения в формате JPG и PNG.
  • Максимальный вес файла: до 10 MB.
  • Максимальное количество загружаемых изображений: 30.

Например:

Промпт

Качественная генерация напрямую зависит от того, насколько точно и последовательно описана сцена. Важно не просто задать идею, а зафиксировать персонажа, окружение и поведение, чтобы избежать искажений и случайных изменений в процессе генерации.

Хороший промпт должен включать в себя:

  1. Описание персонажа/объекта

На этом этапе необходимо максимально подробно зафиксировать внешний вид персонажа или объекта. Важно указать ключевые черты: лицо, телосложение, причёску, одежду, материалы, форму, цвет и другие визуальные особенности. Если в видео участвует один и тот же персонаж или объект, это нужно обозначить отдельно, чтобы модель сохраняла его внешний вид на протяжении всей генерации, например:

«Same person in all shots. Preserve exact appearance throughout. Stable face throughout.»

  1. Действие

Необходимо чётко описать, что именно делает персонаж или объект, в какой последовательности происходят действия и как они взаимодействуют с окружением. Лучше использовать конкретные формулировки: не «идёт красиво», а «идёт вперёд уверенным шагом, поворачивает голову в камеру, поправляет воротник». Чем точнее заданы движения и их логика, тем стабильнее и понятнее результат.

  1. Локация

Необходимо подробно описать и зафиксировать пространство, в котором происходит сцена: интерьер или экстерьер, расположение объектов, атмосферу, фон и важные детали окружения.

  1. Освещение

Освещение задаёт настроение и глубину сцены, поэтому его желательно указывать отдельно. Можно описывать источник света, его характер и цвет: мягкий дневной свет, жёсткий контровой свет, тёплое объёмное освещение, неоновые акценты и т.д.

  1. Движение камеры

Важно указать тип съёмки и движение камеры, так как именно они определяют динамику видео. Можно комбинировать разные подходы: плавные пролёты, резкие приближения, смену ракурсов и т.д.

  1. Ограничения и стабильность

В завершении запроса рекомендуется зафиксировать технические ограничения, которые помогают сделать результат чище и стабильнее. Обычно здесь указывают отсутствие искажений, мерцания, деформаций, случайных изменений лица, одежды или сцены, например:

«No deformation. No flickering. No ghosting. Stable face throughout. Realistic physics.»

Дополнительные рекомендации:

  • Избегайте размытых формулировок («красиво», «интересно», «круто») - они не дают модели чёткого понимания результата
  • При необходимости разбивайте сценарий по времени (например: [0–3s], [3–6s]) для более точного контроля динамики и последовательности действий
  • При работе с персонажами фиксируйте их внешний вид и поведение, чтобы избежать случайных изменений
  • Рекомендуется писать запросы на английском языке, так модель точнее интерпретирует формулировки и лучше понимает детали, стили и движения камеры. Это особенно важно для сложных сцен и динамики, где требуется высокая точность результата
  • Чем подробнее и точнее описан запрос, тем более качественным и предсказуемым будет результат.
Система тегов

Главной особенностью при работе с референсами в данном инструменте является система тегов. Чтобы добавить тег в запрос, нажмите на миниатюру нужного изображения - тег будет автоматически вставлен в поле запроса.

Это помогает нейросети точнее понимать, какое изображение необходимо использовать в определённой части запроса.

Например:

«Use @ref1 as the exact starting frame and @ref2 as the exact final frame. Create a seamless 10-second cinematic pastry preparation sequence connecting these two images.

The chef must prepare only the raspberry dessert shown in @ref2. Every ingredient and every cooking action shown during the sequence must logically contribute to this exact final dessert.

The dessert consists of fresh raspberries, delicate crispy layered pastry, smooth vanilla cream, glossy raspberry sauce, small crunchy crumbs and fresh mint.

Do not introduce meat, fish, vegetables, savory ingredients or unrelated dishes at any point. No frying pan, steak, grilling or savory cooking. This is exclusively a pastry and dessert preparation sequence.

Preserve the same chef and professional restaurant kitchen from @ref1 throughout the preparation. The sequence gradually transitions from the wider kitchen composition of @ref1 into the extreme macro food composition of @ref2.

[0:00–0:01] Begin exactly from @ref1. The chef stands behind the counter looking down at the empty white plate. He immediately begins preparing the dessert. The camera smoothly pushes forward toward his hands and the work surface.

[0:01–0:02] Close-up of the chef rapidly cutting thin sheets of delicate golden pastry into precise rectangular pieces. Fine crispy flakes and tiny crumbs fall naturally onto the cutting board. The camera tracks closely beside the knife, emphasizing the thin layered texture of the pastry.

[0:02–0:03] Macro shot of the chef arranging several crisp golden pastry layers. He carefully stacks the thin pieces while the camera moves extremely close to the surface, revealing individual flaky layers, caramelized edges and fine sugar crystals.

[0:03–0:04] Quick transition to fresh raspberries. The chef places bright red raspberries onto the work surface and carefully selects the best berries. Extreme macro camera movement passes between the raspberries, revealing their detailed natural texture and tiny droplets of moisture.

[0:04–0:05] Close-up of smooth vanilla cream being prepared and transferred into a piping bag. The chef pipes a small elegant mound of pale vanilla cream onto the white plate. The cream has a smooth, glossy texture with tiny visible vanilla seeds.

[0:05–0:06] Overhead shot. The chef begins assembling the dessert directly on the plate. Crispy layered pastry pieces are positioned beside the vanilla cream, followed by fresh raspberries. Every element begins forming the exact composition visible in @ref2.

[0:06–0:07] Extreme close-up as the chef pours glossy deep-red raspberry sauce around the pastry, berries and vanilla cream. The sauce flows naturally across the ceramic plate, forming the rich raspberry base visible in @ref2. The camera follows the flowing sauce at macro level.

[0:07–0:08] Fast precise finishing sequence. The chef adds small crispy pastry crumbs around the raspberry sauce, places additional fresh raspberries into their final positions and carefully adjusts the pastry layers using his fingers and plating tools.

[0:08–0:09] Using fine plating tweezers, the chef places one fresh green mint leaf onto the vanilla cream. He makes one final adjustment to the dessert and immediately removes his hands from the frame. The completed plate must now accurately match the dessert shown in @ref2.

[0:09–0:10] The camera rapidly pushes toward the finished dessert and descends to plate level. The kitchen and chef gradually disappear into a soft shallow-depth-of-field background as the camera moves into extreme macro scale.

The lens glides past the glossy raspberry sauce and crispy pastry layers before settling beside the large fresh raspberry and vanilla cream topped with the green mint leaf.

End exactly on @ref2.

The transition into the final keyframe must feel natural and continuous. By the final frame, the dessert must precisely reproduce the composition and visual characteristics of @ref2: large detailed raspberry in the foreground, crispy layered golden pastry, pale vanilla cream with visible vanilla seeds, fresh green mint leaf, glossy deep-red raspberry sauce, scattered pastry crumbs and additional raspberries softly blurred in the background.

Visual style: premium Michelin-style pastry commercial, sophisticated restaurant cinematography, photorealistic food photography, warm natural kitchen lighting, rich raspberry reds, golden pastry tones, creamy whites and fresh green accents.

Camera progression: medium-wide chef shot → hand close-up → pastry macro → raspberry macro → cream close-up → overhead plating → sauce macro → detailed finishing → extreme macro final shot.

Focus heavily on satisfying dessert textures: delicate pastry cracking and flaking, smooth vanilla cream, glossy raspberry sauce flowing across the plate, fresh raspberry texture, tiny moisture droplets, sugar crystals and crisp golden crumbs.

Realistic pastry preparation and plating physics. All ingredients appearing during preparation must be visible components of or directly related to the dessert shown in @ref2.

No meat. No steak. No fish. No vegetables. No savory food. No frying. No grilling. No frying pan. No flames. No unrelated ingredients. Do not prepare another dish before the dessert. The entire 10-second sequence is exclusively the preparation and plating of the raspberry dessert shown in @ref2.

Preserve the chef from @ref1. Preserve the final dessert from @ref2. No random ingredient changes. No deformation. No flickering. No ghosting. No duplicated hands or utensils. Realistic hand movement, realistic food textures, stable kitchen environment, smooth cinematic transitions, shallow depth of field, high detail, cinematic 4K quality.»

Модель

В данной Базе Знаний описана работа с моделью «Seedance 2.5».

Узнать как работать с моделью «Seedance 2.0» можно тут: Seedance 2.0

Режим

При работе в модели Seedance 2.5 вам доступно 4 режима на выбор. Для работы по двум изображениям вам необходимо выбрать режим «Keyframes».

Keyframes – режим, позволяющий задать ключевые кадры видео с помощью двух изображений. Модель использует их как ориентиры для первого и последнего кадра и создаёт движение и плавные переходы между заданными кадрами.

Разрешение

При работе по двум изображениям вам доступно три варианта разрешения:

  • 480p

Базовое разрешение видео. Оно идеально подходит для просмотра на небольших экранах мобильных устройств и экономит интернет-трафик. Видео может выглядеть немного размытым, а мелкие детали будут не очень четкими.

  • 720p

Среднее разрешение видео. Обеспечивает хороший баланс между качеством видео и размером файла. Этот формат стал популярным стандартом для онлайн-видео, включая YouTube, и обеспечивает четкую картинку, комфортную для просмотра на телевизорах среднего размера и большинстве современных устройств.

  • 1080p

Представляет собой высококачественный формат видео, обеспечивающий превосходную детализацию и четкость. Этот формат идеально подходит для просмотра на больших экранах и телевизорах, хотя требует более быстрого интернет-соединения и занимает значительно больше места на устройстве хранения, но взамен предоставляет максимально четкое и детализированное видео.

Аудио

При работе в нейросети Seedance 2.5 у вас есть возможность создавать видео с аудио.

Чтобы добавить звуковые эффекты, включите ползунок - нейросеть автоматически подберёт и наложит аудио.

Если вы предпочитаете генерацию без звука - необходимо выключить ползунок.

Соотношение сторон

При работе в режиме «Keyframes» соотношение сторон для видео берется из первого загруженного изображения.

Автоматическая длительность

Автоматическая длительность – это режим, при котором нейросеть самостоятельно определяет оптимальную продолжительность видео от 4 до 30 секунд в зависимости от сложности и содержания запроса.

❣️Итоговая длительность может отличаться между генерациями, поэтому количество списываемых токенов также может меняться.

Длительность

У вас есть возможность установить длительность будущего видео от 4 до 30 секунд.

❣️Обратите внимание, что по умолчанию длительность в настройках выставлена на 5 секунды.

После того как вы написали запрос и проставили верные настройки, необходимо нажать кнопку «Сгенерировать».

Результат

Работа с несколькими изображениями

Настройки модели

Загрузка изображений

Технические требования к изображениям:

  • Вы можете добавлять изображения в формате JPG и PNG.
  • Максимальный вес файла: до 10 MB.
  • Максимальное количество загружаемых изображений: 30.

Например:

Промпт

Качественная генерация напрямую зависит от того, насколько точно и последовательно описана сцена. Важно не просто задать идею, а зафиксировать персонажа, окружение и поведение, чтобы избежать искажений и случайных изменений в процессе генерации.

Хороший промпт должен включать в себя:

  1. Описание персонажа/объекта

На этом этапе необходимо максимально подробно зафиксировать внешний вид персонажа или объекта. Важно указать ключевые черты: лицо, телосложение, причёску, одежду, материалы, форму, цвет и другие визуальные особенности. Если в видео участвует один и тот же персонаж или объект, это нужно обозначить отдельно, чтобы модель сохраняла его внешний вид на протяжении всей генерации, например:

«Same person in all shots. Preserve exact appearance throughout. Stable face throughout.»

  1. Действие

Необходимо чётко описать, что именно делает персонаж или объект, в какой последовательности происходят действия и как они взаимодействуют с окружением. Лучше использовать конкретные формулировки: не «идёт красиво», а «идёт вперёд уверенным шагом, поворачивает голову в камеру, поправляет воротник». Чем точнее заданы движения и их логика, тем стабильнее и понятнее результат.

  1. Локация

Необходимо подробно описать и зафиксировать пространство, в котором происходит сцена: интерьер или экстерьер, расположение объектов, атмосферу, фон и важные детали окружения.

  1. Освещение

Освещение задаёт настроение и глубину сцены, поэтому его желательно указывать отдельно. Можно описывать источник света, его характер и цвет: мягкий дневной свет, жёсткий контровой свет, тёплое объёмное освещение, неоновые акценты и т.д.

  1. Движение камеры

Важно указать тип съёмки и движение камеры, так как именно они определяют динамику видео. Можно комбинировать разные подходы: плавные пролёты, резкие приближения, смену ракурсов и т.д.

  1. Ограничения и стабильность

В завершении запроса рекомендуется зафиксировать технические ограничения, которые помогают сделать результат чище и стабильнее. Обычно здесь указывают отсутствие искажений, мерцания, деформаций, случайных изменений лица, одежды или сцены, например:

«No deformation. No flickering. No ghosting. Stable face throughout. Realistic physics.»

Дополнительные рекомендации:

  • Избегайте размытых формулировок («красиво», «интересно», «круто») - они не дают модели чёткого понимания результата
  • При необходимости разбивайте сценарий по времени (например: [0–3s], [3–6s]) для более точного контроля динамики и последовательности действий
  • При работе с персонажами фиксируйте их внешний вид и поведение, чтобы избежать случайных изменений
  • Рекомендуется писать запросы на английском языке, так модель точнее интерпретирует формулировки и лучше понимает детали, стили и движения камеры. Это особенно важно для сложных сцен и динамики, где требуется высокая точность результата
  • Чем подробнее и точнее описан запрос, тем более качественным и предсказуемым будет результат.
Система тегов

Главной особенностью при работе с референсами в данном инструменте является система тегов. Чтобы добавить тег в запрос, нажмите на миниатюру нужного изображения - тег будет автоматически вставлен в поле запроса.

Это помогает нейросети точнее понимать, какое изображение необходимо использовать в определённой части запроса.

Например:

«Reference assignment:

@ref1 — primary female character reference. Use the woman from this image as the first main character. Preserve her exact facial features, face shape, skin tone, eye color, hairstyle, hair color, body proportions and overall identity throughout the entire video. She may wear a different outfit appropriate for the scene, but her identity and physical appearance must remain unchanged.

@ref2 — primary male character reference. Use the man from this image as the second main character. Preserve his exact facial features, face shape, skin tone, eye color, hairstyle, hair color, body proportions and overall identity throughout the entire video. He may wear a different outfit appropriate for the scene, but his identity and physical appearance must remain unchanged.

@ref3 — environment reference. Use this image as the primary reference for the museum interior. Preserve its architectural style, scale, materials, exhibition layout and overall atmosphere. The entire interior sequence takes place inside this same museum.

@ref4 — object reference. Use the blue diamond from this image as the central object of the scene. Preserve its exact shape, color, size, material, reflections and recognizable visual characteristics. The same diamond must remain consistent whenever visible.

@ref5 — vehicle reference. Use the black sports car from this image as the getaway vehicle in the final scene. Preserve its exact design, body shape, color, headlights, wheels and recognizable visual characteristics.

Key Concept: A fast-paced cinematic museum heist featuring the two characters from Reference @ref1 and @ref2. They infiltrate a luxurious museum at night, navigate through a security laser system, steal the blue diamond from @ref4 and escape toward the black sports car from @ref5. The sequence should feel like a polished high-budget spy thriller with rapid camera movement, dramatic lighting and escalating tension.

Both characters wear sophisticated black tactical evening outfits suitable for a stylish spy film. The woman wears a fitted black outfit with minimal accessories. The man wears a clean black tactical-style outfit. Their clothing remains consistent throughout the sequence.

Same woman throughout. Same man throughout. Never exchange, merge or mix their facial features. Preserve both identities independently in every shot.

[0:00–0:02] Wide cinematic establishing shot inside the museum from @ref3 at night. The woman and man move quickly through the enormous exhibition hall side by side. The camera tracks backward in front of them at a low angle while they walk confidently toward the center of the museum. Glass display cases and polished surfaces create realistic reflections around them.

The camera briefly pushes closer toward their faces before rapidly pulling back, clearly establishing both characters and preserving their identities.

[0:02–0:03] A dense security grid of bright red laser beams suddenly activates across the corridor directly ahead.

Both characters immediately stop.

The woman quickly extends one arm across the man’s chest to stop him from walking into a laser. They exchange a brief focused glance.

The camera rapidly moves sideways, revealing the complex laser grid separating them from the diamond exhibition.

[0:03–0:05] They begin moving through the laser system together.

The woman ducks beneath a horizontal laser while stepping carefully between two beams. At the same moment, the man raises one leg over a lower beam and rotates his body through a narrow opening.

The camera moves dynamically between them, passing extremely close to the glowing red lasers.

For a brief macro moment, the lens passes only millimeters beside one laser beam. Tiny floating dust particles become visible in the red light while both characters continue moving in the softly blurred background.

The camera immediately accelerates forward again as they successfully clear the final lasers.

[0:05–0:06] They reach a large glass display case containing the exact blue diamond from @ref4.

The camera performs a rapid orbit around the display while the man interacts with the security mechanism beside the case.

The lock disengages.

The glass enclosure smoothly opens.

The woman immediately reaches forward toward the diamond.

[0:06–0:07] Extreme close-up as her hand grabs the blue diamond.

The diamond must clearly match @ref4, with the same shape, deep blue color, reflective surface and visual characteristics.

The instant the diamond leaves its pedestal, the museum lighting abruptly changes.

Warm exhibition lighting switches to intense flashing red emergency illumination.

The woman’s face, the man’s face, the glass display and the blue diamond are illuminated by alternating red alarm light.

Both characters immediately realize the alarm has been triggered.

[0:07–0:08] They turn simultaneously and sprint back through the museum.

The woman keeps the blue diamond firmly in one hand.

The camera races backward directly in front of them while they run toward the exit.

Red emergency lights flash across the museum walls. Security doors begin closing in the distance. Reflections rapidly move across the polished floor while the camera maintains clear visibility of both characters.

[0:08–0:09] A large metal security door rapidly descends directly ahead.

Both characters continue running without slowing down.

At the final possible moment, the woman drops low and slides underneath the closing door while holding the diamond securely against her body.

The man immediately follows.

The camera drops almost to floor level and slides underneath the door with them.

The heavy security door slams shut immediately behind the camera.

[0:09–0:10] The camera bursts through the museum exit with both characters onto a wet nighttime city street.

The exact black sports car from @ref5 is waiting directly outside with its headlights illuminated.

The woman and man sprint toward the car while the woman still visibly carries the blue diamond.

The camera rapidly pulls backward and rises slightly, revealing both characters, the black sports car and the illuminated museum entrance behind them.

Final frame: the woman reaches the passenger side while the man reaches the driver’s side of the black sports car, red emergency lights flashing across the wet street and reflecting across the vehicle.

Visual style: photorealistic cinematic spy thriller, sophisticated luxury aesthetic, high-budget action film, dramatic nighttime lighting, polished museum interiors, deep blacks, warm exhibition lighting transitioning into intense red emergency illumination, realistic reflections and strong cinematic contrast.

Camera: low-angle tracking, rapid push-ins, lateral movement, close character shots, macro laser pass, fast orbital movement around the diamond, backward running shot, floor-level security-door slide and dramatic final pull-back. Fast-paced but controlled cinematic movement with high motion clarity.

Maintain strict reference consistency. @ref1 controls the woman’s identity. @ref2 controls the man’s identity. @ref3 controls the museum environment. @ref4 controls the blue diamond. @ref5 controls the black sports car.

Do not blend characteristics between references. Do not transfer facial features between the woman and man. Do not randomly modify the museum architecture, diamond or vehicle.

No identity drift. No face changes. No morphing. No character swapping. No duplicated characters. No distorted hands. No extra fingers or limbs. No deformation. No flickering. No ghosting. Stable clothing throughout. Stable diamond design throughout. Stable vehicle design throughout. Realistic running, sliding and physical interactions. Natural fabric movement, realistic reflections and physically believable movement.

Photorealistic cinematic quality, ultra-detailed textures, realistic skin, glass, metal and gemstone materials, cinematic HDR lighting, high motion clarity, sharp focus, 4K.»

Модель

В данной Базе Знаний описана работа с моделью «Seedance 2.5».

Узнать как работать с моделью «Seedance 2.0» можно тут: Seedance 2.0

Режим

При работе в модели Seedance 2.5 вам доступно 4 режима на выбор. Для работы с несколькими изображениями вам необходимо выбрать режим «Omni Reference».

Omni Reference – основной режим, позволяющий одновременно использовать несколько референсов: изображения, видео и аудио. Они помогают модели сохранять внешность персонажей, объекты, локации, стиль, движения и звуковое сопровождение.

Разрешение

При работе с несколькими изображениями вам доступно три варианта разрешения:

  • 480p

Базовое разрешение видео. Оно идеально подходит для просмотра на небольших экранах мобильных устройств и экономит интернет-трафик. Видео может выглядеть немного размытым, а мелкие детали будут не очень четкими.

  • 720p

Среднее разрешение видео. Обеспечивает хороший баланс между качеством видео и размером файла. Этот формат стал популярным стандартом для онлайн-видео, включая YouTube, и обеспечивает четкую картинку, комфортную для просмотра на телевизорах среднего размера и большинстве современных устройств.

  • 1080p

Представляет собой высококачественный формат видео, обеспечивающий превосходную детализацию и четкость. Этот формат идеально подходит для просмотра на больших экранах и телевизорах, хотя требует более быстрого интернет-соединения и занимает значительно больше места на устройстве хранения, но взамен предоставляет максимально четкое и детализированное видео.

Аудио

При работе в нейросети Seedance 2.5 у вас есть возможность создавать видео с аудио.

Чтобы добавить звуковые эффекты, включите ползунок - нейросеть автоматически подберёт и наложит аудио.

Если вы предпочитаете генерацию без звука - необходимо выключить ползунок.

Соотношение сторон

При работе в режиме «Omni Reference» вам доступно 7 вариантов соотношения сторон на выбор:

Автоматическая длительность

Автоматическая длительность – это режим, при котором нейросеть самостоятельно определяет оптимальную продолжительность видео от 4 до 30 секунд в зависимости от сложности и содержания запроса.

❣️Итоговая длительность может отличаться между генерациями, поэтому количество списываемых токенов также может меняться.

Длительность

У вас есть возможность установить длительность будущего видео от 4 до 30 секунд.

❣️Обратите внимание, что по умолчанию длительность в настройках выставлена на 5 секунды.

После того как вы написали запрос и проставили верные настройки, необходимо нажать кнопку «Сгенерировать».

Результат


💥 Пошаговое руководство по использованию Seedance 2.5 «Работа с использованием референсов видео»

Первым делом при работе с референсом видео вам необходимо открыть «Настройки». Там можно загрузить все материалы, добавить текстовый запрос и настроить параметры будущего видео.

Настройки модели

Загрузка видео

Технические требования к видео:

  • Формат файла: MP4
  • Максимальный вес файлов: до 200 MB
  • Максимальное количество загружаемых видео: 10
  • Суммарная длительность всех видео: до 30 секунд

Например:

Промпт

Качественная генерация напрямую зависит от того, насколько точно и последовательно описана сцена. Важно не просто задать идею, а зафиксировать персонажа, окружение и поведение, чтобы избежать искажений и случайных изменений в процессе генерации.

Хороший текстовый запрос должен включать в себя:

  1. Описание персонажа/объекта

На этом этапе необходимо максимально подробно зафиксировать внешний вид персонажа или объекта. Важно указать ключевые черты: лицо, телосложение, причёску, одежду, материалы, форму, цвет и другие визуальные особенности. Если в видео участвует один и тот же персонаж или объект, это нужно обозначить отдельно, чтобы модель сохраняла его внешний вид на протяжении всей генерации, например:

«Same person in all shots. Preserve exact appearance throughout. Stable face throughout.»

  1. Действие

Необходимо чётко описать, что именно делает персонаж или объект, в какой последовательности происходят действия и как они взаимодействуют с окружением. Лучше использовать конкретные формулировки: не «идёт красиво», а «идёт вперёд уверенным шагом, поворачивает голову в камеру, поправляет воротник». Чем точнее заданы движения и их логика, тем стабильнее и понятнее результат.

  1. Локация

Необходимо подробно описать и зафиксировать пространство, в котором происходит сцена: интерьер или экстерьер, расположение объектов, атмосферу, фон и важные детали окружения.

  1. Освещение

Освещение задаёт настроение и глубину сцены, поэтому его желательно указывать отдельно. Можно описывать источник света, его характер и цвет: мягкий дневной свет, жёсткий контровой свет, тёплое объёмное освещение, неоновые акценты и т.д.

  1. Движение камеры

Важно указать тип съёмки и движение камеры, так как именно они определяют динамику видео. Можно комбинировать разные подходы: плавные пролёты, резкие приближения, смену ракурсов и т.д.

  1. Ограничения и стабильность

В завершении запроса рекомендуется зафиксировать технические ограничения, которые помогают сделать результат чище и стабильнее. Обычно здесь указывают отсутствие искажений, мерцания, деформаций, случайных изменений лица, одежды или сцены, например:

«No deformation. No flickering. No ghosting. Stable face throughout. Realistic physics.»

Дополнительные рекомендации:

  • Избегайте размытых формулировок («красиво», «интересно», «круто») - они не дают модели чёткого понимания результата
  • При необходимости разбивайте сценарий по времени (например: [0–3s], [3–6s]) для более точного контроля динамики и последовательности действий
  • При работе с персонажами фиксируйте их внешний вид и поведение, чтобы избежать случайных изменений
  • Рекомендуется писать запросы на английском языке, так модель точнее интерпретирует формулировки и лучше понимает детали, стили и движения камеры. Это особенно важно для сложных сцен и динамики, где требуется высокая точность результата
  • Чем подробнее и точнее описан запрос, тем более качественным и предсказуемым будет результат.
Система тегов

Главной особенностью при работе с референсами в данном инструменте является система тегов. Чтобы добавить тег в запрос, нажмите на миниатюру нужного изображения - тег будет автоматически вставлен в поле запроса.

Это помогает нейросети точнее понимать, какое изображение необходимо использовать в определённой части запроса.

Например:

«Replace the woman in the reference video @ref1 with the woman from the reference image @ref2.

Use the reference video @ref1 strictly as the motion, pose, timing, camera movement and scene reference. The woman from the reference image @ref2 must fully replace the original woman in the video @ref1 while performing exactly the same movements, gestures, poses, walking pattern, body turns, head movements and facial direction with identical timing.

Use the reference image @ref2 as the primary identity and appearance reference. Preserve the exact facial features, face shape, skin tone, hairstyle, hair color, body proportions and overall appearance of the woman from the reference image @ref2 throughout the entire video. Same person in all frames. Stable face and identity throughout.

Preserve the original environment, composition, camera angles, camera movement, framing, lighting, pacing and sequence of actions from the reference video @ref1. Do not change the background or movement trajectory.

The replacement must look natural and physically integrated into the original scene, with realistic body movement, natural walking physics, accurate contact with the ground, realistic hair and clothing movement, and lighting consistent with the environment.

Do not preserve the identity, facial features or appearance of the original woman from the reference video @ref1. Transfer only her motion, pose, timing and movement trajectory.

No face morphing. No identity drift. No deformation. No flickering. No ghosting. No duplicated limbs. No changes in facial features between frames. Preserve the exact identity of the woman from the reference image throughout. Smooth natural motion, realistic anatomy, high detail, photorealistic cinematic quality.»

Модель

В данной Базе Знаний описана работа с моделью «Seedance 2.5».

Узнать как работать с моделью «Seedance 2.0» можно тут: Seedance 2.0

Режим

При работе в модели Seedance 2.5 вам доступно 4 режима на выбор. Для работы с референсом видео вам необходимо выбрать режим «Edit».

Edit – режим для изменения уже готового видеоролика. Для работы необходимо обязательно загрузить минимум одно исходное видео, которое модель будет использовать как основу для дальнейшего редактирования в соответствии с вашим запросом.

Разрешение

При работе с видео референсом вам доступно три варианта разрешения:

  • 480p

Базовое разрешение видео. Оно идеально подходит для просмотра на небольших экранах мобильных устройств и экономит интернет-трафик. Видео может выглядеть немного размытым, а мелкие детали будут не очень четкими.

  • 720p

Среднее разрешение видео. Обеспечивает хороший баланс между качеством видео и размером файла. Этот формат стал популярным стандартом для онлайн-видео, включая YouTube, и обеспечивает четкую картинку, комфортную для просмотра на телевизорах среднего размера и большинстве современных устройств.

  • 1080p

Представляет собой высококачественный формат видео, обеспечивающий превосходную детализацию и четкость. Этот формат идеально подходит для просмотра на больших экранах и телевизорах, хотя требует более быстрого интернет-соединения и занимает значительно больше места на устройстве хранения, но взамен предоставляет максимально четкое и детализированное видео.

Аудио

При работе в нейросети Seedance 2.5 у вас есть возможность создавать видео с аудио.

Чтобы добавить звуковые эффекты, включите ползунок - нейросеть автоматически подберёт и наложит аудио.

Если вы предпочитаете генерацию без звука - необходимо выключить ползунок.

Соотношение сторон

При работе в режиме «Edit» соотношение сторон определяется автоматически на основе загруженного видео и не подлежит ручному выбору.

Если вы подгружаете несколько видео с разным соотношением сторон, то финальное соотношение будет взято с первого загруженного вами видео.

Автоматическая длительность

Автоматическая длительность – это режим, при котором нейросеть самостоятельно определяет оптимальную продолжительность видео от 4 до 30 секунд в зависимости от сложности и содержания запроса.

❣️Итоговая длительность может отличаться между генерациями, поэтому количество списываемых токенов также может меняться.

После того как вы написали запрос и проставили верные настройки, необходимо нажать кнопку «Сгенерировать».

Результат


💥 Пошаговое руководство по использованию Seedance 2.5 «Работа с использованием аудио»

Первым делом при работе с референсом аудио вам необходимо открыть «Настройки». Там можно загрузить все материалы, добавить текстовый запрос и настроить параметры будущего видео.

Настройки модели

Загрузка аудио

Технические требования к аудио:

  • Формат файла: MP3
  • Максимальное количество загружаемых аудио: 10
  • Суммарная длительность всех аудио: до 30 секунд

Например:

Промпт

Качественная генерация напрямую зависит от того, насколько точно и последовательно описана сцена. Важно не просто задать идею, а зафиксировать персонажа, окружение и поведение, чтобы избежать искажений и случайных изменений в процессе генерации.

Хороший текстовый запрос должен включать в себя:

  1. Описание персонажа/объекта

На этом этапе необходимо максимально подробно зафиксировать внешний вид персонажа или объекта. Важно указать ключевые черты: лицо, телосложение, причёску, одежду, материалы, форму, цвет и другие визуальные особенности. Если в видео участвует один и тот же персонаж или объект, это нужно обозначить отдельно, чтобы модель сохраняла его внешний вид на протяжении всей генерации, например:

«Same person in all shots. Preserve exact appearance throughout. Stable face throughout.»

  1. Действие

Необходимо чётко описать, что именно делает персонаж или объект, в какой последовательности происходят действия и как они взаимодействуют с окружением. Лучше использовать конкретные формулировки: не «идёт красиво», а «идёт вперёд уверенным шагом, поворачивает голову в камеру, поправляет воротник». Чем точнее заданы движения и их логика, тем стабильнее и понятнее результат.

  1. Локация

Необходимо подробно описать и зафиксировать пространство, в котором происходит сцена: интерьер или экстерьер, расположение объектов, атмосферу, фон и важные детали окружения.

  1. Освещение

Освещение задаёт настроение и глубину сцены, поэтому его желательно указывать отдельно. Можно описывать источник света, его характер и цвет: мягкий дневной свет, жёсткий контровой свет, тёплое объёмное освещение, неоновые акценты и т.д.

  1. Движение камеры

Важно указать тип съёмки и движение камеры, так как именно они определяют динамику видео. Можно комбинировать разные подходы: плавные пролёты, резкие приближения, смену ракурсов и т.д.

  1. Ограничения и стабильность

В завершении запроса рекомендуется зафиксировать технические ограничения, которые помогают сделать результат чище и стабильнее. Обычно здесь указывают отсутствие искажений, мерцания, деформаций, случайных изменений лица, одежды или сцены, например:

«No deformation. No flickering. No ghosting. Stable face throughout. Realistic physics.»

Дополнительные рекомендации:

  • Избегайте размытых формулировок («красиво», «интересно», «круто») - они не дают модели чёткого понимания результата
  • При необходимости разбивайте сценарий по времени (например: [0–3s], [3–6s]) для более точного контроля динамики и последовательности действий
  • При работе с персонажами фиксируйте их внешний вид и поведение, чтобы избежать случайных изменений
  • Рекомендуется писать запросы на английском языке, так модель точнее интерпретирует формулировки и лучше понимает детали, стили и движения камеры. Это особенно важно для сложных сцен и динамики, где требуется высокая точность результата
  • Чем подробнее и точнее описан запрос, тем более качественным и предсказуемым будет результат.
❗️Важно для работы с аудио
  1. Аудиофайл может использоваться моделью как готовая звуковая дорожка или как референс голоса, интонации и музыкального стиля. Поэтому в текстовом запросе рекомендуется явно указывать назначение каждого загруженного файла.

  2. Если используется несколько аудиофайлов, обозначьте их нумерацию и роль, например: какой файл содержит речь конкретного персонажа, какой используется для музыки, а какой для звуковых эффектов.

  3. При работе с русской речью рекомендуется избегать слишком длинных и сложных фраз, модель может перегенерировать речь, из-за чего произношение и отдельные слова могут искажаться.

  4. Также рекомендуется указывать приоритет звуков: речь должна оставаться на переднем плане, а музыка и звуковые эффекты не должны её перекрывать.

  5. Аудиореференсы могут влиять не только на звук, но и на длительность и темп действий, мимику персонажей, монтаж и движение камеры. Модель старается синхронизировать визуальную часть видео с ритмом и продолжительностью аудио.

Система тегов

Главной особенностью при работе с референсами в данном инструменте является система тегов. Чтобы добавить тег в запрос, нажмите на миниатюру нужного изображения - тег будет автоматически вставлен в поле запроса.

Это помогает нейросети точнее понимать, какое изображение необходимо использовать в определённой части запроса.

Например:

«Create a lively, photorealistic cinematic scene at a traditional Turkish street market using all three uploaded references.

Reference assignment:

@ref1 - environment reference. Use this image as the primary reference for the Turkish market location, architecture, market stalls, products, colors and overall atmosphere. Preserve the recognizable visual characteristics of this environment.

@ref2 - character reference. Use the elderly Turkish man from this image as the main character. Preserve his exact facial features, age, skin tone, hairstyle, facial hair, body proportions and overall appearance throughout the entire video. Same man throughout. Stable face and identity.

@ref3 - primary dialogue reference. The elderly man must loudly and clearly speak the exact phrase from this audio. Preserve the original wording, voice, pronunciation, timing, rhythm and intonation. Do not rewrite, regenerate or reinterpret the dialogue.

The elderly Turkish market seller stands confidently beside a colorful market stall filled with fresh vegetables, fruits, spices and traditional products. The market around him is busy and alive: customers walk between stalls, vendors work in the background, colorful fabrics move gently in the breeze and people naturally interact with products.

The man looks toward people passing through the market and loudly calls out the exact phrase from @ref3 like an energetic experienced street vendor trying to attract customers.

His facial expressions and body language must naturally match the audio. His mouth movements must be accurately synchronized with every spoken word. He gestures expressively with his hands, briefly points toward the products on his stall and opens one hand toward passing customers while speaking. His performance feels confident, charismatic, energetic and authentic rather than exaggerated or theatrical.

Camera begins with a wider cinematic shot showing the busy Turkish market and the seller at his stall. The camera then smoothly moves forward through the crowd toward him. Passing customers briefly cross the foreground, creating natural depth and movement. As the man begins speaking, the camera transitions into a medium shot and slowly pushes closer toward his face while he gestures and delivers his phrase. Finish with a confident medium close-up of the seller looking toward nearby customers.

Warm natural daylight, rich Mediterranean colors, colorful fruits and vegetables, realistic skin texture, detailed fabrics, subtle sunlight reflections and soft natural shadows. Slight handheld documentary-style camera movement creates the feeling of actually standing inside a busy Turkish market.

@ref3 is the highest priority. The man’s dialogue must be loud, clear and dominant in the final audio mix. Preserve the exact phrase from the uploaded audio. Do not generate additional dialogue or change the spoken words.

Add subtle natural market ambience underneath the dialogue: distant conversations, footsteps, bags and products moving, subtle street activity and background vendor voices. Keep all environmental sounds significantly quieter than the man’s voice. No background music.

Accurate lip synchronization with @ref3. Natural mouth movement, facial expressions and gestures synchronized with the rhythm and intensity of the speech.

Same elderly man throughout. Preserve exact identity from @ref2. No face changes. No identity drift. No deformation. No flickering. No ghosting. No duplicated people. No distorted hands. Natural anatomy and realistic body movement. Preserve the Turkish market environment from @ref1. Photorealistic cinematic quality, high detail, realistic lighting and natural motion.»

Модель

В данной Базе Знаний описана работа с моделью «Seedance 2.5».

Узнать как работать с моделью «Seedance 2.0» можно тут: Seedance 2.0

Режим

При работе в модели Seedance 2.5 вам доступно 4 режима на выбор. Для работы с референсом аудио вам необходимо выбрать режим «Omni Reference».

Omni Reference – основной режим, позволяющий одновременно использовать несколько референсов: изображения, видео и аудио. Они помогают модели сохранять внешность персонажей, объекты, локации, стиль, движения и звуковое сопровождение.

Разрешение

При работе с аудио референсом вам доступно три варианта разрешения:

  • 480p

Базовое разрешение видео. Оно идеально подходит для просмотра на небольших экранах мобильных устройств и экономит интернет-трафик. Видео может выглядеть немного размытым, а мелкие детали будут не очень четкими.

  • 720p

Среднее разрешение видео. Обеспечивает хороший баланс между качеством видео и размером файла. Этот формат стал популярным стандартом для онлайн-видео, включая YouTube, и обеспечивает четкую картинку, комфортную для просмотра на телевизорах среднего размера и большинстве современных устройств.

  • 1080p

Представляет собой высококачественный формат видео, обеспечивающий превосходную детализацию и четкость. Этот формат идеально подходит для просмотра на больших экранах и телевизорах, хотя требует более быстрого интернет-соединения и занимает значительно больше места на устройстве хранения, но взамен предоставляет максимально четкое и детализированное видео.

Аудио

При использовании аудио-референса ползунок должен быть включён. Если его отключить, генерация будет происходить без звука, даже при наличии референса аудио.

Соотношение сторон

При работе в режиме «Omni Reference» вам доступно 7 вариантов соотношения сторон на выбор:

Автоматическая длительность

Автоматическая длительность – это режим, при котором нейросеть самостоятельно определяет оптимальную продолжительность видео от 4 до 30 секунд в зависимости от сложности и содержания запроса.

❣️Итоговая длительность может отличаться между генерациями, поэтому количество списываемых токенов также может меняться.

Длительность

У вас есть возможность установить длительность будущего видео от 4 до 30 секунд.

❣️Обратите внимание, что по умолчанию длительность в настройках выставлена на 5 секунды.

После того как вы написали запрос и проставили верные настройки, необходимо нажать кнопку «Сгенерировать».

Результат


💥 Пошаговое руководство по использованию Seedance 2.5 «Работа с разными референсами»

Первым делом при работе с разными референсами вам необходимо открыть «Настройки». Там можно загрузить все материалы, добавить текстовый запрос и настроить параметры будущего видео.

Настройки модели

Загрузка изображения

Технические требования к изображениям:

  • Вы можете добавлять изображения в формате JPG и PNG.
  • Максимальный вес файла: до 10 MB.
  • Максимальное количество загружаемых изображений: 30.

Например:

Загрузка видео

Технические требования к видео:

  • Формат файла: MP4
  • Максимальный вес файлов: до 200 MB
  • Максимальное количество загружаемых видео: 10
  • Суммарная длительность всех видео: до 30 секунд

Например:

Загрузка аудио

Технические требования к аудио:

  • Формат файла: MP3
  • Максимальное количество загружаемых аудио: 10
  • Суммарная длительность всех аудио: до 30 секунд

Например:

Промпт

Качественная генерация напрямую зависит от того, насколько точно и последовательно описана сцена. Важно не просто задать идею, а зафиксировать персонажа, окружение и поведение, чтобы избежать искажений и случайных изменений в процессе генерации.

Хороший текстовый запрос должен включать в себя:

  1. Описание персонажа/объекта

На этом этапе необходимо максимально подробно зафиксировать внешний вид персонажа или объекта. Важно указать ключевые черты: лицо, телосложение, причёску, одежду, материалы, форму, цвет и другие визуальные особенности. Если в видео участвует один и тот же персонаж или объект, это нужно обозначить отдельно, чтобы модель сохраняла его внешний вид на протяжении всей генерации, например:

«Same person in all shots. Preserve exact appearance throughout. Stable face throughout.»

  1. Действие

Необходимо чётко описать, что именно делает персонаж или объект, в какой последовательности происходят действия и как они взаимодействуют с окружением. Лучше использовать конкретные формулировки: не «идёт красиво», а «идёт вперёд уверенным шагом, поворачивает голову в камеру, поправляет воротник». Чем точнее заданы движения и их логика, тем стабильнее и понятнее результат.

  1. Локация

Необходимо подробно описать и зафиксировать пространство, в котором происходит сцена: интерьер или экстерьер, расположение объектов, атмосферу, фон и важные детали окружения.

  1. Освещение

Освещение задаёт настроение и глубину сцены, поэтому его желательно указывать отдельно. Можно описывать источник света, его характер и цвет: мягкий дневной свет, жёсткий контровой свет, тёплое объёмное освещение, неоновые акценты и т.д.

  1. Движение камеры

Важно указать тип съёмки и движение камеры, так как именно они определяют динамику видео. Можно комбинировать разные подходы: плавные пролёты, резкие приближения, смену ракурсов и т.д.

  1. Ограничения и стабильность

В завершении запроса рекомендуется зафиксировать технические ограничения, которые помогают сделать результат чище и стабильнее. Обычно здесь указывают отсутствие искажений, мерцания, деформаций, случайных изменений лица, одежды или сцены, например:

«No deformation. No flickering. No ghosting. Stable face throughout. Realistic physics.»

7.        Текст для озвучки

При необходимости вы можете дополнительно указать конкретный текст для озвучки и модель использует его при формировании финального результата. Для этого добавьте фразу, которую персонаж должен произнести. Фраза должна быть написана в виде прямой речи.

Например: Мужчина говорит: «Where are we going tonight?».

Дополнительные рекомендации:

  • Избегайте размытых формулировок («красиво», «интересно», «круто») - они не дают модели чёткого понимания результата
  • При необходимости разбивайте сценарий по времени (например: [0–3s], [3–6s]) для более точного контроля динамики и последовательности действий
  • При работе с персонажами фиксируйте их внешний вид и поведение, чтобы избежать случайных изменений
  • Рекомендуется писать запросы на английском языке, так модель точнее интерпретирует формулировки и лучше понимает детали, стили и движения камеры. Это особенно важно для сложных сцен и динамики, где требуется высокая точность результата
  • Чем подробнее и точнее описан запрос, тем более качественным и предсказуемым будет результат.
❗️Важно для работы с аудио
  1. Аудиофайл может использоваться моделью как готовая звуковая дорожка или как референс голоса, интонации и музыкального стиля. Поэтому в текстовом запросе рекомендуется явно указывать назначение каждого загруженного файла.
  2. Если используется несколько аудиофайлов, обозначьте их нумерацию и роль, например: какой файл содержит речь конкретного персонажа, какой используется для музыки, а какой для звуковых эффектов.
  3. При работе с русской речью рекомендуется избегать слишком длинных и сложных фраз, модель может перегенерировать речь, из-за чего произношение и отдельные слова могут искажаться.
  4. Также рекомендуется указывать приоритет звуков: речь должна оставаться на переднем плане, а музыка и звуковые эффекты не должны её перекрывать.
  5. Аудиореференсы могут влиять не только на звук, но и на длительность и темп действий, мимику персонажей, монтаж и движение камеры. Модель старается синхронизировать визуальную часть видео с ритмом и продолжительностью аудио.
Система тегов

Главной особенностью при работе с референсами в данном инструменте является система тегов. Чтобы добавить тег в запрос, нажмите на миниатюру нужного изображения - тег будет автоматически вставлен в поле запроса.

Это помогает нейросети точнее понимать, какое изображение необходимо использовать в определённой части запроса.

Например:

«Use all uploaded references to create a 10-second photorealistic cinematic perfume commercial set in a modern city during an extreme windstorm.

Reference assignment:

@ref1- primary female character reference. Use the woman from this image as the only main character. Preserve her exact facial features, face shape, skin tone, hairstyle, hair color, body proportions and overall identity throughout the entire video. Same woman in all shots. Stable face and identity.

@ref2- windstorm and motion reference. Use this video as the primary reference for the strength, direction and physical behavior of the wind. Recreate the violent urban wind, dramatically bending trees, flying leaves, papers, branches, trash and lightweight street objects. Use the reference for storm intensity and realistic wind physics, but do not copy its exact camera composition.

@ref3- primary dialogue reference. The woman must speak the exact dialogue from this audio. Preserve the original words, voice, pronunciation, timing, pacing and intonation. Do not rewrite, regenerate or reinterpret the speech. Her mouth movements and facial expressions must accurately synchronize with the uploaded audio.

@ref4- perfume bottle reference. Use the exact perfume bottle shown in this image. Preserve its shape, proportions, glass, color, cap, label, materials and recognizable design. The bottle must remain visually consistent whenever visible.

Key Concept: A premium cinematic perfume commercial built around the contrast between absolute chaos and complete confidence. A violent windstorm tears through a modern city while the woman remains calm and composed, looking directly into the camera and delivering the dialogue from @ref3. During her speech, the perfume bottle emerges from the storm, flies toward her through the chaotic city and lands naturally in her hand.

[0:00–0:02] Medium cinematic shot of the woman standing confidently in the middle of a modern city street. She looks directly into the camera and immediately begins speaking the exact dialogue from @ref3.

The wind is already powerful. Her hair and clothing move dramatically but naturally. Behind her, trees bend, leaves race across the pavement and loose papers fly through the air.

The camera slowly pushes toward her while she remains completely calm.

[0:02–0:04] The wind becomes significantly stronger while she continues speaking.

The camera smoothly moves around her into a slight three-quarter angle. In the background, branches shake violently, garbage bins roll across the street, café chairs slide across the pavement and lightweight debris flies through the air.

Her performance remains controlled, elegant and confident despite the chaos surrounding her.

[0:04–0:06] A massive gust travels down the street from the distant background toward the woman.

Far behind her, the exact perfume bottle from @ref4 becomes visible inside the moving debris.

The bottle is carried forward by the wind, rotating naturally through the air while approaching rapidly.

The camera briefly shifts focus from the woman’s face to the approaching bottle and then back to her.

[0:06–0:08] The perfume bottle flies directly beside the woman.

Brief cinematic slow motion.

The camera performs a tight dynamic orbit as the bottle rotates through the air in extreme detail. Leaves, papers and small droplets or particles remain suspended around it. Reflections move realistically across the glass surface.

The woman calmly extends one hand without interrupting her dialogue.

The bottle rotates once more and lands naturally in her open hand exactly as she reaches the final part of the spoken phrase.

[0:08–0:10] The woman closes her fingers around the bottle and raises it elegantly beside her face.

At that exact moment, the violent wind begins to weaken. Flying debris falls away and the trees gradually stop bending while her hair continues moving gently in the remaining breeze.

She finishes the exact dialogue from @ref3 and maintains direct confident eye contact with the camera.

The camera rapidly pushes toward the perfume bottle, transitioning into an extreme macro product shot. The exact bottle from @ref4 fills the foreground while the woman’s face and the recovering city remain softly visible behind it.

End on a polished luxury advertising composition with the perfume bottle clearly visible.

@ref3 is the highest audio priority. The woman’s dialogue must remain loud, clear and fully intelligible throughout. Do not generate additional dialogue or alter the uploaded speech.

Add realistic urban wind ambience, moving branches, flying paper and environmental sounds underneath the dialogue. All environmental audio must remain significantly quieter than her voice. No additional background music unless it already exists in @ref3.

Accurate lip synchronization is essential. Synchronize the woman’s mouth movement, facial expressions and natural gestures with the exact timing of @ref3.

Visual style: luxury perfume advertising, photorealistic cinematic realism, sophisticated fashion aesthetic combined with dramatic disaster-movie scale, premium commercial lighting, realistic skin, detailed hair and fabric, volumetric daylight, cinematic HDR, shallow depth of field and high contrast.

Wind physics are essential. Hair, clothing, trees, leaves, branches, papers, trash and the perfume bottle must react consistently to the same dominant wind direction. The perfume bottle must travel naturally from the distant background toward the woman. Do not make the bottle randomly appear or teleport into her hand.

Maintain strict reference consistency. @ref1 controls the woman’s identity. @ref2 wind intensity and physics. @ref3 controls dialogue, voice and timing. @ref4 controls the perfume bottle.

No identity drift. No face changes. No morphing. No distorted hands. No extra fingers. No duplicated perfume bottles. No changing bottle design. No teleportation of the bottle. No random character appearances. No tornado funnel. No sandstorm. No supernatural magic effects. No deformation. No flickering. No ghosting.

Photorealistic cinematic 4K, realistic physics, high motion clarity, detailed glass reflections, natural facial animation and polished premium advertising quality.»

Модель

В данной Базе Знаний описана работа с моделью «Seedance 2.5».

Узнать как работать с моделью «Seedance 2.0» можно тут: Seedance 2.0

Режим

При работе в модели Seedance 2.5 вам доступно 4 режима на выбор. Для работы с референсом аудио вам необходимо выбрать режим «Omni Reference».

Omni Reference – основной режим, позволяющий одновременно использовать несколько референсов: изображения, видео и аудио. Они помогают модели сохранять внешность персонажей, объекты, локации, стиль, движения и звуковое сопровождение.

Разрешение

При работе с аудио референсом вам доступно три варианта разрешения:

  • 480p

Базовое разрешение видео. Оно идеально подходит для просмотра на небольших экранах мобильных устройств и экономит интернет-трафик. Видео может выглядеть немного размытым, а мелкие детали будут не очень четкими.

  • 720p

Среднее разрешение видео. Обеспечивает хороший баланс между качеством видео и размером файла. Этот формат стал популярным стандартом для онлайн-видео, включая YouTube, и обеспечивает четкую картинку, комфортную для просмотра на телевизорах среднего размера и большинстве современных устройств.

  • 1080p

Представляет собой высококачественный формат видео, обеспечивающий превосходную детализацию и четкость. Этот формат идеально подходит для просмотра на больших экранах и телевизорах, хотя требует более быстрого интернет-соединения и занимает значительно больше места на устройстве хранения, но взамен предоставляет максимально четкое и детализированное видео.

Аудио

При использовании аудио-референса ползунок должен быть включён. Если его отключить, генерация будет происходить без звука, даже при наличии референса аудио.

Соотношение сторон

При работе в режиме «Omni Reference» вам доступно 7 вариантов соотношения сторон на выбор:

Автоматическая длительность

Автоматическая длительность – это режим, при котором нейросеть самостоятельно определяет оптимальную продолжительность видео от 4 до 30 секунд в зависимости от сложности и содержания запроса.

❣️Итоговая длительность может отличаться между генерациями, поэтому количество списываемых токенов также может меняться.

Длительность

У вас есть возможность установить длительность будущего видео от 4 до 30 секунд.

❣️Обратите внимание, что по умолчанию длительность в настройках выставлена на 5 секунды.

После того как вы написали запрос и проставили верные настройки, необходимо нажать кнопку «Сгенерировать».

Результат


💥 Пошаговое руководство по использованию Seedance 2.5 «Продление видео (Extend)»

Первым делом при работе с продлением видео вам необходимо открыть «Настройки». Там можно загрузить все материалы, добавить текстовый запрос и настроить параметры будущего видео.

Настройки модели

Загрузка видео

Технические требования к видео:

  • Формат файла: MP4
  • Максимальный вес файлов: до 200 MB
  • Максимальное количество загружаемых видео: 10
  • Суммарная длительность всех видео: до 30 секунд

Например:

Промпт

Качественная генерация напрямую зависит от того, насколько точно и последовательно описана сцена. Важно не просто задать идею, а зафиксировать персонажа, окружение и поведение, чтобы избежать искажений и случайных изменений в процессе генерации.

Хороший текстовый запрос должен включать в себя:

  1. Описание персонажа/объекта

На этом этапе необходимо максимально подробно зафиксировать внешний вид персонажа или объекта. Важно указать ключевые черты: лицо, телосложение, причёску, одежду, материалы, форму, цвет и другие визуальные особенности. Если в видео участвует один и тот же персонаж или объект, это нужно обозначить отдельно, чтобы модель сохраняла его внешний вид на протяжении всей генерации, например:

«Same person in all shots. Preserve exact appearance throughout. Stable face throughout.»

  1. Действие

Необходимо чётко описать, что именно делает персонаж или объект, в какой последовательности происходят действия и как они взаимодействуют с окружением. Лучше использовать конкретные формулировки: не «идёт красиво», а «идёт вперёд уверенным шагом, поворачивает голову в камеру, поправляет воротник». Чем точнее заданы движения и их логика, тем стабильнее и понятнее результат.

  1. Локация

Необходимо подробно описать и зафиксировать пространство, в котором происходит сцена: интерьер или экстерьер, расположение объектов, атмосферу, фон и важные детали окружения.

  1. Освещение

Освещение задаёт настроение и глубину сцены, поэтому его желательно указывать отдельно. Можно описывать источник света, его характер и цвет: мягкий дневной свет, жёсткий контровой свет, тёплое объёмное освещение, неоновые акценты и т.д.

  1. Движение камеры

Важно указать тип съёмки и движение камеры, так как именно они определяют динамику видео. Можно комбинировать разные подходы: плавные пролёты, резкие приближения, смену ракурсов и т.д.

  1. Ограничения и стабильность

В завершении запроса рекомендуется зафиксировать технические ограничения, которые помогают сделать результат чище и стабильнее. Обычно здесь указывают отсутствие искажений, мерцания, деформаций, случайных изменений лица, одежды или сцены, например:

«No deformation. No flickering. No ghosting. Stable face throughout. Realistic physics.»

Дополнительные рекомендации:

  • Избегайте размытых формулировок («красиво», «интересно», «круто») - они не дают модели чёткого понимания результата
  • При необходимости разбивайте сценарий по времени (например: [0–3s], [3–6s]) для более точного контроля динамики и последовательности действий
  • При работе с персонажами фиксируйте их внешний вид и поведение, чтобы избежать случайных изменений
  • Рекомендуется писать запросы на английском языке, так модель точнее интерпретирует формулировки и лучше понимает детали, стили и движения камеры. Это особенно важно для сложных сцен и динамики, где требуется высокая точность результата
  • Чем подробнее и точнее описан запрос, тем более качественным и предсказуемым будет результат.
Система тегов

Главной особенностью при работе с референсами в данном инструменте является система тегов. Чтобы добавить тег в запрос, нажмите на миниатюру нужного изображения - тег будет автоматически вставлен в поле запроса.

Это помогает нейросети точнее понимать, какое изображение необходимо использовать в определённой части запроса.

Например:

«Continue directly from the exact final frame of the reference video @ref1. The extension must begin seamlessly with the same two characters running toward the black sports car outside the museum at night.

Preserve the exact appearance and identity of both characters from the original video. Preserve the same black sports car, museum entrance, rainy nighttime environment, red emergency lighting, wet pavement and cinematic visual style.

The woman is still carrying the stolen blue diamond. The diamond must remain clearly visible and consistent with the original video.

Do not restart or recreate the previous scene. Continue the action immediately from the final movement of the reference video.

[0:00–0:01] The woman and man reach the black sports car simultaneously. The man quickly opens the driver’s door while the woman reaches the passenger side, still holding the glowing blue diamond tightly in one hand. Rain pours around them and red alarm lights flash across the wet body of the car.

The camera rapidly moves closer at a low angle while both characters enter the vehicle.

[0:01–0:02] Both doors slam shut almost simultaneously.

Immediate interior shot from the center of the dashboard. The man grips the steering wheel and aggressively starts the car while the woman drops into the passenger seat beside him.

She briefly looks down at the blue diamond in her hand, then looks toward the road ahead.

The engine roars.

The man immediately accelerates.

[0:02–0:03] The black sports car launches forward at extreme speed.

Camera switches to an extremely low cinematic tracking shot directly beside the rear wheel. The tire spins violently across the rain-soaked pavement, throwing water backward.

The car performs a sharp controlled drift away from the museum entrance.

Headlights sweep across the street while red emergency lights stretch into reflections across the wet asphalt.

[0:03–0:04] The camera rapidly orbits around the drifting car as it turns onto a wider nighttime city street.

In the background, two dark security vehicles suddenly emerge from the museum area with bright headlights and flashing lights, beginning pursuit.

The sports car straightens violently and accelerates away.

Rain, reflections and city lights streak across the frame.

[0:04–0:05] Dynamic rear tracking shot extremely close behind the sports car as it accelerates through the wet city street.

The camera rapidly pulls backward and slightly upward, revealing the black sports car racing through the center of the illuminated city while the two pursuing vehicles enter the street far behind.

Final moment: the sports car aggressively turns around a corner and disappears between the buildings while its red taillights reflect across the rain-covered asphalt.

One seamless five-second continuation: characters reach the car → enter simultaneously → engine starts → aggressive launch → high-speed drift → pursuit begins → escape into the nighttime city.

Maintain direct continuity with the final frame of the reference video. Preserve the exact two characters, their clothing, the blue diamond and the black sports car. The woman must keep possession of the diamond throughout the extension.

Visual style: photorealistic high-budget spy thriller, luxury action film aesthetic, dramatic nighttime rain, deep blacks, red emergency lighting, bright headlights, wet reflective pavement, cinematic contrast and realistic vehicle lighting.

Camera: rapid low-angle push-in, brief interior dashboard shot, extreme low wheel tracking, dynamic orbit around the drifting vehicle and fast rear tracking shot. Energetic cinematic editing with strong motion clarity.

Realistic vehicle physics. Natural door movement, realistic acceleration, tire rotation, suspension movement, wet-road traction, water spray and controlled drifting. Rain must interact naturally with the vehicle and environment.

No identity changes. No character swapping. No clothing changes. Do not remove or change the blue diamond. Do not change the sports car design. No deformation. No flickering. No ghosting. No distorted hands or faces. No duplicated characters. No warped vehicle geometry. No random environment changes. Photorealistic cinematic 4K, realistic motion, detailed reflections, high motion clarity.»

Модель

В данной Базе Знаний описана работа с моделью «Seedance 2.5».

Узнать как работать с моделью «Seedance 2.0» можно тут: Seedance 2.0

Режим

При работе в модели Seedance 2.5 вам доступно 4 режима на выбор. Для работы с продлением видео вам необходимо выбрать режим «Extend».

Extend - это режим для продолжения уже готового видео. Вы загружаете исходный ролик, а нейросеть генерирует его дальнейшее продолжение, сохраняя персонажей, окружение, стиль и общую логику сцены.

Разрешение

При работе с продлением видео вам доступно три варианта разрешения:

  • 480p

Базовое разрешение видео. Оно идеально подходит для просмотра на небольших экранах мобильных устройств и экономит интернет-трафик. Видео может выглядеть немного размытым, а мелкие детали будут не очень четкими.

  • 720p

Среднее разрешение видео. Обеспечивает хороший баланс между качеством видео и размером файла. Этот формат стал популярным стандартом для онлайн-видео, включая YouTube, и обеспечивает четкую картинку, комфортную для просмотра на телевизорах среднего размера и большинстве современных устройств.

  • 1080p

Представляет собой высококачественный формат видео, обеспечивающий превосходную детализацию и четкость. Этот формат идеально подходит для просмотра на больших экранах и телевизорах, хотя требует более быстрого интернет-соединения и занимает значительно больше места на устройстве хранения, но взамен предоставляет максимально четкое и детализированное видео.

Аудио

При работе в нейросети Seedance 2.5 у вас есть возможность создавать видео с аудио.

Чтобы добавить звуковые эффекты, включите ползунок - нейросеть автоматически подберёт и наложит аудио.

Если вы предпочитаете генерацию без звука - необходимо выключить ползунок.

Соотношение сторон

При работе в режиме «Extend» соотношение сторон определяется автоматически и не подлежит ручному выбору.

Автоматическая длительность

Автоматическая длительность – это режим, при котором нейросеть самостоятельно определяет оптимальную продолжительность видео от 4 до 30 секунд в зависимости от сложности и содержания запроса.

❣️Итоговая длительность может отличаться между генерациями, поэтому количество списываемых токенов также может меняться.

Длительность

При работе с продлением видео вы можете выбрать длительность продлённого фрагмента от 4 до 30 секунд.

❣️ Исходное видео не объединяется с продлённым фрагментом. В результате генерации вы получите только продолжение загруженного видео.

После того как вы написали запрос и проставили верные настройки, необходимо нажать кнопку «Сгенерировать».

Результат


Мы надеемся, что эта инструкция поможет вам лучше понять возможности Seedance 2.5 и уверенно использовать инструмент в работе. Мы постарались сделать её максимально простой и понятной, чтобы вы могли быстро приступить к практике. Если в процессе возникают сложности - это естественно.

Экспериментируйте, пробуйте разные подходы и постепенно находите решения, которые подходят именно вам. Со временем вы сможете всё точнее управлять результатом и получать именно тот визуал, который задумывали. 💛


SYNTX AI: Syntx AI
SYNTX Сообщество: Syntx Community
Блог SYNTX FAMILY: Syntx Family Служба Заботы SYNTX: Syntx Support