Cinematic video from references
Seedance 2.0 Fast Reference to Video — это самая передовая модель видео на основе референсов от ByteDance, представленная в быстром варианте, настроенном на более быстрые результаты без ущерба для творческого диапазона. Вместо генерации видео только из текстового промпта она позволяет загрузить в модель свои собственные референсные материалы и затем оркестровать, как эти элементы сочетаются на экране. Вы можете комбинировать до девяти референсных изображений, до трех референсных видео и до трех аудиоклипов в одной генерации, смешивая и подбирая визуальные и звуковые источники для управления внешним видом, движением и звуком готового клипа.
Что отличает эту модель — это возможность прямо указывать на референсы внутри промпта. Каждое загруженное изображение, видео или аудиофайл получает простой идентификатор, поэтому вы пишете вещи вроде @Image1, @Video2 или @Audio1 прямо в описании, чтобы точно указать модели, какой источник должен влиять на какой момент или объект. Это значит, что вы не просто надеетесь, что модель уловит настроение, — вы называете персонажа из одного изображения, стиль движения из клипа и голос или атмосферу из аудиодорожки, а затем описываете, как они взаимодействуют. Это рабочий процесс, созданный для трансформации и стилизации существующих материалов, переноса персонажей и стилей через кадры и синхронизации губ с предоставленным аудио.
Модель выдает готовое видео с синхронизированным аудио. Когда включена генерация аудио, она создает звуковые эффекты, фоновый шум и речь с синхронизацией губ, соответствующую действию на экране, так что говорящий объект двигает ртом в такт словам. Если вы предпочитаете предоставить свою собственную саундтрек или голос, вы можете загрузить референсные аудиоклипы и ссылаться на них в промпте. Обратите внимание: при включении референсного аудио вам также нужно хотя бы одно референсное изображение или видео, чтобы у модели было визуальное основание для привязки звука.
У вас гибкий контроль над кадрированием. Выберите из полного набора соотношений сторон, включая широкоэкранное 16:9 для альбомной ориентации, 9:16 для вертикальной и мобильного контента, квадратное 1:1 для соцсетей, ультраширокое 21:9 для кинематографических последовательностей, плюс варианты 4:3 и 3:4 или позвольте модели выбрать автоматически на основе промпта. Длительность тоже гибкая: генерируйте клипы от 4 до 15 секунд или установите автоматический режим, чтобы длина соответствовала описанной истории. Этот диапазон позволяет легко создавать всё — от короткого зацикленного клипа для соцсетей до более длинного нарративного фрагмента.
Для качества вывода вы можете выбрать 480p для быстрой генерации или 720p для сбалансированного результата. Есть также контроль качества, позволяющий запросить версию повышенного качества с большим файлом, когда нужна самая чистая картинка, или остаться на стандартной версии для меньших файлов. Эти настройки позволяют менять скорость и размер файла в обмен на точность в зависимости от того, быстро ли вы итерируете идеи или экспортируете финальный ролик.
Поддерживаемые входные данные широкие и практичные. Референсные изображения могут быть в JPEG, PNG или WebP. Референсные видео — MP4 или MOV, каждое примерно в разрешении от 480p до 720p, с общей длиной клипов от 2 до 15 секунд. Референсное аудио — MP3 или WAV, с общей длительностью не более 15 секунд по всем клипам. В сумме по всем типам файлов вы можете включить до двенадцати референсных элементов в одной генерации, получая богатую палитру источников, но сохраняя управляемость для модели.
Эта модель идеально подходит для широкого круга творческих профессионалов. Кинорежиссеры и видеоредакторы могут использовать ее для стилизации и трансформации материала, продления сцены или смешивания нескольких дублей в единый coherentный кадр. Контент-креаторы и продюсеры для соцсетей выиграют от вертикальных и квадратных форматов и коротких, ярких длительностей для лент. Дизайнеры персонажей и аниматоры опираются на систему референсов, чтобы сохранить узнаваемость объекта через клип и обеспечить синхронизацию губ с предоставленным голосом. Музыканты и аудио-рассказчики могут сочетать трек с визуалом и позволить модели синхронизировать движение со звуком. Поскольку вы можете ссылаться на конкретные источники по имени в промпте, модель вознаграждает осознанное, описательное направление: чем четче вы указываете, какой референс что делает и как развивается сцена, тем больше контроля над результатом.
Несколько практических моментов стоит иметь в виду. Референсное аудио всегда требует хотя бы одного референсного изображения или видео рядом. Ваши референсные видео должны укладываться в поддерживаемые разрешение и длину, а общая аудиодлительность — в 15 секунд. Общее количество референсов по изображениям, видео и аудио не превышает двенадцать файлов, так что планируйте, какие источники важнее для кадра. Более высокое разрешение и качество дают красивые, большие файлы, но требуют больше времени на рендер, в то время как 480p и стандартная версия идеальны для быстрой итерации. Как и в любой генерации на основе референсов, результаты улучшаются, если исходный материал чистый, хорошо освещенный и четко кадрированный, а промпт явно называет каждый референс и описывает желаемое движение, настроение и звук. Так Seedance 2.0 Fast Reference to Video становится гибким инструментом для превращения ваших изображений, клипов и аудио в короткие видео с синхронизированным звуком и стилем по вашему указанию.
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
Опишите сцену вашего видео: движение, ракурсы камеры и настроение
Модель создаёт кинематографичное движение с естественной физикой и освещением
Скачайте видео, готовое к публикации, и поделитесь им
Демонстрирует симуляцию физики реального мира и атмосферную динамику модели — рендеринг правдоподобных погодных систем, движения животных и драматических трансформаций окружения в кинематографическом стиле Netflix с нативным аудио.
Показывает точность Seedance 2.0 в физике объектов, динамике жидкостей, макро-деталях и плавных стилизованных переходах — идеально для кинематографии люксовых продуктов с синхронизированным фоли и атмосферным аудио.
“Cinematic reveal of a sleek black luxury sports car in a dark studio. Camera starts close on the chrome badge, slowly pulling back while orbiting 180 degrees around the vehicle. Dramatic rim lighting gradually intensifies, highlighting the car's sculptural curves and glossy finish. Reflections dance across the body as the camera moves. Dust particles float in volumetric light beams. Final wide shot reveals the full silhouette against a gradient backdrop. 8 seconds, smooth motion, 24fps cinematic quality.”
Перейдите на синтез с поддержкой рассуждений уже сегодня

Text to video with audio
0.3 кредитов

Cinematic video from references
10 кредитов
![Kling Video v3 Text to Video [Standard]](https://v3b.fal.media/files/b/0a8cfc9f/dei5OqFRB9HK8AgSHwk8f_9a5eea197b3045d1be55aedb0213f6f9.jpg)
Cinematic text-to-video with audio
4.2 кредитов

Fast cinematic video with audio
0.1 кредитов
Text to video with audio
0.7 кредитов

Cinematic video with native audio
1.4 кредитов

Frontier 2K text-to-video generation
7.3 кредитов

Fast balanced text-to-video generation
1.6 кредитов

Film-grade video with audio
0.1 кредитов