Cinematic video from references
Seedance 2.0 Fast Reference to Video — це найпередовіша модель відео на основі референсів від ByteDance, надана в швидкому рівні, налаштованому для швидших результатів без втрати творчого діапазону. Замість генерації відео лише з текстового запиту, вона дозволяє надати моделі власні референсні матеріали та хореографувати, як ці елементи поєднуються на екрані. Ви можете комбінувати до дев’яти референсних зображень, до трьох референсних відео та до трьох аудіокліпів в одній генерації, змішуючи візуальні та звукові джерела, щоб керувати виглядом, рухом і звуком готового кліпу.
Те, що вирізняє цю модель, — це те, як безпосередньо ви можете посилатися на референси всередині запиту. Кожне завантажене зображення, відео чи аудіофайл отримує простий ідентифікатор, тому ви пишете такі речі, як @Image1, @Video2 або @Audio1, прямо у своєму описі, щоб сказати моделі точно, яке джерело має впливати на той чи інший момент або суб’єкт. Це означає, що ви не просто сподіваєтеся, що модель вловить настрій, — ви називаєте персонажа з одного зображення, стиль руху з кліпу та голос чи атмосферу з аудіодоріжки, а потім описуєте, як вони взаємодіють. Це робочий процес, створений для трансформації та стилізації наявних матеріалів, перенесення персонажів і вигляду через кадри та синхронізації губ з наданим аудіо.
Модель видає готове відео з синхронізованим аудіо. Коли генерація аудіо увімкнена, вона створює звукові ефекти, атмосферний шум і синхронізовану з губами мову, що відповідає діям на екрані, тому суб’єкт, що говорить, рухає ротом у такт словам. Якщо ви віддаєте перевагу власній саундтреку чи голосу, ви можете надати референсні аудіокліпи та посилатися на них у запиті. Зверніть увагу, що коли ви включаєте референсне аудіо, вам також потрібно принаймні одне референсне зображення чи відео, щоб модель мала візуальну основу для звуку.
Ви маєте гнучкий контроль над кадруванням. Вибирайте з повного набору співвідношень сторін, включаючи широке 16:9 для ландшафтного формату, 9:16 для вертикального та контенту для мобільних, 1:1 квадрат для стрічок у соцмережах, ультрашироке 21:9 для кінематографічнихシー, плюс 4:3 і 3:4, або дозвольте моделі вирішити автоматично на основі запиту. Тривалість також адаптивна: генеруйте кліпи від 4 до 15 секунд або встановіть автоматично, щоб довжина відповідала описаній історії. Цей діапазон полегшує створення всього — від швидкого циклічного кліпу для соцмереж до довшого наративного фрагмента.
Для якості виводу ви можете обрати 480p для швидшої генерації та 720p для збалансованого результату. Також є контроль якості, що дозволяє запросити версію вищої якості з більшим файлом, коли потрібне найчистіше відео, або залишитися зі стандартною версією для менших файлів. Ці налаштування дозволяють обмінювати швидкість і розмір файлу на точність залежно від того, чи швидко ітеруєте ідеї, чи експортуєте фінальний продукт.
Підтримувані входи широкі та практичні. Референсні зображення можуть бути JPEG, PNG або WebP. Референсні відео — MP4 або MOV, кожне з роздільною здатністю приблизно від 480p до 720p, з сумарною довжиною кліпів від 2 до 15 секунд. Референсне аудіо — MP3 або WAV, з загальною тривалістю не довше 15 секунд на всі кліпи. Загалом по всіх типах файлів ви можете включити до дванадцяти референсних елементів в одній генерації, надаючи багату палітру для роботи, зберігаючи все керованим для моделі.
Ця модель добре підходить для широкого кола творчих професіоналів. Кінематографісти та відеоредактори можуть використовувати її для стилізації та трансформації зйомок, розширення сцени чи змішування кількох дублів в один згуртований кадр. Контент-креатори та продюсери соцмереж виграють від вертикальних і квадратних форматів та коротких, динамічних тривалостей для стрічок. Дизайнери персонажів та аніматори можуть покладатися на систему референсів, щоб зберегти суб’єкта впізнаваним через кліп і керувати синхронізацією губ з наданим голосом. Музиканти та аудіооповідачі можуть поєднувати трек з візуалами та дозволити моделі узгодити рух зі звуком. Оскільки ви можете посилатися на конкретні джерела за назвою в запиті, модель винагороджує свідоме, описове керування: що чіткіше ви вказуєте, який референс що робить і як розгортається сцена, то більше контролю отримуєте над результатом.
Декілька практичних порад варто пам’ятати. Референсне аудіо завжди потребує принаймні одного референсного зображення чи відео поряд. Ваші референсні відео мають відповідати підтримуваній роздільній здатності та тривалості, а загальне аудіо — не перевищувати п’ятнадцяти секунд. Загальна кількість референсів по зображеннях, відео та аудіо обмежена дванадцятьма файлами, тож плануйте, які джерела найважливіші для кадру. Вища роздільна здатність і вища якість дають кращий вигляд і більші файли, але потребують більше часу на рендер, тоді як 480p і стандартна версія ідеальні для швидкої ітерації. Як і в будь-якій генерації на основі референсів, результати покращуються, коли вихідний матеріал чистий, добре освітлений і чітко кадрований, а запит явно називає кожен референс і описує рух, настрій та звук. Використовуючи таким чином, Seedance 2.0 Fast Reference to Video стає гнучким інструментом для перетворення власних зображень, кліпів і аудіо на короткі відео з синхронізованим звуком і керованою візуальною стилістикою.
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
Опишіть свою відеосцену з рухом, ракурсами камери та настроєм
Модель створює кінематографічний рух з природною фізикою та освітленням
Завантажте та поділіться готовим до публікації відео
Демонструє симуляцію реальної фізики моделі та атмосферну динаміку — відтворює правдоподібні погодні системи, рух тварин і драматичні трансформації середовища з кіномовою Netflix-якості та нативним аудіо.
Показує точність Seedance 2.0 з фізикою об’єктів, динамікою рідин, макродеталями та безшовними стилізованими переходами — ідеально для люксової продуктової кінематографії з синхронізованим фолі та атмосферним аудіо.
“Cinematic reveal of a sleek black luxury sports car in a dark studio. Camera starts close on the chrome badge, slowly pulling back while orbiting 180 degrees around the vehicle. Dramatic rim lighting gradually intensifies, highlighting the car's sculptural curves and glossy finish. Reflections dance across the body as the camera moves. Dust particles float in volumetric light beams. Final wide shot reveals the full silhouette against a gradient backdrop. 8 seconds, smooth motion, 24fps cinematic quality.”
Перейдіть на синтез із керованим мисленням вже сьогодні

Frontier 2K text-to-video generation
7.3 кредитів

Text to video with audio
0.3 кредитів
![Kling Video v3 Text to Video [Standard]](https://v3b.fal.media/files/b/0a8cfc9f/dei5OqFRB9HK8AgSHwk8f_9a5eea197b3045d1be55aedb0213f6f9.jpg)
Cinematic text-to-video with audio
4.2 кредитів

Cinematic video with native audio
1.4 кредитів

Fast cinematic video with audio
0.1 кредитів

Cinematic video from references
10 кредитів

Fast balanced text-to-video generation
1.6 кредитів
Text to video with audio
0.7 кредитів

Film-grade video with audio
0.1 кредитів