Cinematic video from references
Seedance 2 Reference to Video는 ByteDance에서 개발한 가장 진보된 레퍼런스 기반 비디오 생성 모델로, 텍스트 입력만이 아니라 실제 소스 자료로 영상을 연출하고 싶은 크리에이터를 위해 설계되었습니다. 모든 것을 처음부터 설명하는 대신, 최대 9장의 이미지, 3개의 비디오, 3개의 오디오(총 12개의 다양한 타입의 파일)를 조합해 모델에 입력하고 이를 프롬프트와 함께 연결합니다. 각 자산은 프롬프트에서 @Image1, @Video1, @Audio1과 같이 태그로 직접 지정해주므로, 모델이 정확히 어떤 얼굴, 환경, 동작, 소리를 반영해야 할지 알 수 있습니다. 결과물은 레퍼런스를 충실히 반영하면서 그 주변 세계를 자연스럽게 채워주는 하나의 연속적인 시네마틱 영상 클립입니다.
가장 큰 특징은 오디오의 동시 생성입니다. 한 번의 생성만으로 영상과 완벽하게 싱크된 소리가 함께 만들어집니다: 환경음, 효과음, 음악, 입모양에 맞는 대사까지 모두 장면에 정확히 맞춰 등장합니다. 따로 사운드를 합성할 필요가 없습니다. 즉, 북적이는 군중 장면이라면 겹쳐지는 외침, 카메라 셔터음, 멀리서 울리는 사이렌, 시동 걸린 엔진 소리까지 화면 동작에 맞춰 이미 완성되어 전달됩니다. 오디오 생성 여부는 설정에서 켜거나 끌 수 있으니 직접 사운드를 넣고 싶다면 비활성화하실 수도 있습니다.
창의적인 연출력은 이 모델의 큰 장점입니다. 프롬프트에서 시네마 카메라 용어를 활용하면 돌리줌, 트래킹샷, 핸드헬드 미세 흔들림, 시점 전환, 아이레벨/하이앵글 시점 등을 카메라 감독처럼 직접 지시할 수 있습니다. 모델은 이러한 연출을 실제 촬영감독처럼 해석합니다. 또, 물리 시뮬레이션도 자연스러워 액체, 천, 캐릭터 움직임 모두 사실적으로 표현됩니다. 특히 유용한 기능은 한 번에 15초까지 여러 컷의 장면전환(멀티샷 편집)이 자연스럽게 가능하다는 점입니다. 덕분에 단일 고정 프레임이 아닌, 장면이 자연스럽게 이어지는 시퀀스를 만들 수 있습니다.
이미지 레퍼런스를 받을 수 있기 때문에, 일관성에서 매우 뛰어납니다. 캐릭터 레퍼런스 이미지를 제공하면 다른 시각적 스타일(예: 스타일리시 3D ➝ 실사 합성)로 변환할 때도 같은 얼굴과 의상이 동일하게 재현됩니다. 예시에서는 3D 애니메이션 캐릭터가 완전히 실제와 같은 라이브액션 환경에 자연스럽게 합성되고, 인물의 얼굴과 의상이 원본 이미지 그대로 장면 전체에 유지됩니다. 실사 조명, 플래시 반사, 가로등 하이라이트, 그림자까지 모두 사실적으로 상호작용합니다. 반복 캐릭터, 특정 제품, 고정된 연출이 필요한 분들에게 이상적입니다.
출력 옵션도 유연합니다. 빠른 결과가 필요하면 480p, 속도-품질 균형은 720p, 고화질은 1080p까지 선택할 수 있습니다. 영상 길이는 4초~15초 범위에서 선택하거나 프롬프트에 따라 자동으로 설정할 수 있습니다. 화면 비율 역시 16:9(가로), 9:16(세로/소셜), 1:1, 21:9(시네마틱), 4:3, 3:4, 또는 auto로 모델에 맞길 수 있습니다. 고퀄리티 인코딩 요청, 시드 값 고정으로 결과 반복 생성도 가능합니다(단, 소폭 차이는 발생할 수 있음).
각 레퍼런스 입력 유형엔 합리적인 제한이 적용됩니다. 이미지는 JPEG, PNG, WebP형식 각 30MB 이내/최대 9장, 비디오는 MP4, MOV 지원, 총 215초, 전체 50MB 미만, 각 영상 480p720p, 최대 3개. 오디오는 MP3, WAV 각각 15MB 이하/최대 3개, 총 15초 이내. 중요한 규칙: 오디오 레퍼런스 입력 시 반드시 이미지 또는 비디오 레퍼런스가 1개 이상 필요합니다. 전체 파일 수는 어떤 조합이든 12개를 넘을 수 없습니다.
이점이 가장 큰 사용자는? 영화 및 영상감독들은 실제 카메라 언어와 완성된 사운드가 적용된 시네마틱 프리비주얼, 단편 시퀀스 제작에 활용할 수 있습니다. 크리에이터, 소셜미디어 제작자는 단일 캐릭터 레퍼런스를 일관된 세로 영상 클립으로 손쉽게 제작합니다. 광고주 및 마케터는 제품 이미지를 조명과 카메라 연출이 컨트롤된 스타일 환경에 삽입할 수 있습니다. 애니메이터, 믹스드미디어 아티스트는 스타일화된 캐릭터와 실사 환경의 하이브리드 합성 영상을 만들 수 있습니다. 자신의 이미지/비디오/오디오를 최대한 반영하는 만큼, 브랜드 일관성, 캐릭터 아이덴티티, 특정 룩이 중요한 모든 경우에 이상적입니다.
최적의 결과를 위한 실전 팁도 자연스럽게 따라옵니다. 프롬프트는 감독처럼 작성하세요: 스타일, 조명, 환경, 인물, 액션, 오디오 모두 묘사하고, @ 태그로 레퍼런스를 명확히 지정하세요. 영상 레퍼런스는 권장 길이/해상도에 맞춰 준비하면 처리 퀄리티가 좋습니다. 오디오 입력 시에는 반드시 1개 이상의 시각적 자료를 함께 넣어야 한다는 점을 기억하세요. 가장 완성도 높은 클립을 위해서는 군중/행렬 시퀀스 예시처럼 구체적 액션과 카메라 연출을 상세히 프롬프트에서 지시하는 것이 효과적입니다. 꼼꼼한 레퍼런스와 명확한 디렉션이 동반된다면, Seedance 2 Reference to Video는 소재를 충실히 반영한, 완성형 사운드 시네마틱 클립을 전달합니다.
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
움직임, 카메라 앵글, 분위기로 비디오 장면을 설명하세요
모델이 자연스러운 물리와 조명으로 영화 같은 움직임을 만들어냅니다
프로덕션에 바로 쓸 수 있는 비디오를 다운로드하고 공유하세요
Seedance 2의 감독급 카메라 연출력, 복잡한 카메라 무빙과 날씨 시뮬레이션, 드라마틱한 랜드스케이프 연출로 와이드스크린 여행 시네마에 적합합니다.
복잡한 씬 전환, 스타일화된 물리효과(유리 파편, 부유하는 잔해), 강렬한 조명 연출로 뮤직비디오의 컷씬 내러티브 제작에 최적화되어 있습니다.
Seedance 2의 실제 물리엔진과 환경 사운드(눈 밟는 소리, 바람, 호흡)까지 네이티브로 구현 — 동물 모션과 대기 역동도 Netflix급 다큐멘터리 퀄리티로 연출합니다.
“Cinematic reveal of a sleek black luxury sports car in a dark studio. Camera starts close on the chrome badge, slowly pulling back while orbiting 180 degrees around the vehicle. Dramatic rim lighting gradually intensifies, highlighting the car's sculptural curves and glossy finish. Reflections dance across the body as the camera moves. Dust particles float in volumetric light beams. Final wide shot reveals the full silhouette against a gradient backdrop. 8 seconds, smooth motion, 24fps cinematic quality.”
오늘 바로 추론 기반 생성으로 전환하세요

Cinematic video with native audio
1.4 크레딧

Fast balanced text-to-video generation
1.6 크레딧

Cinematic video from references
0.4 크레딧

Text to video with audio
0.3 크레딧

Film-grade video with audio
0.1 크레딧

Fast cinematic video with audio
0.1 크레딧

Frontier 2K text-to-video generation
7.3 크레딧
![Kling Video v3 Text to Video [Standard]](https://v3b.fal.media/files/b/0a8cfc9f/dei5OqFRB9HK8AgSHwk8f_9a5eea197b3045d1be55aedb0213f6f9.jpg)
Cinematic text-to-video with audio
4.2 크레딧
Text to video with audio
0.7 크레딧