Cinematic video from references
Seedance 2.0 Fast Reference to Video는 ByteDance의 가장 진보된 참조 기반 비디오 모델로, 창의적 범위를 희생하지 않으면서 더 빠른 결과를 위해 튜닝된 빠른 티어로 제공됩니다. 텍스트 프롬프트만으로 비디오를 생성하는 대신, 모델에 자신의 참조 자료를 제공하고 화면에서 그 요소들이 어떻게 결합되는지 안무할 수 있습니다. 하나의 생성에서 최대 아홉 개의 참조 이미지, 최대 세 개의 참조 비디오, 최대 세 개의 오디오 클립을 조합할 수 있으며, 시각적 및 음향 소스를 섞어 완성된 클립의 외관, 움직임, 소리를 조절할 수 있습니다.
이 모델을 차별화하는 점은 프롬프트 내에서 참조 자료를 직접 지정할 수 있다는 것입니다. 업로드한 모든 이미지, 비디오, 오디오 파일에 간단한 핸들이 부여되므로, 설명문에서 @Image1, @Video2, @Audio1과 같이 작성하여 모델에게 정확히 어떤 소스가 어떤 순간이나 주체에 영향을 미쳐야 하는지 알려줄 수 있습니다. 즉, 모델이 분위기를 파악하기만을 기대하는 것이 아니라, 한 이미지의 캐릭터, 클립의 움직임 스타일, 오디오 트랙의 목소리나 분위기를 명시하고 그것들이 어떻게 상호작용하는지 설명할 수 있습니다. 이는 기존 자료를 변환하고 스타일화하며, 샷 간 캐릭터와 외관을 유지하고, 제공된 오디오에 맞춰 립싱크를 수행하는 워크플로를 위해 설계되었습니다.
모델은 동기화된 오디오가 포함된 완성된 비디오를 출력합니다. 오디오 생성이 활성화되면 화면의 행동에 맞는 효과음, 주변 소음, 립싱크된 대사를 생성하므로 말하는 주체의 입이 단어에 맞춰 움직입니다. 자체 사운드트랙이나 목소리를 제공하고 싶다면 참조 오디오 클립을 제공하고 프롬프트에서 참조할 수 있습니다. 참조 오디오를 포함할 때는 모델이 소리를 고정할 시각적 요소를 위해 최소 하나의 참조 이미지 또는 비디오가 필요하다는 점을 유의하세요.
프레임 구성에 유연한 제어가 가능합니다. 16:9 와이드스크린(가로), 9:16(세로 및 모바일 우선 콘텐츠), 1:1 정사각형(소셜 피드용), 21:9 울트라와이드(시네마틱 시퀀스용), 4:3 및 3:4 옵션 등 전체 비율 세트를 선택하거나 프롬프트에 따라 모델이 자동으로 결정하게 할 수 있습니다. 지속 시간도 유연합니다: 4~15초 사이의 클립을 생성하거나 설명한 스토리에 맞춰 자동으로 길이를 설정할 수 있습니다. 이 범위는 빠른 루프 소셜 클립부터 긴 서사적 비트까지 쉽게 제작할 수 있게 합니다.
출력 품질을 위해 480p(빠른 생성) 또는 720p(균형 잡힌 결과)를 선택할 수 있습니다. 더 깨끗한 영상을 원할 때 고품질 대용량 파일 버전을 요청할 수 있는 품질 제어 기능도 있으며, 작은 파일을 위해 표준 버전을 사용할 수 있습니다. 이러한 설정으로 아이디어 빠른 반복 시 속도와 파일 크기를, 최종 작품 내보내기 시 충실도를 우선할 수 있습니다.
지원 입력은 광범위하고 실용적입니다. 참조 이미지는 JPEG, PNG, WebP를 지원합니다. 참조 비디오는 MP4 또는 MOV로, 해상도는 대략 480p720p 사이여야 하며, 클립의 총 길이는 215초 사이여야 합니다. 참조 오디오는 MP3 또는 WAV로, 모든 클립의 총 오디오 길이는 15초를 초과하지 않아야 합니다. 모든 파일 유형을 합쳐 하나의 생성에서 최대 12개의 참조 항목을 포함할 수 있어 풍부한 팔레트를 활용하면서도 모델이 관리하기 쉽게 유지할 수 있습니다.
이 모델은 다양한 창작 전문가에게 적합합니다. 영화 제작자와 비디오 편집자는 영상을 스타일화하고 변환하거나 장면을 연장하거나 여러 테이크를 하나의 일관된 샷으로 블렌딩할 수 있습니다. 콘텐츠 크리에이터와 소셜 미디어 프로듀서는 피드에 최적화된 세로 및 정사각형 프레임과 짧고 강렬한 지속 시간을 활용할 수 있습니다. 캐릭터 디자이너와 애니메이터는 참조 시스템으로 클립 전체에서 주체를 인식 가능하게 유지하고 제공된 목소리로 립싱크를 구동할 수 있습니다. 뮤지션과 오디오 스토리텔러는 트랙을 비주얼과 페어링하고 모델이 움직임을 소리에 맞추게 할 수 있습니다. 프롬프트에서 특정 소스를 이름으로 참조할 수 있으므로, 의도적이고 상세한 지시를 내릴수록 결과에 대한 제어가 커집니다.
몇 가지 실용적인 고려사항을 유의하세요. 참조 오디오는 항상 최소 하나의 참조 이미지 또는 비디오와 함께 사용해야 합니다. 참조 비디오는 지원 해상도와 길이 범위 내여야 하며, 총 오디오 길이는 15초 이내여야 합니다. 이미지, 비디오, 오디오 전체 참조 수는 12개로 제한되므로 샷에 가장 중요한 소스를 계획하세요. 높은 해상도와 고품질은 더 나은 외관의 대용량 파일을 생성하지만 렌더링 시간이 길어지며, 480p와 표준 버전은 빠른 반복에 이상적입니다. 참조 기반 생성에서와 마찬가지로, 소스 자료가 깨끗하고 조명이 좋으며 명확하게 프레임된 경우, 프롬프트에서 각 참조를 명시적으로 지정하고 원하는 움직임, 분위기, 소리를 설명하면 결과가 향상됩니다. 이렇게 사용하면 Seedance 2.0 Fast Reference to Video는 자신의 이미지, 클립, 오디오를 직접 지시하는 외관의 짧은 사운드 싱크 비디오로 변환하는 유연한 도구가 됩니다.
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
움직임, 카메라 앵글, 분위기로 비디오 장면을 설명하세요
모델이 자연스러운 물리와 조명으로 영화 같은 움직임을 만들어냅니다
프로덕션에 바로 쓸 수 있는 비디오를 다운로드하고 공유하세요
모델의 실세계 물리 시뮬레이션과 대기 역학을 보여줍니다. 믿을 만한 날씨 시스템, 동물 움직임, 극적인 환경 변화를 Netflix 품질 시네마틱 언어와 네이티브 오디오로 렌더링합니다.
Seedance 2.0의 물체 물리, 액체 역학, 매크로 수준 디테일, 완벽한 스타일화 전환 정밀도를 선보입니다. 동기화된 풀리와 대기 오디오를 포함한 럭셔리 제품 시네마토그래피에 이상적입니다.
“Cinematic reveal of a sleek black luxury sports car in a dark studio. Camera starts close on the chrome badge, slowly pulling back while orbiting 180 degrees around the vehicle. Dramatic rim lighting gradually intensifies, highlighting the car's sculptural curves and glossy finish. Reflections dance across the body as the camera moves. Dust particles float in volumetric light beams. Final wide shot reveals the full silhouette against a gradient backdrop. 8 seconds, smooth motion, 24fps cinematic quality.”
오늘 바로 추론 기반 생성으로 전환하세요

Film-grade video with audio
0.1 크레딧
![Kling Video v3 Text to Video [Standard]](https://v3b.fal.media/files/b/0a8cfc9f/dei5OqFRB9HK8AgSHwk8f_9a5eea197b3045d1be55aedb0213f6f9.jpg)
Cinematic text-to-video with audio
4.2 크레딧

Frontier 2K text-to-video generation
7.3 크레딧

Cinematic video with native audio
1.4 크레딧
Text to video with audio
0.7 크레딧

Cinematic video from references
10 크레딧

Text to video with audio
0.3 크레딧

Fast cinematic video with audio
0.1 크레딧

Fast balanced text-to-video generation
1.6 크레딧