Cinematic video from references
Seedance 2.0 Fast Reference to Video adalah model video berbasis referensi paling canggih dari ByteDance, disediakan dalam tingkat cepat yang dioptimalkan untuk hasil lebih cepat tanpa mengorbankan rentang kreatif. Alih-alih menghasilkan video hanya dari prompt teks semata, model ini memungkinkan Anda memasukkan materi referensi Anda sendiri lalu mengatur bagaimana elemen-elemen tersebut bersatu di layar. Anda dapat menggabungkan hingga sembilan gambar referensi, hingga tiga video referensi, dan hingga tiga klip audio dalam satu generasi, mencampur dan mencocokkan sumber visual serta sonik untuk mengarahkan tampilan, gerakan, dan suara klip akhir.
Yang membedakan model ini adalah cara langsung Anda dapat merujuk referensi di dalam prompt. Setiap file gambar, video, dan audio yang diunggah akan mendapat penanda sederhana, sehingga Anda bisa menulis hal seperti @Image1, @Video2, atau @Audio1 langsung di deskripsi untuk memberi tahu model sumber mana yang harus memengaruhi momen atau subjek tertentu. Artinya, Anda tidak hanya berharap model menangkap suasana hati, melainkan menyebut karakter dari satu gambar, gaya gerakan dari klip, serta suara atau ambience dari trek audio, lalu mendeskripsikan bagaimana mereka berinteraksi. Ini adalah alur kerja yang dibuat untuk mentransformasi dan menistilkan materi yang ada, membawa karakter dan tampilan melintasi tembakan, serta menyinkronkan bibir pada penampilan dengan audio yang disediakan.
Model ini menghasilkan video jadi dengan audio tersinkronisasi. Saat pembuatan audio diaktifkan, ia menghasilkan efek suara, kebisingan ambient, dan ucapan tersinkronisasi bibir yang sesuai dengan aksi di layar, sehingga subjek yang berbicara menggerakkan mulutnya tepat waktu dengan kata-kata. Jika Anda lebih suka menyediakan soundtrack atau suara sendiri, Anda bisa memberikan klip audio referensi dan merujuknya di prompt. Perhatikan bahwa setiap kali menyertakan audio referensi, Anda juga memerlukan setidaknya satu gambar atau video referensi agar model memiliki jangkar visual untuk suara tersebut.
Anda memiliki kontrol fleksibel atas framing. Pilih dari berbagai rasio aspek termasuk 16:9 lebar untuk lanskap, 9:16 vertikal dan konten prioritas mobile, 1:1 persegi untuk feed sosial, ultrawide 21:9 untuk urutan sinematik, plus opsi 4:3 dan 3:4, atau biarkan model memutuskan secara otomatis berdasarkan prompt Anda. Durasi juga bisa disesuaikan: hasilkan klip dari 4 hingga 15 detik, atau atur otomatis agar panjangnya sesuai cerita yang Anda deskripsikan. Rentang ini memudahkan pembuatan segala hal mulai dari klip sosial looping cepat hingga beat naratif yang lebih panjang.
Untuk kualitas output, Anda bisa pilih 480p untuk generasi lebih cepat dan 720p untuk hasil seimbang. Ada juga kontrol kualitas yang memungkinkan permintaan versi berkualitas lebih tinggi dengan file lebih besar saat Anda ingin footage paling bersih, atau tetap gunakan versi standar untuk file lebih kecil. Pengaturan ini memungkinkan pertukaran antara kecepatan dan ukuran file dengan ketajaman, tergantung apakah Anda sedang mengiterasi ide dengan cepat atau mengekspor karya akhir.
Input yang didukung luas dan praktis. Gambar referensi bisa JPEG, PNG, atau WebP. Video referensi bisa MP4 atau MOV, dengan resolusi kasar antara 480p dan 720p, serta panjang gabungan klip antara 2 dan 15 detik. Audio referensi bisa MP3 atau WAV, dengan total audio tidak lebih dari 15 detik di semua klip. Secara keseluruhan untuk semua jenis file, Anda bisa sertakan hingga dua belas item referensi dalam satu generasi, memberikan palet kaya untuk digambar sambil tetap mudah dikelola model.
Model ini cocok untuk berbagai profesional kreatif. Filmmaker dan editor video bisa gunakan untuk menistilkan dan mentransformasi footage, memperpanjang adegan, atau menyatukan beberapa take menjadi satu tembakan kohesif. Pembuat konten dan produser media sosial mendapat manfaat dari opsi framing vertikal dan persegi serta durasi pendek yang cocok untuk feed. Desainer karakter dan animator bisa andalkan sistem referensi untuk menjaga subjek tetap dikenali sepanjang klip dan menggerakkan lip-sync dari suara yang disediakan. Musisi dan pencerita audio bisa padukan trek dengan visual lalu biarkan model menyelaraskan gerakan dengan suara. Karena Anda bisa merujuk sumber spesifik dengan nama di prompt, model ini menghargai arahan yang disengaja dan deskriptif: semakin jelas Anda jelaskan referensi mana yang melakukan apa dan bagaimana adegan harus berlangsung, semakin banyak kontrol atas hasilnya.
Beberapa pertimbangan praktis patut diingat. Audio referensi selalu butuh setidaknya satu gambar atau video referensi bersamanya. Video referensi harus masuk dalam jendela resolusi dan panjang yang didukung, serta total audio gabungan tidak boleh melebihi lima belas detik. Jumlah referensi keseluruhan dari gambar, video, dan audio maksimal dua belas file, jadi rencanakan sumber mana yang paling penting untuk tembakan Anda. Resolusi lebih tinggi dan kualitas lebih tinggi menghasilkan tampilan lebih baik dengan file lebih besar tapi butuh waktu render lebih lama, sementara 480p dan versi standar ideal untuk iterasi cepat. Seperti generasi berbasis referensi lainnya, hasil lebih baik saat materi sumber bersih, terang, dan terframing jelas, serta prompt menyebut setiap referensi secara eksplisit dan mendeskripsikan gerakan, suasana, dan suara yang diinginkan. Digunakan begini, Seedance 2.0 Fast Reference to Video menjadi alat fleksibel untuk mengubah gambar, klip, dan audio Anda sendiri menjadi video pendek tersinkronisasi suara dengan tampilan yang Anda arahkan.
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
Jelaskan adegan video Anda beserta gerakan, sudut kamera, dan suasana
Model menciptakan gerakan sinematik dengan fisika dan pencahayaan alami
Unduh dan bagikan video siap produksi Anda
Menunjukkan simulasi fisika dunia nyata model dan dinamika atmosferik — merender sistem cuaca meyakinkan, gerakan hewan, dan transformasi lingkungan dramatis dengan bahasa sinematik kualitas Netflix dan audio asli.
Menampilkan presisi Seedance 2.0 dengan fisika objek, dinamika cairan, detail makro, dan transisi bergaya mulus — ideal untuk sinematografi produk mewah dengan foley tersinkronisasi dan audio atmosferik.
“Cinematic reveal of a sleek black luxury sports car in a dark studio. Camera starts close on the chrome badge, slowly pulling back while orbiting 180 degrees around the vehicle. Dramatic rim lighting gradually intensifies, highlighting the car's sculptural curves and glossy finish. Reflections dance across the body as the camera moves. Dust particles float in volumetric light beams. Final wide shot reveals the full silhouette against a gradient backdrop. 8 seconds, smooth motion, 24fps cinematic quality.”
Beralih ke sintesis berbasis penalaran hari ini

Cinematic video from references
10 kredit

Fast balanced text-to-video generation
1.6 kredit

Cinematic video with native audio
1.4 kredit

Frontier 2K text-to-video generation
7.3 kredit

Fast cinematic video with audio
0.1 kredit
Text to video with audio
0.7 kredit
![Kling Video v3 Text to Video [Standard]](https://v3b.fal.media/files/b/0a8cfc9f/dei5OqFRB9HK8AgSHwk8f_9a5eea197b3045d1be55aedb0213f6f9.jpg)
Cinematic text-to-video with audio
4.2 kredit

Film-grade video with audio
0.1 kredit

Text to video with audio
0.3 kredit