Cinematic video from references
Seedance 2.0 Fast Reference to Video ialah model video rujukan paling canggih daripada ByteDance, disampaikan dengan tahap pantas yang dioptimumkan untuk hasil lebih cepat tanpa mengorbankan julat kreatif. Berbeza dengan menjana video hanya daripada arahan teks, anda boleh memberikan bahan rujukan anda sendiri kepada model dan mengarah bagaimana elemen-elemen itu digabungkan di skrin. Anda boleh menggabungkan sehingga sembilan imej rujukan, tiga video rujukan, dan tiga klip audio dalam satu generasi, mencampurkan dan memadankan sumber visual serta bunyi untuk mengawal rupa, pergerakan, dan bunyi klip yang terhasil.
Keistimewaan model ini adalah cara anda boleh merujuk rujukan anda secara langsung dalam arahan. Setiap imej, video, dan audio yang anda muat naik akan mendapatkan label mudah, jadi anda boleh menulis seperti @Image1, @Video2, atau @Audio1 terus dalam penerangan anda untuk memberitahu model sumber mana yang perlu mempengaruhi babak atau subjek tertentu. Ini bermakna anda tidak perlu berharap model memahami mood tertentu; anda boleh menamakan watak dari satu imej, gaya pergerakan dari satu klip, dan suara atau suasana dari trek audio, kemudian menggambarkan bagaimana mereka berinteraksi. Ia adalah alur kerja yang direka untuk mengubah dan menggayakan bahan sedia ada, membawa watak dan rupa merentasi babak, dan menyegerakkan pergerakan mulut dengan audio yang dibekalkan.
Model ini menghasilkan video siap dengan audio yang disegerakkan. Apabila penjanaan audio diaktifkan, ia akan menghasilkan kesan bunyi, bunyi suasana, dan ucapan yang selaras dengan pergerakan mulut subjek di skrin. Jika anda mahu menggunakan trek bunyi atau suara anda sendiri, anda boleh menyediakan klip audio rujukan dan merujuknya dalam arahan anda. Perlu diingat, setiap kali anda menyertakan audio rujukan, anda juga memerlukan sekurang-kurangnya satu imej atau video rujukan supaya model ada visual untuk dipadankan dengan bunyi tersebut.
Anda mempunyai kawalan fleksibel terhadap pemotongan babak. Pilih daripada pelbagai nisbah aspek termasuk 16:9 untuk landskap, 9:16 untuk kandungan menegak dan mudah alih, 1:1 empat segi untuk sosial media, 21:9 ultra lebar untuk babak sinematik, serta 4:3 dan 3:4, atau biarkan model tentukan secara automatik mengikut arahan anda. Durasi juga boleh diubah: hasilkan klip antara 4 hingga 15 saat, atau tetapkan secara automatik agar tempoh sesuai dengan cerita yang anda gariskan. Julat ini memudahkan anda menghasilkan segalanya daripada klip sosial pendek berulang kepada rentak naratif yang lebih panjang.
Untuk kualiti output, anda boleh pilih antara 480p untuk hasil lebih pantas dan 720p untuk keseimbangan antara kualiti dan masa. Terdapat juga kawalan kualiti yang membolehkan anda memohon versi berfail lebih besar untuk ketulenan visual paling kemas, atau kekal dengan versi standard untuk saiz fail lebih kecil. Tetapan ini membolehkan anda menukar keutamaan antara kelajuan dan saiz fail berdasarkan sama ada anda mahu cepat bereksperimen atau mengeksport karya akhir.
Input yang disokong adalah luas dan praktikal. Imej rujukan boleh dalam JPEG, PNG, atau WebP. Video rujukan boleh dalam MP4 atau MOV, dan setiapnya hendaklah sekurang-kurangnya 480p hingga 720p dalam resolusi, dengan jumlah panjang klip antara 2 hingga 15 saat. Audio rujukan boleh dalam MP3 atau WAV, dengan jumlah durasi audio di semua klip tidak melebihi 15 saat. Secara keseluruhan, anda boleh sertakan sehingga dua belas item rujukan dalam satu generasi, memberikan anda palet yang kaya untuk diolah tetapi masih mudah untuk model diuruskan.
Model ini sangat sesuai untuk pelbagai kumpulan kreatif profesional. Pembikin filem dan penyunting video boleh menggunakannya untuk menggayakan dan menukar rakaman, memanjangkan satu babak atau menggabungkan beberapa rakaman menjadi satu shot padu. Pencipta kandungan dan penerbit media sosial mendapat manfaat daripada pilihan framing menegak dan empat segi bersama jangka masa pendek sesuai untuk feeds. Pereka watak dan animator boleh menggunakan sistem rujukan untuk memastikan subjek kekal dikenali sepanjang klip dan menggerakkan lip-sync dari suara yang dibekalkan. Pemuzik dan pencerita audio boleh memadankan trek dengan visual dan membiarkan model menyeleraskan pergerakan dengan bunyi. Oleh kerana anda boleh merujuk sumber tertentu mengikut nama dalam arahan, model ini sangat menghargai arahan yang jelas dan terperinci: lebih anda jelaskan sumber mana digunakan untuk apa dan bagaimana babak berkembang, lebih banyak kawalan anda terhadap hasil.
Beberapa pertimbangan praktikal yang harus diingat. Audio rujukan sentiasa memerlukan sekurang-kurangnya satu imej atau video rujukan. Video rujukan anda perlu berada dalam jarak resolusi dan panjang yang disokong, dan jumlah keseluruhan audio tidak boleh melebihi lima belas saat. Jumlah rujukan semua imej, video, dan audio maksimum dua belas fail, jadi rancang dengan teliti sumber yang paling penting untuk shot anda. Resolusi dan kualiti lebih tinggi menghasilkan fail lebih cantik tapi mengambil masa lebih lama, manakala 480p dan versi standard paling sesuai untuk eksperimen pantas. Seperti mana-mana generasi berasaskan rujukan, hasil akan lebih baik jika sumber asal anda jelas, pencahayaan baik, framing kemas, dan anda menamakan setiap rujukan dalam arahan dengan keterangan pergerakan, mood, dan bunyi yang diinginkan. Digunakan dengan cara ini, Seedance 2.0 Fast Reference to Video menjadi alat fleksibel untuk menukar imej, klip, dan audio anda sendiri menjadi video pendek segerak bunyi dengan gaya yang anda tentukan.
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
Terangkan babak video anda dengan pergerakan, sudut kamera dan mood
Model mencipta pergerakan sinematik dengan fizik dan pencahayaan semula jadi
Muat turun dan kongsi video sedia-produksi anda
Menunjukkan simulasi fizik realiti model dan dinamik atmosfera — menghasilkan sistem cuaca dipercayai, pergerakan haiwan, serta transformasi persekitaran dramatik dengan sinematografi gaya Netflix dan audio asli.
Memperlihatkan ketepatan Seedance 2.0 dalam fizik objek, dinamik cecair, perincian makro, dan peralihan bergaya yang lancar — ideal untuk sinematografi produk mewah dengan foley dan audio atmosfera segerak.
“Cinematic reveal of a sleek black luxury sports car in a dark studio. Camera starts close on the chrome badge, slowly pulling back while orbiting 180 degrees around the vehicle. Dramatic rim lighting gradually intensifies, highlighting the car's sculptural curves and glossy finish. Reflections dance across the body as the camera moves. Dust particles float in volumetric light beams. Final wide shot reveals the full silhouette against a gradient backdrop. 8 seconds, smooth motion, 24fps cinematic quality.”
Beralih ke sintesis dipandu penaakulan hari ini

Cinematic video from references
10 kredit

Fast cinematic video with audio
0.1 kredit

Fast balanced text-to-video generation
1.6 kredit

Cinematic video with native audio
1.4 kredit

Film-grade video with audio
0.1 kredit

Text to video with audio
0.3 kredit
Text to video with audio
0.7 kredit

Frontier 2K text-to-video generation
7.3 kredit
![Kling Video v3 Text to Video [Standard]](https://v3b.fal.media/files/b/0a8cfc9f/dei5OqFRB9HK8AgSHwk8f_9a5eea197b3045d1be55aedb0213f6f9.jpg)
Cinematic text-to-video with audio
4.2 kredit