Text to video with audio
LTX-2.3 22B menukar satu prompt bertulis tunggal menjadi klip video siap lengkap dengan audio tersinkron miliknya sendiri. Daripada menjana klip senyap dan kemudian mencari kesan bunyi atau muzik untuk ditimpa selepas itu, anda huraikan adegan yang anda mahu dan model itu menyampaikan imej bergerak dan bunyi sepadan bersama dalam satu laluan sahaja. Ini menjadikannya sesuai untuk pembuat filem yang membina previsualisasi cepat, pencipta kandungan yang menghasilkan klip sosial pendek, pereka gerakan yang meneroka idea, dan mana-mana artis yang mahu melihat konsep bergerak dan berbunyi hidup tanpa menyentuh timeline.
Inti model membaca prompt teks anda dan membina video daripadanya. Prompt yang baik bukan sahaja menerangkan apa yang muncul di skrin tetapi juga bagaimana ia terasa — contohnya, "Seorang koboi berjalan melalui bandar berdebu pada tengah hari, kamera mengikuti dari belakang, kedalaman sinematik, pencahayaan realistik, mood western, 4K butiran filem." Semakin anda huraikan mood, pencahayaan, tingkah laku kamera, dan tekstur, semakin dekat hasilnya dengan apa yang anda bayangkan. Model juga boleh mengembangkan prompt anda secara automatik, mengisi butiran sinematik supaya walaupun huraian pendek menghasilkan penggambaran yang kaya dan koheren.
Anda mempunyai kawalan luas ke atas bentuk dan panjang klip anda. Video boleh berjalan dari seketika 9 bingkai sehingga 481 bingkai, dan anda tetapkan kadar bingkai dari 1 hingga 60 bingkai sesaat, dengan 24 bingkai sesaat — irama filem klasik — sebagai lalai. Klip lalai ialah 121 bingkai footage landskap 16:9, sesuai untuk video skrin lebar dan sosial, tetapi anda boleh pilih framing lain untuk projek anda. Kelajuan putar balik dan panjang bekerjasama, jadi bilangan bingkai lebih panjang pada kadar bingkai lebih rendah memberi seketika lebih perlahan dan lebih dilipatgandakan, manakala kadar bingkai lebih tinggi memberi gerakan lebih lancar.
Salah satu alat kreatif terbaik ialah kawalan kamera langsung. Daripada mengharap model mentafsir frasa seperti "push in on the subject," anda boleh pilih dari set gerakan kamera sebenar: dolly in, dolly out, dolly left, dolly right, jib up, jib down, atau penggambaran statik locked-off. Ini memberi anda bahasa kamera yang disengajakan dan boleh diulang yang dibuang oleh pembuat filem, dan anda boleh laras kekuatan gerakan itu naik atau turun supaya terasa halus atau dramatik. Ini memudahkan mendapatkan gerakan sengaja yang menyokong cerita anda daripada hanyutan rawak.
Audio dijana bersama video secara lalai, dan anda boleh matikan jika anda hanya perlukan footage senyap. Anda juga mempunyai pengawal kreatif berasingan untuk betapa ketat audio dan video masing-masing melekat pada prompt anda, dan bagaimana kedua-duanya seimbang antara satu sama lain — berguna apabila anda mahu landskap bunyi terasa menonjol atau mahu fokus kekal pada visual.
Untuk membantu koherensi keseluruhan dan butiran halus, model menggunakan pendekatan multi-skala. Ia terlebih dahulu melakar video pada skala kecil, kemudian menggunakan draf itu untuk membimbing render akhir yang lebih besar dan lebih terperinci. Hasilnya ialah konsistensi lebih kuat dan butiran lebih bersih daripada menjana pada saiz penuh dalam satu tembakan. Anda boleh laras lagi betapa dekat model mengikuti prompt anda berbanding betapa banyak kebebasan kreatif yang diambilnya, laras tahap penulenan untuk keseimbangan antara kelajuan dan kilau, dan gunakan pilihan variasi terkawal yang boleh meningkatkan kualiti pada adegan sukar.
Prompt negatif memberi anda cara untuk mengarahkan model menjauh daripada rupa yang anda tidak mahu. Secara lalai ia mengelak perkara seperti estetika kartun dan video permainan, teks pada skrin, tera air, logo, sari kata, gerakan perlahan, dan footage statik rata — mendorong hasil ke arah rasa sinematik, aksi langsung. Anda boleh tulis semula ini untuk matlamat estetika anda sendiri.
Bagi output, anda boleh eksport dalam beberapa format untuk sesuai dengan aliran kerja anda: MP4 standard, WebM, ProRes untuk saluran penyuntingan tinggi, atau GIF animasi untuk perkongsian ringan. Tahap kualiti dari rendah hingga maksimum, dan anda boleh beratkan fail ke arah penulisan lebih cepat, saiz lebih kecil, atau tengah seimbang. Tetapan pecutan membolehkan anda pertukar antara kelajuan penjanaan dan ketepatan bergantung sama ada anda mengulang cepat atau mem akhirkan tembakan hero.
Untuk boleh diulang, anda boleh tetapkan seed supaya prompt dan tetapan sama menghasilkan hasil sama — berguna apabila anda mahu buat perubahan kecil terkawal daripada mula semula setiap kali. Pemeriksa keselamatan terbina diaktifkan secara lalai.
LTX-2.3 22B paling sesuai untuk video sinematik bentuk pendek: kepingan mood, penggambaran konsep, klip sosial, animatik, dan penerokaan idea di mana bunyi tersinkron yang dibakar masuk menjimatkan satu langkah penyuntingan. Kerana klip diukur dalam bingkai dan dijana sebagai seketika terkandung sendiri, ia bersinar pada penggambaran tunggal evocatif daripada naratif panjang berbilangan adegan. Mendapatkan yang paling daripadanya bergantung pada menulis prompt deskriptif sinematik, memilih gerakan kamera sengaja, dan membiarkan render multi-skala dan penulenan melakukan kerja mereka. Dengan gabungan video dipacu prompt, audio asal, dan kawalan kamera tepat, ia memberi pencipta laluan cepat dari idea bertulis ke adegan bergerak berbunyi.
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
Terangkan babak video anda dengan pergerakan, sudut kamera dan mood
Model mencipta pergerakan sinematik dengan fizik dan pencahayaan semula jadi
Muat turun dan kongsi video sedia-produksi anda
Memaparkan gerakan penjejakan berterusan, dinamik kenderaan, dan penjanaan audio enjin dalam urutan sinematik skrin lebar untuk YouTube dan filem.
Memaparkan dinamik kabus atmosfera, peralihan pencahayaan, dan audio alam immersif untuk kandungan landskap dokumentari gaya Netflix.
Menyeriai penjanaan audio-visual tersinkron model dengan bunyi orang ramai, pencahayaan pentas dinamik, dan gerakan kamera energetik untuk sinema landskap.
“Cinematic reveal of a sleek black luxury sports car in a dark studio. Camera starts close on the chrome badge, slowly pulling back while orbiting 180 degrees around the vehicle. Dramatic rim lighting gradually intensifies, highlighting the car's sculptural curves and glossy finish. Reflections dance across the body as the camera moves. Dust particles float in volumetric light beams. Final wide shot reveals the full silhouette against a gradient backdrop. 8 seconds, smooth motion, 24fps cinematic quality.”
Beralih ke sintesis dipandu penaakulan hari ini

Text to video with audio
0.3 kredit

Fast balanced text-to-video generation
1.6 kredit

Cinematic video from references
0.4 kredit

Cinematic video with native audio
1.4 kredit

Frontier 2K text-to-video generation
7.3 kredit

Fast cinematic video with audio
0.1 kredit

Film-grade video with audio
0.1 kredit
![Kling Video v3 Text to Video [Standard]](https://v3b.fal.media/files/b/0a8cfc9f/dei5OqFRB9HK8AgSHwk8f_9a5eea197b3045d1be55aedb0213f6f9.jpg)
Cinematic text-to-video with audio
4.2 kredit

Cinematic video from references
10 kredit