Text to video with audio
LTX-2.3 22B omdanner én enkelt skriftlig prompt til et færdigt videoklip med synkroniseret lyd. I stedet for at generere et lydløst klip og derefter lede efter lydeffekter eller musik, beskriver du den scene, du ønsker, og modellen leverer bevægelige billeder og matchende lyd samlet på én gang. Det gør den ideel til filmskabere, der bygger hurtige previsualiseringer, indholdsskabere, der producerer korte sociale klip, motion designere, der udforsker idéer, og enhver kunstner, som vil gøre et koncept levende uden at røre ved en tidslinje.
I sin kerne læser modellen din tekstprompt og bygger en video ud fra den. En god prompt beskriver ikke kun, hvad der vises på skærmen, men også fornemmelsen – for eksempel: "En cowboy, der går gennem en støvet by ved højlys dag, kameraet følger bagfra, filmisk dybde, realistisk belysning, westernstemning, 4K filmkorn." Jo mere du beskriver stemning, belysning, kameraføring og tekstur, desto tættere kommer resultatet på det, du forestillede dig. Modellen kan også automatisk udvide din prompt og tilføje filmisk detalje, så selv en kort beskrivelse giver et rigt, sammenhængende klip.
Du har bred kontrol over form og længde på dit klip. Videoer kan vare fra et kort øjeblik på 9 frames op til 481 frames, og du vælger billedhastighed fra 1 til 60 billeder i sekundet – standard er 24 billeder i sekundet, som er klassisk filmfrekvens. Standardklippet er 121 frames i bredformat 16:9, hvilket passer naturligt til widescreen og sociale medier, men du kan vælge andre formater, der matcher dit projekt. Afspilningshastighed og længde arbejder sammen, så flere frames ved lavere billedhastighed giver en langsommere følelse, mens højere billedhastighed giver mere jævn bevægelse.
En af de mest kreative værktøjer er direkte kamerakontrol. I stedet for at håbe, modellen tolker en sætning som "zoom ind på motivet" korrekt, kan du vælge imellem rigtige kamerabevægelser: dolly ind, dolly ud, dolly venstre, dolly højre, jib op, jib ned eller et statisk låst skud. Disse giver dig det bevidste, gentagelige kamerasprog, filmskabere stoler på, og du kan justere intensiteten, så bevægelsen føles subtil eller dramatisk. Det gør det langt nemmere at få intentionel bevægelse, som understøtter din fortælling i stedet for tilfældig drift.
Lyd genereres som standard sammen med videoen, og du kan slå det fra, hvis du kun har brug for stilbilleder. Du har også separate kreative kontroller for, hvor tæt lyd og video følger din prompt, og hvordan disse vægtes op mod hinanden – nyttigt, hvis du enten vil have lydbilledet i fokus eller holde opmærksomheden på det visuelle.
For at hjælpe med sammenhæng og detalje bruger modellen en multi-skala tilgang; den skitserer først videoen i mindre format og bruger derefter denne kladde til at guide et større, mere detaljeret billede. Resultatet er stærkere konsistens og renere detalje, end hvis du skaber videoen i fuld størrelse på én gang. Du kan desuden styre, hvor tæt modellen følger din prompt versus hvor meget kreativ frihed den tager, justere graden af forfining for balance mellem hastighed og finish og bruge en kontrolleret variationsfunktion, der kan løfte kvaliteten i vanskelige scener.
En negativ prompt giver dig mulighed for at styre modellen væk fra udtryk, du ikke ønsker. Som standard undgår den blandt andet tegnefilms- og spilæstetik, on-screen tekst, vandmærker, logoer, undertekster, slowmotion og statiske eller flade klip – så resultatet får et mere filmisk, live-action præg. Du kan omskrive dette, så det passer til dine egne æstetiske mål.
Når det gælder eksport, kan du vælge mellem flere formater, der passer til dit workflow: standard MP4, WebM, ProRes til professionel redigering eller animeret GIF til let deling. Kvalitetsniveauer går fra lav op til maksimum, og du kan vælge filtype efter hurtigere generering, mindre størrelse eller en balanceret mellemvej. Accelerationsindstillinger gør det muligt at vælge mellem hurtig generering eller maksimal kvalitet, afhængigt af om du itererer hurtigt eller færdiggør det endelige skud.
For at kunne gentage resultater kan du sætte et seed, så samtlige indstillinger med samme prompt giver præcis det samme resultat – smart, hvis du vil lave små, kontrollerede ændringer i stedet for at starte forfra hver gang. En indbygget sikkerhedstjekker er aktiveret som standard.
LTX-2.3 22B er bedst til korte, filmiske videoer: stemningsbilleder, konceptskud, sociale klip, animatics og idéudforskning, hvor indbygget, synkroniseret lyd sparer et helt redigeringstrin. Fordi klippene måles i frames og genereres som selvstændige øjeblikke, egner den sig bedst til enkle, stemningsfulde skud fremfor lange, mange-scene fortællinger. For at få det bedste udbytte handler det om beskrivende, filmiske prompts, bevidst kameraføring og at lade multi-skala renderingen og forædlingen gøre sit arbejde. Med kombinationen af prompt-baseret video, indbygget lyd og præcis kamerakontrol giver den skabere en hurtig vej fra idé på skrift til levende, lydfulde scener.
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
Beskriv din videoscene med bevægelse, kameravinkler og stemning
Modellen skaber filmisk bevægelse med naturlig fysik og lys
Download og del din produktionsklare video
Viser vedvarende tracking, køretøjsdynamik og motorlyd i en bredformat filmsekvens til YouTube og filmbrug.
Demonstrerer atmosfærisk tågedynamik, lysforløb og naturtro lyd til landskabsindhold i Netflix-stil.
Fremhæver modellens synkroniserede audio-visuelle generering med publikumslyde, dynamisk scenelys og energiske kamerabevægelser til biografisk widescreen-indhold.
“Cinematic reveal of a sleek black luxury sports car in a dark studio. Camera starts close on the chrome badge, slowly pulling back while orbiting 180 degrees around the vehicle. Dramatic rim lighting gradually intensifies, highlighting the car's sculptural curves and glossy finish. Reflections dance across the body as the camera moves. Dust particles float in volumetric light beams. Final wide shot reveals the full silhouette against a gradient backdrop. 8 seconds, smooth motion, 24fps cinematic quality.”
Skift til ræsonnementsstyret syntese i dag

Cinematic video with native audio
1.4 credits

Cinematic video from references
10 credits

Fast balanced text-to-video generation
1.6 credits

Fast cinematic video with audio
0.1 credits
![Kling Video v3 Text to Video [Standard]](https://v3b.fal.media/files/b/0a8cfc9f/dei5OqFRB9HK8AgSHwk8f_9a5eea197b3045d1be55aedb0213f6f9.jpg)
Cinematic text-to-video with audio
4.2 credits

Text to video with audio
0.3 credits

Cinematic video from references
0.4 credits

Frontier 2K text-to-video generation
7.3 credits

Film-grade video with audio
0.1 credits