Text to video with audio
LTX-2.3 22B는 단일 텍스트 프롬프트를 자체 동기화된 오디오가 포함된 완성된 비디오 클립으로 변환합니다. 무음 클립을 생성한 후 사운드 효과나 음악을 나중에 덧붙여 찾는 대신, 원하는 장면을 설명하면 모델이 한 번에 움직이는 이미지와 일치하는 사운드를 함께 제공합니다. 이는 영화 제작자들이 빠른 프리비주얼라이제이션을 구축하거나, 콘텐츠 크리에이터가 짧은 소셜 클립을 제작하고, 모션 디자이너가 아이디어를 탐구하며, 타임라인을 건드리지 않고 컨셉을 움직이고 소리가 나는 모습을 보고 싶은 모든 아티스트에게 강력한 적합성을 제공합니다.
모델의 핵심은 텍스트 프롬프트를 읽고 이를 바탕으로 비디오를 생성하는 것입니다. 좋은 프롬프트는 화면에 나타나는 것뿐만 아니라 느낌까지 설명합니다. 예를 들어, "한낮의 먼지 낀 마을을 걸어가는 카우보이, 뒤에서 따라가는 카메라, 시네마틱 깊이감, 사실적인 조명, 서부 분위기, 4K 필름 그레인." 분위기, 조명, 카메라 동작, 텍스처를 더 자세히 설명할수록 결과물이 상상한 모습에 가까워집니다. 모델은 프롬프트를 자동으로 확장하여 시네마틱 세부 사항을 채워넣어 짧은 설명조차 풍부하고 일관된 샷을 생성합니다.
클립의 형태와 길이에 대한 광범위한 제어가 가능합니다. 비디오는 짧은 9프레임 순간부터 최대 481프레임까지 가능하며, 프레임 속도는 1에서 60 FPS까지 설정할 수 있습니다. 기본값은 24 FPS로 클래식한 필름 리듬입니다. 기본 클립은 121프레임의 16:9 가로세로비 비디오로 와이드스크린 및 소셜 비디오에 자연스럽게 맞습니다. 프로젝트에 맞게 다른 프레임 비율을 선택할 수 있습니다. 재생 속도와 길이가 함께 작동하므로, 낮은 프레임 속도의 긴 프레임 수는 느리고 길게 끌어당기는 순간을 만들고, 높은 프레임 속도는 부드러운 모션을 제공합니다.
뛰어난 창의적 도구 중 하나는 직접적인 카메라 제어입니다. "피사체에 푸시 인" 같은 구절을 모델이 해석하기를 기대하는 대신, 실제 카메라 이동을 선택할 수 있습니다: dolly in, dolly out, dolly left, dolly right, jib up, jib down, 또는 고정 정적 샷. 이는 영화 제작자들이 의존하는 의도적이고 반복 가능한 카메라 언어를 제공하며, 이동 강도를 미세하게 조정하여 은은하거나 극적인 느낌을 줄 수 있습니다. 이는 무작위 드리프트 대신 스토리텔링을 지원하는 의도적인 모션을 얻기 쉽게 만듭니다.
오디오는 기본적으로 비디오와 함께 생성되며, 무음 비디오만 필요하다면 끌 수 있습니다. 오디오와 비디오가 프롬프트에 얼마나 충실한지, 그리고 둘의 균형을 별도로 조정할 수 있습니다. 사운드스케이프를 강조하거나 비주얼에 집중하고 싶을 때 유용합니다.
전체 일관성과 세부 사항을 돕기 위해 모델은 다중 스케일 접근 방식을 사용합니다. 먼저 작은 스케일로 비디오를 스케치한 후, 이를 안내로 더 크고 상세한 최종 렌더를 생성합니다. 이는 한 번에 전체 크기로 생성하는 것보다 더 강한 일관성과 깨끗한 세부 사항을 제공합니다. 모델의 프롬프트 충실도 대 창의적 자유, 속도와 세련미 간 균형을 위한 정제 수준, 까다로운 장면의 품질 향상을 위한 제어된 변형 옵션을 추가로 조정할 수 있습니다.
부정 프롬프트는 원하지 않는 스타일을 피하는 방법입니다. 기본적으로 만화 및 비디오 게임 미학, 화면 텍스트, 워터마크, 로고, 자막, 슬로우 모션, 정적 평평한 비디오를 피하여 더 시네마틱하고 실사 느낌으로 유도합니다. 자신의 미학 목표에 맞게 재작성할 수 있습니다.
출력 시 워크플로에 맞는 여러 형식을 내보낼 수 있습니다: 표준 MP4, WebM, 고급 편집 파이프라인용 ProRes, 가벼운 공유용 애니메이티드 GIF. 품질 수준은 낮음에서 최대까지이며, 파일을 더 빠른 쓰기, 작은 크기, 또는 균형된 중간으로 편향할 수 있습니다. 가속 설정으로 빠른 반복 또는 최종 히어로 샷에 따라 생성 속도와 충실도를 조정합니다.
재현성을 위해 시드를 설정하면 동일한 프롬프트와 설정으로 동일한 결과를 얻을 수 있습니다. 작은 제어된 변경을 할 때 유용하며, 기본적으로 내장된 안전 검사기가 활성화됩니다.
LTX-2.3 22B는 단편 시네마틱 비디오에 최적화되어 있습니다: 분위기 피스, 컨셉 샷, 소셜 클립, 애니매틱, 아이디어 탐구 등에서 동기화된 사운드가 편집 단계를 절약합니다. 프레임 단위로 측정되고 자립형 순간으로 생성되므로 긴 멀티신 서사보다는 단일 evocative 샷에 강합니다. 최적의 활용은 서술적이고 시네마틱한 프롬프트 작성, 의도적인 카메라 이동 선택, 다중 스케일 렌더와 정제에 있습니다. 프롬프트 기반 비디오, 네이티브 오디오, 정밀 카메라 제어의 조합으로 텍스트 아이디어를 빠르게 움직이고 소리가 나는 장면으로 변환합니다.
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
움직임, 카메라 앵글, 분위기로 비디오 장면을 설명하세요
모델이 자연스러운 물리와 조명으로 영화 같은 움직임을 만들어냅니다
프로덕션에 바로 쓸 수 있는 비디오를 다운로드하고 공유하세요
YouTube와 필름용 와이드스크린 시네마틱 시퀀스에서 지속적인 트래킹 모션, 차량 역학, 엔진 오디오 생성을 보여줍니다.
Netflix 스타일 다큐멘터리 랜드스케이프 콘텐츠를 위한 분위기 있는 안개 역학, 조명 전환, 몰입형 자연 오디오를 보여줍니다.
랜드스케이프 시네마를 위한 군중 소리, 동적 무대 조명, 에너지 넘치는 카메라 모션과 동기화된 오디오-비주얼 생성을 강조합니다.
“Cinematic reveal of a sleek black luxury sports car in a dark studio. Camera starts close on the chrome badge, slowly pulling back while orbiting 180 degrees around the vehicle. Dramatic rim lighting gradually intensifies, highlighting the car's sculptural curves and glossy finish. Reflections dance across the body as the camera moves. Dust particles float in volumetric light beams. Final wide shot reveals the full silhouette against a gradient backdrop. 8 seconds, smooth motion, 24fps cinematic quality.”
오늘 바로 추론 기반 생성으로 전환하세요
![Kling Video v3 Text to Video [Standard]](https://v3b.fal.media/files/b/0a8cfc9f/dei5OqFRB9HK8AgSHwk8f_9a5eea197b3045d1be55aedb0213f6f9.jpg)
Cinematic text-to-video with audio
4.2 크레딧

Frontier 2K text-to-video generation
7.3 크레딧

Text to video with audio
0.3 크레딧

Film-grade video with audio
0.1 크레딧

Fast cinematic video with audio
0.1 크레딧

Cinematic video from references
0.4 크레딧

Cinematic video from references
10 크레딧

Cinematic video with native audio
1.4 크레딧

Fast balanced text-to-video generation
1.6 크레딧