Text to video with audio
يحول LTX-2.3 22B طلبًا مكتوبًا واحدًا إلى مقطع فيديو مكتمل مع صوت متزامن خاص به. بدلاً من إنشاء مقطع صامت ثم البحث عن تأثيرات صوتية أو موسيقى لإضافتها لاحقًا، تصف المشهد الذي تريده ويقوم النموذج بتسليم صور متحركة وصوت مطابق معًا في خطوة واحدة. هذا يجعله مناسبًا جدًا لصانعي الأفلام الذين يبنون تصورات أولية سريعة، ومنشئي المحتوى الذين ينتجون مقاطع اجتماعية قصيرة، ومصممي الحركة الذين يستكشفون الأفكار، وأي فنان يريد رؤية مفهوم يتحرك ويصدر صوتًا حيًا دون لمس جدول زمني.
في جوهره، يقرأ النموذج طلبك النصي ويبني فيديو منه. طلب جيد يصف ليس فقط ما يظهر على الشاشة بل كيف يشعر - على سبيل المثال، "كاوبوي يسير عبر مدينة مغبرة في منتصف النهار، الكاميرا تتبعه من الخلف، عمق سينمائي، إضاءة واقعية، مزاج غربي، 4K film grain." كلما وصفت المزاج والإضاءة وسلوك الكاميرا والملمس أكثر، كلما اقترب النتيجة مما تخيلته. يمكن للنموذج أيضًا توسيع طلبك تلقائيًا، مع إضافة تفاصيل سينمائية ليصبح حتى وصف أقصر لقطة غنية ومتماسكة.
لديك سيطرة واسعة على شكل وطول مقطعك. يمكن أن يستمر الفيديو من لحظة قصيرة 9 إطارات تصل إلى 481 إطارًا، وتحدد معدل الإطارات من 1 إلى 60 إطارًا في الثانية، مع 24 إطارًا في الثانية كمعيار افتراضي - الإيقاع السينمائي الكلاسيكي. المقطع الافتراضي هو 121 إطارًا بتنسيق 16:9 أفقي، مناسب طبيعيًا للفيديو الواسع والاجتماعي، لكن يمكنك اختيار إطارات أخرى لتتناسب مع مشروعك. يعمل سرعة التشغيل والطول معًا، لذا عدد إطارات أكبر بمعدل إطارات أقل يعطيك لحظة أبطأ وأطول، بينما معدل إطارات أعلى يعطي حركة أكثر سلاسة.
أحد الأدوات الإبداعية البارزة هو السيطرة المباشرة على الكاميرا. بدلاً من الاعتماد على تفسير النموذج لعبارة مثل "اقتراب من الموضوع"، يمكنك اختيار من حركات كاميرا حقيقية: dolly in، dolly out، dolly left، dolly right، jib up، jib down، أو لقطة ثابتة locked-off. هذه تعطيك لغة كاميرا متعمدة ومتكررة يعتمد عليها صانعو الأفلام، ويمكنك تعديل قوة الحركة لتكون خفيفة أو درامية. هذا يجعل الحصول على حركة متعمدة تدعم روايتك أسهل بكثير بدلاً من الانجراف العشوائي.
يتم إنشاء الصوت مع الفيديو افتراضيًا، ويمكنك إيقافه إذا كنت بحاجة إلى لقطات صامتة فقط. لديك أيضًا عجلات إبداعية منفصلة لمدى التزام الصوت والفيديو بطلبك، وكيفية توازنهما - مفيد عندما تريد أن يكون المشهد الصوتي بارزًا أو تركز تمامًا على المرئيات.
للمساعدة في التماسك العام والتفاصيل الدقيقة، يستخدم النموذج نهجًا متعدد المقاييس. يرسم الفيديو أولاً بمقياس أصغر، ثم يستخدم ذلك المسودة لتوجيه رندر نهائي أكبر وأكثر تفصيلاً. النتيجة هي تماسك أقوى وتفاصيل أنقى من الإنشاء بحجم كامل في ضربة واحدة. يمكنك تعديل مدى التزام النموذج بطلبك مقابل الحرية الإبداعية، تعديل مستوى التحسين لتوازن بين السرعة والتلميع، واستخدام خيار تباين متحكم فيه يمكن أن يحسن الجودة في المشاهد الصعبة.
يمنحك الطلب السلبي طريقة لتوجيه النموذج بعيدًا عن المظاهر غير المرغوبة. افتراضيًا، يتجنب أشياء مثل الرسوم المتحركة وجماليات ألعاب الفيديو، النصوص على الشاشة، العلامات المائية، الشعارات، الترجمات، الحركة البطيئة، واللقطات الثابتة المسطحة - مما يدفع النتائج نحو شعور سينمائي أكثر، حياة حقيقية. يمكنك إعادة كتابته ليتناسب مع أهدافك الجمالية.
عندما يتعلق الأمر بالإخراج، يمكنك تصدير بعدة تنسيقات لتناسب سير عملك: MP4 القياسي، WebM، ProRes لسير عمل التحرير عالي المستوى، أو GIF المتحرك للمشاركة الخفيفة. تتراوح مستويات الجودة من منخفضة إلى قصوى، ويمكنك تحيز الملف نحو الكتابة الأسرع، الحجم الأصغر، أو توازن متوسط. إعدادات التسريع تسمح بالتفاوض بين سرعة الإنشاء والدقة حسب ما إذا كنت تكرر بسرعة أو تنهي لقطة بطل.
للتكرار، يمكنك تعيين seed بحيث ينتج نفس الطلب والإعدادات نفس النتيجة - مفيد عندما تريد إجراء تغييرات صغيرة متحكم فيها بدلاً من البدء من الصفر كل مرة. فاحص أمان مدمج مفعل افتراضيًا.
LTX-2.3 22B مناسب تمامًا لفيديو سينمائي قصير: قطع مزاجية، لقطات مفاهيم، مقاطع اجتماعية، animatics، واستكشاف أفكار حيث يوفر الصوت المتزامن المدمج خطوة تحرير كاملة. بما أن المقاطع تقاس بالإطارات وتنتج كلحظات مستقلة، يتألق في لقطات إيحائية واحدة بدلاً من روايات طويلة متعددة المشاهد. الحصول على أقصى استفادة منه يعتمد على كتابة طلبات وصفية سينمائية، اختيار حركة كاميرا متعمدة، وترك الرندر متعدد المقاييس والتحسين يقومان بعملهما. مع مزيج من الفيديو المدفوع بالطلب، الصوت الأصلي، والسيطرة الدقيقة على الكاميرا، يمنح المنشئين مسارًا سريعًا من فكرة مكتوبة إلى مشهد متحرك ومصوت.
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
صف مشهد الفيديو الخاص بك مع الحركة وزوايا الكاميرا والأجواء
ينشئ النموذج حركة سينمائية بفيزياء وإضاءة طبيعية
نزّل وشارك الفيديو الجاهز للنشر
يعرض حركة تتبع مستمرة، ديناميكيات السيارة، وإنشاء صوت المحرك في تسلسل سينمائي أفقي 16:9 مصمم لـYouTube والأفلام.
يظهر ديناميكيات الضباب الجوي، انتقالات الإضاءة، والصوت الطبيعي الغامر لمحتوى وثائقي منظر طبيعي بأسلوب Netflix.
يبرز إنشاء الصوتي-المرئي المتزامن مع صوت الجمهور، إضاءة مسرح ديناميكية، وحركة كاميرا نشيطة لسينما أفقية.
“Cinematic reveal of a sleek black luxury sports car in a dark studio. Camera starts close on the chrome badge, slowly pulling back while orbiting 180 degrees around the vehicle. Dramatic rim lighting gradually intensifies, highlighting the car's sculptural curves and glossy finish. Reflections dance across the body as the camera moves. Dust particles float in volumetric light beams. Final wide shot reveals the full silhouette against a gradient backdrop. 8 seconds, smooth motion, 24fps cinematic quality.”
انتقل إلى الإنشاء الموجَّه بالاستدلال اليوم

Cinematic video with native audio
1.4 رصيد
![Kling Video v3 Text to Video [Standard]](https://v3b.fal.media/files/b/0a8cfc9f/dei5OqFRB9HK8AgSHwk8f_9a5eea197b3045d1be55aedb0213f6f9.jpg)
Cinematic text-to-video with audio
4.2 رصيد

Fast cinematic video with audio
0.1 رصيد

Frontier 2K text-to-video generation
7.3 رصيد

Fast balanced text-to-video generation
1.6 رصيد

Text to video with audio
0.3 رصيد

Cinematic video from references
0.4 رصيد

Cinematic video from references
10 رصيد

Film-grade video with audio
0.1 رصيد