ShortGenius
نقدّم لكم Grok Imagine Video 1.5 Text to Video

Grok Imagine Video 1.5 Text to Video

Generates clips with native audio baked in, up to 15 seconds at 1080p

Text to video with audio

مدونة شخصية للشخصية

مشهد ASMR ماكرو

بودكاست الحيوانات الأليفة

نموذج Grok Imagine Video 1.5 (تحويل النص إلى فيديو)، المطور من xAI، يحول التعليمات النصية إلى مقاطع فيديو قصيرة مع صوت مدمج. بدلاً من الحاجة لاستخدام أدوات منفصلة للصورة والصوت، يمكنك ببساطة وصف المشهد الذي تريده بلغة عادية وينتج النموذج لك مقطعًا مكتملاً بالحركة ومسار صوتي خاص به. هذا يجعلها وسيلة سريعة ومتكاملة للمبدعين لاختبار الأفكار، وصنع محتوى اجتماعي، ونمذجة الصور المتحركة بدون الحاجة إلى كاميرا أو ممثلين أو أدوات مونتاج.

في جوهره، يقرأ النموذج الوصف النصي ويفسر الموضوع وكيفية حركته. على سبيل المثال، وصف مثل "قطة بيضاء تطارد فراشة في حديقة مشمسة، حركة كاميرا ناعمة، حركة طبيعية، إضاءة عصر هادئ تتخلل الأشجار" يمنح النموذج كل ما يحتاجه: الموضوع، الحركة، توجه الكاميرا، وجو الإضاءة. وبما أنه يستجيب لهذا النوع من التوجيه التفصيلي والسينمائي، يمكنك التحكم ليس فقط في ما يظهر على الشاشة بل أيضاً كيف تتحرك الكاميرا وكيف تسقط الإضاءة على المشهد. الأمثلة أيضاً توضح أنه يتعامل مع الأساليب الفنية مثل أسلوب الأنمي والشوجو مع خطوط السرعة، وزهور الكرز، وألوان زاهية، وشخصيات معبرة، لذلك هو مرتاح في التنقل بين المظهر الواقعي والمرسوم.

يمكنك التحكم في طول كل مقطع، واختيار أي مدة من ثانية إلى 15 ثانية. المقاطع الأقصر مثالية للحلقات السريعة، وردود الفعل، والمقاطع الاجتماعية، بينما الفترات الأطول تمنحك مجالاً للقطة كاملة أو لحظة سردية صغيرة. الطول الافتراضي حوالي 6 ثواني، وهو مناسب لمعظم الأفكار ذات اللقطة الواحدة. العرض يكون بسرعة 24 إطار في الثانية، لتمنح الحركة سلاسة تشبه الأفلام.

الدقة قابلة للتعديل ضمن ثلاث مستويات: 480p للعينات السريعة والاختبار، 720p كمعيار يومي قوي، و1080p عندما ترغب في أوضح وأدق نتيجة لقطعة نهائية. هذا يسمح لك بالتجربة بسرعة بدقة أقل ثم إنتاج نسخة نهائية بجودة أعلى عند رضاك عن الاتجاه.

نسبة العرض إلى الارتفاع مرنة بالكامل، مع مجموعة واسعة من الأشكال لتناسب أين سيعرض الفيديو الخاص بك. يمكنك إنتاج شاشة عريضة 16:9 للمشاهدة الأفقية، أو 9:16 للتنسيقات الرأسية مثل القصص، أو 1:1 للمنشورات المربعة، ونسب وسيطة مثل 4:3، 3:2، 2:3، و3:4. بما أنك قادر على الإطار الرأسي أو الأفقي لنفس التعليمات، النموذج يتلاءم بسهولة مع سير عمل متعدد المنصات حيث تظهر نفس الفكرة بأشكال مختلفة.

من الميزات البارزة وجود الصوت الأصلي. بدلاً من استلام ملف صامت تضيف عليه الصوت لاحقاً، يخرج Grok Imagine Video 1.5 الفيديو بمسار صوتي متزامن في نفس الوقت. هذا يجعل التعليمات النصية تخرج على هيئة لحظة شبه مكتملة، وهذا مفيد بشكل خاص للأفكار التجريبية السريعة أو اختبارات المزاج أو المحتوى الاجتماعي حيث يضيف الصوت تأثيرًا كبيرًا بدون خطوات إضافية.

حقل التعليمات واسع، ويقبل أوصافًا غنية تصل إلى عدة آلاف من الأحرف. هذه المساحة تكافئ التفاصيل: يمكنك إدراج الموضوع، الحركة، حركة الكاميرا، الإضاءة، لوحة الألوان، النمط الفني، والمزاج في وقت واحد. كما توضح الأمثلة، ذكر تفاصيل مثل "حركة كاميرا ناعمة"، "ضوء العصر المرشح بلطف"، "خطوط سرعة تشير إلى الاستعجال"، أو اسم نمط معين يمنح النموذج توجيهًا واضحًا ويتجه غالباً نحو نتائج أقرب لرغبتك.

هذا النموذج مناسب لفئة واسعة من المحترفين المبدعين. منشئو المحتوى والمدونون ومنسقو التسويق يستطيعون بسهولة إنتاج مقاطع جذابة رأسية أو مربعة. صناع الأفلام والمصممون الحركيون يمكنهم استخدامه لرسم لقطات أولية وتحديد حركات الكاميرا واستكشاف الأساليب قبل الانتقال لتنفيذ كامل. الرسامون والمصممون يمكنهم إحياء العوالم المرسومة بالحركة والصوت. فنانو الأفكار والحكاؤون يمكنهم اختبار أجواء وتوقيت وأفكار بصرية بسرعة، مع إنتاج عدة بدائل للمقارنة. وبما أنه يعتمد على النص فقط ولا يتطلب مشاهد مصورة، فهو يقلل الحواجز أمام أي شخص يريد صورًا متحركة بدون الإمكانيات أو الميزانية للتصوير التقليدي.

هناك بعض الاعتبارات العملية. النموذج يعمل فقط استنادًا إلى النص، بدون قبول صور أو مراجع، لذا كل شيء ينتج من وصفك النصي وحده. هذا يجعل العملية بسيطة، لكنه يعني أيضاً أن وضوح وتفاصيل تعليماتك تمثل العامل الأكبر؛ فكلما كان الوصف أدق كلما كانت النتائج مميزة أكثر. طول المقطع لا يتجاوز 15 ثانية، لذلك هو أداة للحظات سريعة ولقطات مفردة وليس تسلسلات طويلة، وإن كان يمكن توليد عدة مقاطع وتركيبها لشيء أطول. الطلبات تخضع لشروط استخدام xAI.

عمومًا، Grok Imagine Video 1.5 (تحويل النص إلى فيديو) هو وسيلة متعددة وغير معقدة للانتقال من فكرة مكتوبة إلى فيديو قصير مع صوت. مع إمكانية ضبط المدة حتى 15 ثانية، ثلاث مستويات دقة حتى 1080p، جميع نسب العرض المنتشرة، حركة سلسة 24 إطار في الثانية، وصوت مدمج، فهو يمنح المبدعين نقطة انطلاق مرنة لكل شيء من التجارب الاجتماعية السريعة إلى الأعمال التصورية المصقولة.

أنشئ باستخدام أكثر نماذج الفيديو تطورًا

A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.

الخطوة 1

اكتب السيناريو الخاص بك

صف مشهد الفيديو الخاص بك مع الحركة وزوايا الكاميرا والأجواء

الخطوة 2

الذكاء الاصطناعي ينشئ

ينشئ النموذج حركة سينمائية بفيزياء وإضاءة طبيعية

الخطوة 3

ابدأ المشاركة

نزّل وشارك الفيديو الجاهز للنشر

أبعد من الوصف: مستوى جديد من التحكم

لقطة سينمائية FPV

لقطة سينمائية FPV

تعرض تحكم العدسة العدواني مع حركة FPV مستحيلة في لقطة واحدة، لتوضيح قدرة النموذج على الحركة المستمرة وتغيير الحجم الديناميكي في العرض العريض.

كوميديا كاميرا الجسم العبثية

كوميديا كاميرا الجسم العبثية

تستخدم واقعية النموذج لصناعة مشاهد كوميدية ساخرة بكاميرا جسم وصوت متزامن، لقطات مصممة لتنتشر بفضل الأسلوب الجاد الساخط.

تسارع المدينة

تسارع المدينة

يعرض تحكم الكاميرا الدقيق وحركة الزمن مع تسارع زمني مستمر وديناميكية آثار الضوء، مثالي لمقطع بطولي سينمائي بنسبة 16:9.

قارن مع النماذج المشابهة

Cinematic reveal of a sleek black luxury sports car in a dark studio. Camera starts close on the chrome badge, slowly pulling back while orbiting 180 degrees around the vehicle. Dramatic rim lighting gradually intensifies, highlighting the car's sculptural curves and glossy finish. Reflections dance across the body as the camera moves. Dust particles float in volumetric light beams. Final wide shot reveals the full silhouette against a gradient backdrop. 8 seconds, smooth motion, 24fps cinematic quality.

انتهى الانتظار أخيرًا

اختبر الكمال مع Grok Imagine Video 1.5 Text to Video

انتقل إلى الإنشاء الموجَّه بالاستدلال اليوم

الأسئلة الشائعة

نعم. ينتج Grok Imagine Video 1.5 الفيديو بمسار صوتي أصلي، بحيث يصلك المقطع مع الصوت بالفعل وليس كملف صامت تحتاج لإضافة موسيقى أو صوتيات عليه لاحقاً.