Video from image, audio references
Grok Imagine Video 1.5 Reference to Video เป็นโมเดลภาพสู่วิดีโอจาก xAI ที่แปลงภาพอ้างอิงและพรอมต์ข้อความของคุณให้เป็นคลิปวิดีโอเคลื่อนไหว แทนที่จะเริ่มจากศูนย์ คุณป้อนภาพอ้างอิงหนึ่งภาพหรือมากกว่าและอธิบายฉากที่ต้องการ จากนั้นให้โมเดลสร้างการเคลื่อนไหวที่นำสไตล์และเนื้อหาของภาพอ้างอิงเหล่านั้นไปสู่วิดีโอสำเร็จรูป
สิ่งที่ทำให้โมเดลนี้แตกต่างคือวิธีการใช้ภาพอ้างอิง คุณสามารถให้ภาพอ้างอิงได้ตั้งแต่หนึ่งถึงเจ็ดภาพ และโมเดลจะใช้它们เป็นแนวทางทั้งสไตล์และเนื้อหา ในพรอมต์ของคุณ ชี้ไปยังภาพเฉพาะโดยใช้แท็กง่ายๆ เช่น <IMAGE_0>, <IMAGE_1> เป็นต้น ทำให้คุณสามารถเขียนคำสั่งเช่น "บุคคลจาก <IMAGE_0> เดินผ่านถนนไฟนีออนเปียกฝน" เพื่อให้โมเดลรู้ว่าต้องดึงตัวละครหรือองค์ประกอบสไตล์จากภาพไหน ระบบแท็กนี้ให้การควบคุมสร้างสรรค์ที่แม่นยำต่อการรวมแหล่งภาพหลายแห่งในช็อตเดียว ซึ่งมีประโยชน์เป็นพิเศษเมื่อต้องการให้ตัวละครจากภาพหนึ่งปรากฏในฉากหรือสไตล์จากภาพอื่นๆ
โมเดลนี้ถูกสร้างสำหรับงานสไตล์และการแปลง และมีฟีเจอร์ lip-sync ทำให้เหมาะสำหรับการทำให้ตัวละครและภาพบุคคลมีชีวิตด้วยการเคลื่อนไหวที่แสดงออกและประสานกัน เนื่องจากรับอินพุตภาพ เสียง และข้อความ คุณสามารถซ้อนทิศทางหลายประเภทพร้อมกัน: ภาพกำหนดลุค ข้อความอธิบายการกระทำ และเสียงกำหนดจังหวะและการขยับปาก เอาต์พุตเป็นไฟล์วิดีโอเสมอ พร้อมใช้งานในการตัดต่อหรือแชร์โดยตรง
มืออาชีพสร้างสรรค์จะพบความยืดหยุ่นมากมายในการจัดเฟรมและจังหวะของคลิปสุดท้าย คุณเลือกอัตราส่วนได้หลากหลาย รวมถึง widescreen 16:9 สำหรับการดูแบบภาพยนตร์และเดสก์ท็อป สูง 9:16 สำหรับรูปแบบสังคมแนวตั้งเช่น reels และ stories สี่เหลี่ยม 1:1 สำหรับฟีด และตัวเลือกอื่นๆ เช่น 4:3, 3:2, 2:3, และ 3:4 ทำให้สร้างวิดีโอที่เหมาะกับแพลตฟอร์มหรือเลย์เอาต์ที่ต้องการโดยไม่ต้องครอปหรือปรับรูปแบบใหม่ ความยาววิดีโอปรับได้ตั้งแต่หนึ่งวินาทีถึงสิบห้าวินาที เพื่อสร้างลูปสั้น ฉากสั้น หรือลำดับยาวตามโปรเจกต์
สำหรับคุณภาพเอาต์พุต โมเดลมีตัวเลือกความละเอียดสองแบบ: 480p สำหรับคลิปเบาและเร็ว และ 720p สำหรับผลลัพธ์ที่คมชัดและรายละเอียดสูง ตัวอย่างเอาต์พุตทำงานที่ 24 เฟรมต่อวินาที ให้การเคลื่อนไหวที่นุ่มนวลแบบภาพยนตร์ คลิป 720p widescreen มีขนาด 1280x720 พิกเซล เหมาะสำหรับบริบทออนไลน์และพรีวิวส่วนใหญ่
ใครได้ประโยชน์สูงสุดจากโมเดลนี้? ศิลปินและนักวาดภาพสามารถทำให้งานศิลปะหรือดีไซน์ตัวละครที่มีอยู่เคลื่อนไหวและแสดงออก นักออกแบบสามารถแปลงบอร์ดอ้างอิงและภาพอารมณ์ให้เป็นชิ้นคอนเซปต์ที่เคลื่อนไหว ผู้สร้างภาพยนตร์และวิดีโอสามารถทดสอบช็อตโดยรวมตัวละครกับสภาพแวดล้อมที่อธิบาย สร้างคลิปพรีวิวชันไวก่อนผลิตเต็มรูปแบบ ผู้สร้างคอนเทนต์ข้ามแพลตฟอร์มสังคมสามารถเปลี่ยนภาพอ้างอิงให้เป็นวิดีโอสั้นสไตล์ที่ฟอร์แมตพอดีแนวตั้ง สี่เหลี่ยม หรือ widescreen โดยตรง เนื่องจากรองรับ lip-sync ผู้ที่ผลิตตัวละครพูด อวตารแอนิเมชัน หรือคลิปเล่าเรื่องสั้นสามารถจับคู่ภาพบุคคลกับเสียงเพื่อสร้างคลิปแสดงที่ซิงค์
ผลลัพธ์ที่ดีที่สุดมาจากพรอมต์ที่รอบคอบ เนื่องจากโมเดลอ่านทั้งภาพอ้างอิงและคำอธิบายข้อความ การอธิบายการกระทำชัดเจนพร้อมแท็กภาพที่ถูกต้องช่วยให้เข้าใจว่าต้องให้อะไรเคลื่อนไหวและอย่างไร เมื่อใช้หลายภาพ การกำหนดบทบาทแต่ละภาพในพรอมต์ เช่น ภาพหนึ่งสำหรับตัวละคร อีกภาพสำหรับสภาพแวดล้อมหรือสไตล์ ช่วยให้องค์ประกอบสอดคล้อง จำไว้ว่าคุณรวมภาพได้สูงสุดเจ็ดภาพ ซึ่งให้พื้นที่สร้างฉากหลายชั้น แต่ชุดอ้างอิงที่โฟกัสกับพรอมต์ชัดเจนมักให้ผลที่สะอาดและควบคุมได้ดีที่สุด
มีข้อควรพิจารณาทางปฏิบัติบางประการ ต้องมีภาพอ้างอิงอย่างน้อยหนึ่งภาพและพรอมต์ข้อความสำหรับทุกการสร้าง เนื่องจากโมเดลถูกสร้างรอบการนำทางเอาต์พุตด้วยภาพอ้างอิงแทนการสร้างจากข้อความอย่างเดียว ความละเอียดสูงสุด 720p ทำให้โมเดลนี้เหมาะสำหรับวิดีโอสไตล์ การแปลง และพร้อมสังคม แทนการฟินิชชิงความละเอียดสูงขนาดใหญ่ ความยาวคลิปจำกัดที่สิบห้าวินาที ซึ่งเหมาะกับการเล่าเรื่องสั้น ลูป และคอนเทนต์สังคม ภายในขอบเขตนั้น การรวมการอ้างอิงหลายภาพ เฟรมยืดหยุ่น ระยะเวลาปรับได้ และ lip-sync ทำให้เป็นเครื่องมือหลากหลายสำหรับเปลี่ยนภาพนิ่งให้เป็นการเคลื่อนไหวที่แสดงออก
โดยสรุป Grok Imagine Video 1.5 Reference to Video เป็นเครื่องมือแอนิเมชันที่ขับเคลื่อนด้วยอ้างอิง ให้ผู้สร้างควบคุมโดยตรงว่าภาพของพวกเขากลายเป็นวิดีโออย่างไร โดยให้แท็กอ้างอิงเฉพาะในพรอมต์ เลือกอัตราส่วนหลากหลาย ปรับความยาวและความละเอียด และซิงค์การขยับปากกับเสียง ทำให้การตัดสินใจสร้างสรรค์อยู่ในมือคุณ ขณะจัดการการสร้างการเคลื่อนไหว
Add the image that you want change
เพิ่มรูปภาพ (ไม่บังคับ) เพื่อกำหนดลุค ตัวละคร หรือสภาพแวดล้อม
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
พิมพ์พรอมต์ - โมเดลเข้าใจฟิสิกส์ แสง และอารมณ์ที่ต้องการสื่อในฉากของคุณ
คลิกเพื่อสร้างผลลัพธ์สุดท้ายและดาวน์โหลดวิดีโอระดับมืออาชีพ
แสดง parallax อ้างอิงหลายภาพขณะกล้องเลื่อนผ่านประตู องค์ประกอบหน้าเคลื่อนเร็วกว่าพื้นหลัง โชว์สถาปัตยกรรม cinematic 16:9
เน้นฟิสิกส์เชิงสาเหตุ: ฝนเริ่มกลางคลิป หยดน้ำกระเพื่อมแอ่งและทำให้พื้นมืดตามลำดับ การแปลงบรรยากาศแบบกว้าง cinematic
cinemagraph ลูปไร้รอยต่อที่ไอ้ควันลอยและแสงนีออนสั่นไหว ขณะส่วนอื่น凍ตัว เหมาะสำหรับลูปบรรยากาศภูมิทัศน์ไม่สิ้นสุด
“Animate with subtle natural movements. Add gentle breathing motion to shoulders. Create natural eye blinks every 2-3 seconds. Introduce slight head micro-movements. Hair moves softly as if in gentle breeze. Maintain the warm smile with subtle lip movements. Eyes should have natural catchlight movement. Keep animation subtle and lifelike, not exaggerated. 5 seconds, smooth looping.”
เปลี่ยนมาใช้การสร้างที่ขับเคลื่อนด้วยการให้เหตุผลได้แล้ววันนี้

Animate images into 2K video
7.8 เครดิต
![Kling Video v3 Image to Video [Standard]](https://v3b.fal.media/files/b/0a8cfcdb/TywpxxNj5_vDG8AUw3Yum_e2172b5c00e64a91a434ab5a38e496f0.jpg)
Cinematic image-to-video with audio
4.2 เครดิต

Multimodal references to video
10 เครดิต

Animate image to 1080p video
2.8 เครดิต

Animate images into cinematic video
0.6 เครดิต

Cinematic video from images fast
0.1 เครดิต

Animate images into video with audio
10 เครดิต

Cinematic video from images
10 เครดิต