ShortGenius
Memperkenalkan Grok Imagine Video 1.5 Reference to Video

Grok Imagine Video 1.5 Reference to Video

Blend up to seven reference images into one 10-second clip

Video from image, audio references

ANIMASI POTRET

ANIMASI POTRET

POTRET BERBICARA

Grok Imagine Video 1.5 Reference to Video, dikembangkan oleh xAI, mengubah gambar referensi dan trek audio opsional Anda menjadi video animasi penuh. Alih-alih mulai dari satu frame, model ini memungkinkan Anda memasukkan serangkaian gambar yang menjadi panduan tampilan dan konten klip akhir, lalu menggabungkannya dengan prompt teks yang mendeskripsikan gerakan, suasana, dan aksi yang ingin Anda tampilkan. Hasilnya adalah video pendek yang langsung mengambil referensi dari dunia visual yang Anda berikan, sangat cocok untuk kreator yang sudah memiliki karya seni, foto, foto produk, atau mood board dan ingin menghidupkannya dengan gerakan.

Fitur utama di sini adalah referensi multi-gambar. Anda dapat memberikan antara satu hingga tujuh gambar referensi, dan model akan menggunakan semuanya sebagai panduan gaya dan konten. Dalam prompt Anda, Anda dapat menunjuk ke setiap gambar secara individual, menjelaskan kepada model bagaimana setiap bagian harus terhubung, berpadu, atau bertransisi. Ini memungkinkan Anda untuk mendeskripsikan adegan seperti "temukan tempat dan motion graphic keren menggunakan tiga gambar ini" dan membiarkan model menganyamnya menjadi satu rangkaian yang kohesif. Baik Anda memasukkan karakter, latar belakang, tekstur, dan palet warna, atau tiga variasi dari subjek yang sama, model memperlakukan setiap referensi sebagai blok bangunan.

Audio juga merupakan input utama. Anda dapat menambahkan satu klip audio referensi, dan menyebutkannya di prompt bersama dengan gambar-gambar Anda. Ini membuka kemungkinan prompt seperti membuat seseorang dari salah satu gambar Anda berbicara dengan suara dari trek audio Anda, sehingga Anda bisa menyelaraskan suara, dialog, atau efek suara dengan visual yang diberikan. Karena gambar dan audio dapat ditandai langsung di prompt, Anda tetap memiliki kontrol penuh terhadap kontribusi setiap elemen pada video akhir.

Video output dihasilkan dengan 24 frame per detik dalam dua pilihan resolusi: 480p untuk tes dan draft yang cepat, serta 720p untuk hasil yang lebih tajam dan profesional. Durasi fleksibel, mulai dari satu detik hingga lima belas detik, sehingga Anda dapat membuat segalanya, mulai dari loop pendek hingga adegan yang lebih panjang. Contoh output memperlihatkan klip penuh 1280x720 berdurasi lebih dari sepuluh detik pada 24 fps, menunjukkan panjang dan kelancaran hasil yang dapat dihasilkan dalam satu kali generasi.

Dukungan rasio aspek sangat luas, mencakup widescreen 16:9 untuk sinematik dan landscape, tinggi 9:16 untuk format sosial vertikal, persegi 1:1 untuk feeds, serta beberapa rasio klasik lain seperti 4:3, 3:2, 2:3, dan 3:4. Rentang ini memungkinkan Anda menargetkan komposisi sesuai kebutuhan platform atau proyek tanpa perlu crop setelahnya, baik Anda membuat short vertikal, iklan persegi, atau adegan widescreen.

Kontrol kreatif sangat sederhana. Prompt teks Anda adalah inti utama, mendeskripsikan gerakan dan cerita sekaligus menunjuk gambar referensi dan audio Anda. Anda bebas memilih jumlah gambar referensi dan urutannya, menentukan durasi, memilih resolusi, serta mengatur rasio aspek. Prompt dapat sangat detail, mendukung teks panjang agar Anda dapat sangat spesifik mengenai cara penggabungan gambar, elemen yang bergerak, dan evolusi adegan dari waktu ke waktu.

Siapa yang akan mendapatkan manfaat terbesar? Pembuat film dan kreator video dapat memprototipe adegan dengan cepat dengan memasukkan konsep art atau foto lokasi dan mendeskripsikan aksinya. Desainer dan motion graphic artist dapat menganimasikan komposisi statis dan memadukan beberapa aset visual menjadi komposisi bergerak. Kreator konten yang membuat video pendek vertikal dapat mengubah beberapa gambar menjadi klip siap posting dalam rasio aspek yang benar. Marketer dan tim produk dapat menghidupkan foto produk diam dengan motion prompt yang deskriptif. Siapa pun yang sudah memiliki pustaka visual akan menemukan alur kerja berbasis referensi ini jauh lebih efisien, karena video akhir tetap terhubung dengan tampilan gambar yang sudah mereka punya.

Beberapa pertimbangan praktis perlu diperhatikan. Model ini membutuhkan minimal satu gambar referensi dan satu prompt teks untuk beroperasi, dan menerima maksimal tujuh gambar dan satu klip audio untuk setiap generasi. Karena gambar bertindak sebagai panduan gaya dan konten, memilih gambar referensi yang bersih dan jelas akan menghasilkan hasil yang lebih dapat diprediksi. Menandai setiap gambar secara eksplisit di prompt memberi Anda kontrol paling jelas bagaimana mereka digabungkan. Model ini telah disetujui untuk penggunaan komersial, sehingga cocok untuk pekerjaan klien maupun proyek yang dipublikasikan. Seperti layanan generatif lainnya, permintaan harus mematuhi syarat penggunaan xAI.

Singkatnya, Grok Imagine Video 1.5 Reference to Video dirancang untuk kreator yang ingin videonya tetap setia pada gambar sumber tertentu sambil menambahkan gerakan, dan opsional suara atau audio. Dengan menggabungkan referensi multi-gambar, input audio, durasi fleksibel hingga lima belas detik, dua resolusi, dan pilihan rasio aspek penuh, model ini memberi Anda cara terarah dan terkendali untuk menganimasikan visual yang sudah Anda miliki.

Buat dengan model video paling canggih

Gambar Anda

Add the image that you want change

Langkah 1

Unggah gambar

Tambahkan gambar opsional untuk memandu tampilan, karakter, atau lingkungan

A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.

Langkah 2

Tulis skenario Anda

Ketik prompt - Model memahami fisika, pencahayaan, dan maksud emosional dari adegan Anda

Langkah 3

Mulai berbagi

Klik untuk membuat hasil akhir Anda dan unduh video berkualitas produksi

Melampaui prompt: Tingkat kendali yang baru

PARALLAX ORBIT

PARALLAX ORBIT

Mendemonstrasikan parallax referensi multi-gambar saat kamera meluncur melewati pintu, latar depan bergerak lebih cepat dari latar belakang. Showcase arsitektur sinematik 16:9.

CUACA INTERAKTIF

CUACA INTERAKTIF

Menonjolkan fisika sebab-akibat: hujan mulai di tengah klip, tetesan membentuk riak di genangan air dan menggelapkan permukaan jalan secara berurutan. Transformasi atmosfer lebar ala sinema.

CINEMAGRAPH LOOP

CINEMAGRAPH LOOP

Cinemagraph seamless yang ramah loop, di mana uap berputar dan pantulan neon berkilau sementara elemen lain tetap beku. Sempurna untuk suasana landscape yang bisa diputar terus-menerus.

Bandingkan dengan model serupa

Animate with subtle natural movements. Add gentle breathing motion to shoulders. Create natural eye blinks every 2-3 seconds. Introduce slight head micro-movements. Hair moves softly as if in gentle breeze. Maintain the warm smile with subtle lip movements. Eyes should have natural catchlight movement. Keep animation subtle and lifelike, not exaggerated. 5 seconds, smooth looping.

Penantian akhirnya berakhir

Rasakan kesempurnaan dengan Grok Imagine Video 1.5 Reference to Video

Beralih ke sintesis berbasis penalaran hari ini

Pertanyaan yang Sering Diajukan

Anda dapat memasukkan antara satu hingga tujuh gambar referensi dalam satu kali generasi. Setiap gambar berfungsi sebagai panduan gaya dan konten, dan Anda dapat menunjuknya satu per satu di prompt sehingga Anda mengontrol bagaimana gambar tersebut digabungkan, dipadukan, atau bertransisi dalam klip akhir.