ShortGenius
Découvrez Grok Imagine Video 1.5 Reference to Video

Grok Imagine Video 1.5 Reference to Video

Blend up to seven reference images into one 10-second clip

Video from image, audio references

ANIMATION PORTRAIT

ANIMATION PORTRAIT

PORTRAIT PARLANT

Grok Imagine Video 1.5 Reference to Video, développé par xAI, transforme vos images de référence et une piste audio optionnelle en vidéo entièrement animée. Au lieu de partir d'une seule image, ce modèle vous permet de fournir un ensemble d’images qui guideront à la fois l’apparence et le contenu du clip final, puis de les combiner à une instruction textuelle qui décrit le mouvement, l’ambiance et l’action que vous souhaitez voir. Le résultat est une courte vidéo qui puise directement dans l’univers visuel que vous lui fournissez, ce qui en fait un choix naturel pour les créateurs disposant déjà d’illustrations, de photos, de photos produits ou de moodboards qu’ils souhaitent mettre en mouvement.

La fonctionnalité phare ici est la référence multi-images. Vous pouvez fournir de une à sept images de référence, et le modèle les utilise conjointement comme guides de style et de contenu. Dans votre prompt, vous pouvez désigner chaque image individuellement pour expliquer au modèle exactement comment vous voulez que les éléments se relient, se mélangent ou s’enchaînent. Cela permet de décrire des scènes comme « découvrir des lieux et des motion graphics originaux grâce à ces trois images » et de voir le modèle les assembler en une séquence cohérente. Que vous intégriez un personnage, un arrière-plan, une texture et une palette de couleurs, ou trois variantes du même sujet, le modèle considère chaque référence comme un élément de base.

L’audio est également un élément clé. Vous pouvez ajouter une piste audio de référence et la mentionner dans votre prompt en complément des images. Cela ouvre la voie à des instructions telles que faire parler une personne d’une de vos images avec la voix extraite de votre audio, pour synchroniser la voix ou les sons avec les visuels fournis. Comme les images et l’audio peuvent être explicitement indiqués dans le prompt, vous gardez un contrôle précis sur la contribution de chaque élément à la vidéo finale.

Les vidéos produites sont en 24 images par seconde, au choix en deux résolutions : une version légère en 480p pour tester rapidement ou élaborer des brouillons, et une version plus nette en 720p pour un rendu plus soigné. La durée est flexible, allant d’une seconde à quinze secondes, ce qui permet de créer à la fois des boucles rapides ou des scènes plus longues. L’exemple de sortie montre un clip complet en 1280x720 de plus de dix secondes à 24fps, pour donner un aperçu de la fluidité et de la longueur obtenues en une seule génération.

Le support des formats d’image est large : 16:9 pour le cinéma ou le paysage, 9:16 pour les formats sociaux verticaux, 1:1 pour les feeds, ainsi que plusieurs formats classiques comme 4:3, 3:2, 2:3 et 3:4. Cette diversité vous permet de cadrer exactement selon les exigences de votre plateforme ou de votre projet, sans recadrage en post-production, que ce soit pour un short vertical, une publicité carrée ou une scène en écran large.

Les commandes créatives sont simples : votre prompt textuel fait tout le travail, en décrivant le mouvement et la narration tout en désignant vos images et votre audio de référence. Vous choisissez le nombre et l’ordre des images à inclure, définissez la durée, sélectionnez la résolution et le format d’image souhaité. Les instructions peuvent être très détaillées, avec une longue zone de texte pour préciser la façon dont les images s’assemblent, ce qui doit bouger et comment la scène doit évoluer au fil du temps.

Qui en tire le plus profit ? Les réalisateurs et créateurs vidéo peuvent prototyper rapidement des scènes en utilisant de l’art conceptuel ou des photos de lieux, puis décrire l’action. Les designers et artistes motion peuvent animer des compositions statiques et assembler plusieurs éléments visuels en une seule pièce animée. Les créateurs de contenu vertical peuvent transformer quelques images en clips prêts à être publiés dans le bon format. Les marketeurs ou équipes produit peuvent donner vie à des photos produits par des instructions animées. Toute personne travaillant à partir d’une bibliothèque d’images existante, plutôt qu’en partant de zéro, trouvera ce flux de travail ultra efficace, car la vidéo générée reste fidèle au style déjà en main.

Quelques points à garder à l’esprit : le modèle nécessite au moins une image de référence et un prompt textuel pour fonctionner, et il accepte jusqu’à sept images et une piste audio par génération. Les images servant à guider à la fois le style et le contenu, choisir des références claires, bien composées et représentatives du rendu attendu donnera les résultats les plus prévisibles. Désigner chaque image dans le prompt vous offre le contrôle maximal sur leur combinaison. Ce modèle est approuvé pour un usage commercial, donc adapté au travail client et à la publication de projets. Comme pour tout service de génération, les requêtes doivent se conformer aux conditions d’utilisation de xAI.

En résumé, Grok Imagine Video 1.5 Reference to Video est destiné aux créateurs souhaitant des vidéos fidèles à leurs images sources spécifiques, tout en y ajoutant du mouvement, et en option une voix ou du son. En combinant la référence multi-images, l’intégration audio, une durée flexible jusqu’à quinze secondes, deux résolutions et une large palette de formats d’image, il offre une méthode ciblée et maîtrisable d’animer vos visuels existants.

Générez avec le modèle de vidéo le plus avancé

Votre image

Add the image that you want change

Étape 1

Importer une image

Ajoutez une image facultative pour guider le style, le personnage ou l'environnement

A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.

Étape 2

Rédigez votre scénario

Saisissez un prompt - Le modèle comprend la physique, l'éclairage et l'intention émotionnelle de votre scène

Étape 3

Commencez à partager

Cliquez pour générer votre résultat final et téléchargez une vidéo de qualité professionnelle

Au-delà du prompt : un nouveau niveau de contrôle

ORBITALE PARALLAXE

ORBITALE PARALLAXE

Démontre une parallaxe multi-image où la caméra glisse à travers une porte, le premier plan se déplaçant plus vite que l’arrière-plan. Démonstration architecturale cinématique en 16:9.

MÉTÉO CAUSALE

MÉTÉO CAUSALE

Met en avant la physique causale : la pluie commence en milieu de clip, les gouttes créent des ondes dans les flaques et assombrissent progressivement le sol. Transformation d’ambiance cinématographique en grand angle.

BOUCLE CINEMAGRAPH

BOUCLE CINEMAGRAPH

Une cinemagraph bouclée et fluide où la vapeur tourbillonne et les reflets néon scintillent tandis que le reste demeure figé. Parfait pour une ambiance de paysage à boucle infinie.

Comparer avec des modèles similaires

Animate with subtle natural movements. Add gentle breathing motion to shoulders. Create natural eye blinks every 2-3 seconds. Introduce slight head micro-movements. Hair moves softly as if in gentle breeze. Maintain the warm smile with subtle lip movements. Eyes should have natural catchlight movement. Keep animation subtle and lifelike, not exaggerated. 5 seconds, smooth looping.

L'attente est enfin terminée

Découvrez la perfection avec Grok Imagine Video 1.5 Reference to Video

Passez dès aujourd'hui à la synthèse guidée par le raisonnement

Foire aux questions

Vous pouvez inclure de une à sept images de référence par génération. Chaque image sert de guide de style et de contenu, et vous les nommez individuellement dans votre prompt pour contrôler précisément leur combinaison, fusion ou transition dans le clip final.