ShortGenius
Wir präsentieren Grok Imagine Video 1.5 Reference to Video

Grok Imagine Video 1.5 Reference to Video

Blend up to seven reference images into one 10-second clip

Video from image, audio references

PORTRÄT-ANIMATION

PORTRÄT-ANIMATION

SPRACHENDES PORTRÄT

Grok Imagine Video 1.5 Reference to Video, entwickelt von xAI, verwandelt Ihre Referenzbilder und einen optionalen Audiotrack in ein vollständig animiertes Video. Anstatt von einem einzelnen Frame auszugehen, ermöglicht dieses Modell Ihnen, ihm eine Reihe von Bildern zuzuführen, die sowohl das Aussehen als auch den Inhalt des finalen Clips leiten, und kombiniert diese dann mit einem Textprompt, der die Bewegung, Stimmung und Aktion beschreibt, die Sie sehen möchten. Das Ergebnis ist ein kurzes Video, das direkt aus der visuellen Welt schöpft, die Sie ihm liefern, und eignet sich ideal für Creator, die bereits Artwork, Fotos, Produktaufnahmen oder Moodboards haben und diese zum Leben erwecken möchten.

Die zentrale Funktion ist die Mehrfachbild-Referenzierung. Sie können zwischen einem und sieben Referenzbildern liefern, und das Modell verwendet sie gemeinsam als Stil- und Inhaltsführer. In Ihrem Prompt weisen Sie auf jedes Bild einzeln hin und teilen dem Modell genau mit, wie die Elemente zueinander in Beziehung stehen, vermischt oder überblendet werden sollen. So können Sie Szenen wie „entdecken Sie Orte und coole Motion Graphics mit diesen drei Bildern“ beschreiben, und das Modell verwebt sie zu einer kohärenten Sequenz. Ob Sie einen Charakter, einen Hintergrund, eine Textur und eine Farbpalette oder drei Varianten desselben Motivs einbringen – das Modell behandelt jede Referenz als Baustein.

Audio ist ebenfalls ein erstklassiger Input. Sie können einen einzelnen Referenzaudioclip anhängen und ihn in Ihrem Prompt neben den Bildern referenzieren. Das eröffnet Möglichkeiten wie z. B. dass eine Person aus einem Ihrer Bilder in der Stimme aus Ihrem Audiotrack spricht und Sie gesprochene Performance oder Sound mit den von Ihnen gelieferten Visuals synchronisieren können. Da sowohl Bilder als auch Audio direkt im Prompt markiert werden können, behalten Sie die volle Kontrolle darüber, wie jedes Element zum fertigen Video beiträgt.

Ausgabevideos werden mit 24 Frames pro Sekunde in einer von zwei Auflösungen produziert: einer leichteren 480p-Option für schnelle Tests und Entwürfe sowie einer schärferen 720p-Option für poliertere Ergebnisse. Die Dauer ist flexibel und reicht von so kurz wie einer Sekunde bis zu 15 Sekunden, sodass Sie alles von einer schnellen Schleife bis zu einer längeren Szene erstellen können. Das Beispiel zeigt einen vollständigen 1280x720-Clip von etwas über zehn Sekunden bei 24 fps, der einen Eindruck von der Länge und Geschmeidigkeit vermittelt, die das Modell in einer einzigen Generierung liefern kann.

Die Unterstützung für Aspect Ratios ist umfassend und umfasst Breitbild-16:9 für kinematografische und Landschaftsarbeiten, hohes 9:16 für vertikale Social-Formate, quadratisches 1:1 für Feeds sowie mehrere klassische Ratios dazwischen wie 4:3, 3:2, 2:3 und 3:4. Diese Vielfalt bedeutet, dass Sie das exakte Framing für Ihre Plattform oder Ihr Projekt treffen können, ohne nachträglich zuzuschneiden – egal ob für vertikale Shorts, quadratische Ads oder Breitbildszenen.

Die kreativen Steuerungen sind unkompliziert. Ihr Textprompt übernimmt die Hauptarbeit, beschreibt die Bewegung und Geschichte, während er auf Ihre Referenzbilder und das Audio verweist. Sie wählen, wie viele Referenzbilder Sie einbeziehen und in welcher Reihenfolge, legen die gewünschte Dauer fest, wählen die Auflösung und den Aspect Ratio. Prompts können sehr detailliert sein und unterstützen eine großzügige Textmenge, damit Sie so spezifisch wie gewünscht angeben können, wie Bilder kombiniert werden sollen, was sich bewegen soll und wie sich die Szene im Laufe der Zeit entwickelt.

Wer profitiert am meisten? Filmemacher und Video-Creator können Szenen schnell prototypen, indem sie Concept Art oder Locationsfotos ein speisen und die Aktion beschreiben. Designer und Motion-Graphics-Künstler können statische Kompositionen animieren und mehrere visuelle Assets zu einem einzigen bewegten Stück verschmelzen. Content-Creator für Kurzform-Vertikalvideos können aus einer Handvoll Bilder fertige, postfertige Clips im richtigen Aspect Ratio erzeugen. Marketer und Produktteams können statische Produktaufnahmen mit beschreibenden Bewegungs-Prompts zum Leben erwecken. Jeder, der mit einer bestehenden visuellen Bibliothek arbeitet statt von Null anzufangen, findet den referenzbasierten Workflow besonders effizient, da das finale Video fest mit dem Look verankert bleibt, den sie bereits haben.

Einige praktische Hinweise sind zu beachten. Das Modell benötigt mindestens ein Referenzbild und einen Textprompt, um zu laufen, und akzeptiert maximal sieben Bilder und einen Audioclip pro Generierung. Da die Bilder als Stil- und Inhaltsführer dienen, liefern saubere, gut kompositionierte Referenzen, die klar darstellen, was Sie auf dem Bildschirm wollen, die vorhersehbarsten Ergebnisse. Das explizite Markieren jedes Bildes in Ihrem Prompt gibt Ihnen die klarste Kontrolle über die Kombination. Dieses Modell ist für kommerzielle Nutzung freigegeben und eignet sich für Kundenarbeiten und veröffentlichte Projekte. Wie bei jedem Generierungs-Service müssen Anfragen den Nutzungsbedingungen von xAI entsprechen.

Zusammengefasst ist Grok Imagine Video 1.5 Reference to Video für Creator gebaut, die ihre Videos treu gegenüber spezifischen Quellbildern halten möchten, während sie Bewegung – und optional Stimme oder Sound – hinzufügen. Durch die Kombination aus Mehrfachbild-Referenzierung, Audio-Input, flexibler Dauer bis zu 15 Sekunden, zwei Auflösungen und einem vollen Spektrum an Aspect Ratios bietet es einen fokussierten, kontrollierbaren Weg, die Visuals zu animieren, die Ihnen bereits wichtig sind.

Generiere mit dem fortschrittlichsten Videomodell

Dein Bild

Add the image that you want change

Schritt 1

Bild hochladen

Füge optional ein Bild hinzu, um Look, Charakter oder Umgebung vorzugeben

A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.

Schritt 2

Beschreibe dein Szenario

Gib einen Prompt ein – das Modell versteht die Physik, Beleuchtung und emotionale Aussage deiner Szene

Schritt 3

Jetzt teilen

Klicke, um dein finales Ergebnis zu generieren und ein Video in Produktionsqualität herunterzuladen

Mehr als nur ein Prompt: eine neue Ebene der Kontrolle

PARALLAX-ORBIT

PARALLAX-ORBIT

Zeigt Mehrfachbild-Parallax-Referenz, während die Kamera durch eine Tür gleitet und Vordergrund schneller als Hintergrund verschiebt. Kinematografische 16:9-Architektur-Präsentation.

KAUSALES WETTER

KAUSALES WETTER

Hebt kausale Physik hervor: Regen setzt in der Clip-Mitte ein, Tropfen erzeugen Pfützenringe und verdunkeln den Asphalt sequenziell. Kinematografische breite atmosphärische Transformation.

CINEMAGRAPH-SCHLEIFE

CINEMAGRAPH-SCHLEIFE

Eine nahtlose, schleifenfreundliche Cinemagraph, bei der Dampf sich kräuselt und Neon-Reflexe schimmern, während alles andere erstarrt. Perfekt für endlose Landschaftsambiances.

Mit ähnlichen Modellen vergleichen

Animate with subtle natural movements. Add gentle breathing motion to shoulders. Create natural eye blinks every 2-3 seconds. Introduce slight head micro-movements. Hair moves softly as if in gentle breeze. Maintain the warm smile with subtle lip movements. Eyes should have natural catchlight movement. Keep animation subtle and lifelike, not exaggerated. 5 seconds, smooth looping.

Das Warten hat endlich ein Ende

Erlebe Perfektion mit Grok Imagine Video 1.5 Reference to Video

Wechsle noch heute zur reasoning-gesteuerten Synthese

Häufig gestellte Fragen

Sie können in einer einzigen Generierung zwischen einem und sieben Referenzbildern verwenden. Jedes Bild dient als Stil- und Inhaltsführer, und Sie verweisen individuell darauf in Ihrem Prompt, um genau zu steuern, wie sie kombiniert, vermischt oder überblendet werden.