ShortGenius
Vi presenterar Grok Imagine Video 1.5 Reference to Video

Grok Imagine Video 1.5 Reference to Video

Blend up to seven reference images into one 10-second clip

Video from image, audio references

PORTRÄTTANIMERING

PORTRÄTTANIMERING

TALANDE PORTRÄTT

Grok Imagine Video 1.5 Reference to Video, utvecklad av xAI, omvandlar dina referensbilder och ett valfritt ljudspår till fullt animerad video. Istället för att börja från en enskild bildruta låter denna modell dig mata in en uppsättning bilder som styr både utseende och innehåll i det slutliga klippet, och kombinerar dem sedan med en textprompt som beskriver den rörelse, stämning och handling du vill se. Resultatet är en kort video som direkt hämtar inspiration från den visuella värld du ger den, vilket gör det till ett naturligt val för kreatörer som redan har konstverk, foton, produktbilder eller moodboards och vill få dessa att röra sig.

Huvudfunktionen här är multi-image-referenser. Du kan använda från en till sju referensbilder, och modellen använder dem tillsammans som stil- och innehållsguider. I din prompt kan du peka ut varje bild individuellt, vilket ger dig exakt kontroll över hur delarna ska relateras, blandas eller fasas samman. Detta gör det möjligt att beskriva scener som "upptäck platser och coola rörelsegrafiker med dessa tre bilder" och låta modellen väva ihop dem till en sammanhängande sekvens. Oavsett om du använder en karaktär, en bakgrund, en textur och en färgpalett, eller tre varianter av samma motiv, behandlar modellen varje referens som ett byggblock.

Ljud är också ett förstklassigt indatafält. Du kan lägga till ett referensljudklipp och referera till det i din prompt tillsammans med bilderna. Detta möjliggör till exempel att låta en person från en av dina bilder tala med rösten från ditt ljudspår, vilket låter dig synka talprestation eller ljud med de visuella indata du anger. Eftersom både bilder och ljud kan taggas direkt i prompten har du full kontroll över hur varje element bidrar till den slutliga videon.

Utdata genereras i 24 bilder per sekund i två upplösningar: en lättare 480p för snabba tester och utkast, och en skarpare 720p för mer färdiga resultat. Längden är flexibel, från en sekund upp till femton sekunder, så du kan skapa allt från en snabb loop till en längre scen. Exemplet visar ett fullstort 1280x720-klipp på drygt tio sekunder i 24fps, vilket ger en känsla för längd och mjukhet modellen kan leverera i en enda generation.

Stödet för bildförhållanden är brett och täcker både bredbildsformatet 16:9 för filmiska och liggande projekt, högt 9:16 för vertikala sociala format, kvadratisk 1:1 för flöden, samt klassiska förhållanden som 4:3, 3:2, 2:3 och 3:4. Detta gör att du kan skapa rätt inramning för din plattform eller ditt projekt utan efterföljande beskärning, oavsett om du bygger en vertikal kortvideo, en kvadratisk annons eller en bredbildsscen.

De kreativa kontrollerna är enkla. Din textprompt gör det mesta av jobbet, beskriver rörelse och berättelse samtidigt som du pekar ut referensbilder och ljud. Du väljer hur många referensbilder som ska användas och i vilken ordning, ställer in önskad längd, väljer upplösning och bestämmer bildförhållande. Prompter kan vara mycket detaljerade och stöder riklig text så att du kan vara så specifik du vill kring hur bilder ska kombineras, vad som ska röra sig och hur scenen ska utvecklas över tid.

Vem har mest nytta av detta? Filmskapare och videoproducenter kan snabbt prototypa scener genom att mata in konceptkonst eller miljöbilder och beskriva handlingen. Designers och motion graphics-artister kan animera statiska kompositioner och blanda flera visuella tillgångar till ett enda rörligt verk. Innehållsskapare som gör korta, vertikala videor kan förvandla en handfull bilder till färdiga klipp i rätt format. Marknadsförare och produktteam kan väcka stillbilder till liv med beskrivande rörelseprompter. Alla som utgår från ett befintligt bildbibliotek, istället för att börja från noll, kommer finna referensstyrt arbetssätt särskilt effektivt eftersom det gör att den slutliga videon behåller det utseende de redan har.

Några praktiska saker är bra att tänka på. Modellen kräver minst en referensbild och en textprompt för att köras, och accepterar maximalt sju bilder och ett ljudklipp per generation. Eftersom bilderna fungerar som både stil- och innehållsguider, ger rena, tydliga referenser bäst resultat. Att tagga varje bild tydligt i prompten ger dig full kontroll över hur de kombineras. Denna modell är godkänd för kommersiellt bruk och passar för kundprojekt och offentlig publicering. Som för alla genereringstjänster gäller xAI:s användarvillkor.

Sammanfattningsvis är Grok Imagine Video 1.5 Reference to Video skapad för kreatörer som vill att deras videor ska förbli trogna specifika källbilder samtidigt som de lägger till rörelse – och valfritt röst eller ljud. Genom att kombinera multi-image-referenser, ljudindata, flexibel längd upp till femton sekunder, två upplösningar och full bredd på bildförhållanden får du ett fokuserat, kontrollerbart sätt att animera de visuella element du värdesätter mest.

Generera med den mest avancerade videomodellen

Din bild

Add the image that you want change

Steg 1

Ladda upp bild

Lägg till en valfri bild för att styra utseende, karaktär eller miljö

A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.

Steg 2

Skriv ditt scenario

Skriv en prompt – modellen förstår fysiken, ljussättningen och den känslomässiga avsikten i din scen

Steg 3

Börja dela

Klicka för att generera ditt slutresultat och ladda ner en video av produktionskvalitet

Bortom prompten: en ny nivå av kontroll

PARALLAX-ORBIT

PARALLAX-ORBIT

Visar multi-image-referens för parallax där kameran glider genom en dörr och förgrunden rör sig snabbare än bakgrunden. Filmisk 16:9-arkitekturvisualisering.

KAUSALT VÄDER

KAUSALT VÄDER

Lyfter fram kausal fysik: regnet börjar mitt i klippet, droppar bildar ringar i vattenpölar och mörkar successivt asfalten. En filmisk bred atmosfärsförändring.

CINEMAGRAPH-LOOP

CINEMAGRAPH-LOOP

En sömlös loopvänlig cinemagraph där ånga slingrar sig och neonsken glittrar medan allt annat är fruset. Perfekt för evigt loopande landskapsambiance.

Jämför med liknande modeller

Animate with subtle natural movements. Add gentle breathing motion to shoulders. Create natural eye blinks every 2-3 seconds. Introduce slight head micro-movements. Hair moves softly as if in gentle breeze. Maintain the warm smile with subtle lip movements. Eyes should have natural catchlight movement. Keep animation subtle and lifelike, not exaggerated. 5 seconds, smooth looping.

Väntan är äntligen över

Upplev perfektion med Grok Imagine Video 1.5 Reference to Video

Byt till resonemangsstyrd syntes idag

Vanliga frågor

Du kan använda mellan en och sju referensbilder per generering. Varje bild fungerar som stil- och innehållsguide, och du pekar ut dem individuellt i din prompt så att du har full kontroll över hur de kombineras, blandas eller övergår i det färdiga klippet.