Cinematic image-to-video with audio
Kling Video v3 Image to Video [Standard] transforma una única imatge estàtica en un clip de vídeo cinematogràfic en moviment complet amb el seu propi àudio generat de forma nativa. Proporcioneu-li una imatge inicial i una descripció textual del moviment desitjat, i produeix imatges suaus i fluids que donen vida a l'escena amb un acabat visual premium. Sigui que animeu imatges de productes, il·lustracions, retrats o paisatges, aquest model està dissenyat per oferir l'aspecte cinematogràfic i el moviment continu que abans requeria una configuració de producció completa.
Al seu nucli, el model pren la vostra imatge inicial i un prompt textual que descriu com ha de moure's l'escena. Podeu demanar que una càmera orbiti lentament al voltant d'un subjecte, que una llum suau es desplaci per una superfície, que l'herba onegi suaument o que les ombres es moguin elegantment per l'enquadrament. El resultat és un vídeo amb moviment suau i continu i una sensació realment premium. Com que el model llegeix tant la vostra imatge com les vostres paraules, manteniu el control creatiu sobre el ritme, el comportament de la càmera i l'atmosfera.
Una de les característiques destacades és la generació d'àudio natiu. En lloc d'afegir so en un pas d'edició separat, el model pot produir àudio directament al costat del vídeo. Admet sortida de veu en xinès i anglès, i altres idiomes es tradueixen automàticament a l'anglès. Quan vulgueu parla en anglès, escriure en minúscula produeix una parla natural, mentre que la majúscula es reserva per a acrònims o noms propis perquè es pronunciïn correctament. Si preferiu un clip silenciós, simplement podeu apagar l'àudio i mantenir les imatges soles.
El model us ofereix un control significatiu sobre la durada. Podeu generar clips d'entre 3 segons i un màxim de 15 segons, amb un valor predeterminat de 5 segons. Les durades més curtes són ideals per a bucles ràpids, fragments per a xarxes socials i imatges de bellesa de productes, mentre que les més llargues us permeten construir una seqüència més desenvolupada o explicar una petita història en una sola generació.
Per a projectes més ambiciosos, el model admet la generació de vídeo multi-shot. En lloc d'un únic prompt, podeu proporcionar una sèrie de prompts que divideixen el vídeo en múltiples plans, permetent-vos guiar una seqüència de moments diferenciats en un sol clip. Podeu dirigir exactament com es estructuren aquests plans vosaltres mateixos o deixar les regnes al model perquè determini intel·ligentment l'estructura dels plans. Això fa possible anar més enllà d'una única presa contínua i crear alguna cosa més propera a una escena editada.
Una altra capacitat poderosa és el suport per a elements personalitzats. Podeu alimentar el model amb personatges o objectes específics que vulgueu que apareguin al vídeo i referenciar-los directament al vostre prompt amb etiquetes senzilles com @Element1 o @Element2. Cada element es pot definir ja sigui mitjançant un conjunt d'imatges —una imatge frontal principal més d'una a tres imatges de referència addicionals des de diferents angles— o mitjançant un vídeo de referència curt. Això us permet mantenir un personatge, producte o objecte concret consistent i recognoscible al llarg de les imatges generades, cosa invaluable per a treballs de marca, personatges recurrents i narracions.
El model també us permet guiar el final del vostre clip. Al costat de la imatge inicial, podeu proporcionar opcionalment una imatge final, donant al model un objectiu cap al qual moure's. Això és útil quan voleu que el moviment resolgui en una composició o posició específica, en lloc de deixar el final enterament al hazard.
Diversos controls creatius us ajuden a ajustar exactament l'aspecte que desitgeu. Una configuració d'adherència al prompt determina quina tan propera es manté el model a la vostra descripció escrita enfront de quanta llibertat creativa pren —valors més baixos permeten més interpretació, valors més alts el mantenen fortament alineat amb les vostres paraules. També podeu utilitzar un prompt negatiu per dirigir el model lluny de qualitats no desitjades; per defecte evita el desenfocament, la distorsió i la baixa qualitat, i podeu afegir els vostres propis termes per excloure altres coses que no vulgueu veure.
Aquest model és ideal per a una àmplia gamma de professionals creatius. Cineastes i dissenyadors de moviment poden prototipar plans cinematogràfics i moviments de càmera sense un equip de càmera. Marketers i dissenyadors de productes poden animar fotografies estàtiques de productes en clips promocionals atractius. Il·lustradors i artistes conceptuals poden portar les seves obres estàtiques al moviment. Creadors de contingut per a xarxes socials poden produir vídeos curts polits amb so integrat. I qualsevol que treballi en peces narratives pot recolzar-se en la generació multi-shot i els elements personalitzats per mantenir personatges i escenes consistents al llarg d'una seqüència.
Pel que fa al que produeix, la sortida és un fitxer de vídeo MP4 estàndard fàcil de descarregar, compartir o inserir en una edició més gran. L'èmfasi constant és en visuals cinematogràfics i moviment fluid i creïble —el model està ajustat per fer que les superfícies captin la llum de manera convincent, els objectes es moguin de forma natural i el clip en general sembli intencional i refinat en lloc de tremolós o artificial.
Algunes coses val la pena tenir en compte mentre treballeu. Proporcioneu o bé un únic prompt o bé una seqüència multi-prompt, però no tots dos alhora, així que decidiu per endavant si voleu una presa contínua o una estructura multi-shot. Els elements personalitzats necessiten material de referència clar —per a elements basats en imatges, una vista frontal més angles addicionals ajuden el model a entendre el subjecte completament. Quan utilitzeu àudio amb parla, seguir les indicacions de minúscula per a parla i majúscula per a acrònims us donarà la sortida de veu més neta. I com amb qualsevol eina generativa, un prompt descriptiu i específic sobre el moviment de la càmera, l'enllumenat i el ritme us portarà notablement més a prop del resultat que imagineu. Amb prompts pensats i l'ample conjunt de controls del model, podeu passar d'un sol fotograma a un clip finalitzat, cinematogràfic i amb so en un sol pas.
Add the image that you want change
Afegeix una imatge opcional per guiar l'estètica, el personatge o l'entorn
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
Escriu una indicació: el model entén la física, la il·luminació i la intenció emocional de la teva escena
Fes clic per generar el resultat final i descarregar un vídeo de qualitat professional
Animació cinematogràfica de la natura amb enllumenat dinàmic i moviment ambiental—ideal per a contingut de viatges o documentals naturals.
Perfecte per a anuncis de productes d'alta gamma, animant vidre, reflexos i moviment de càmera per a narracions visuals de luxe.
Demostra animació dramàtica del temps atmosfèric i moviment ample de càmera, ideal per a trailers cinematogràfics o obertures atmosfèriques.
“Animate with subtle natural movements. Add gentle breathing motion to shoulders. Create natural eye blinks every 2-3 seconds. Introduce slight head micro-movements. Hair moves softly as if in gentle breeze. Maintain the warm smile with subtle lip movements. Eyes should have natural catchlight movement. Keep animation subtle and lifelike, not exaggerated. 5 seconds, smooth looping.”
Passa't avui a la síntesi guiada per raonament

Animate image to 1080p video
2.8 crèdits

Multimodal references to video
10 crèdits

Cinematic video from images
10 crèdits

Animate images into cinematic video
0.6 crèdits

Cinematic video from images fast
0.1 crèdits

Video from image, audio references
0.4 crèdits

Animate images into 2K video
7.8 crèdits

Animate images into video with audio
10 crèdits