Cinematic image-to-video with audio
O Kling Video v3 Image to Video [Standard] transforma uma única imagem estática num clip de vídeo em movimento, cinematográfico, completo com o seu próprio áudio gerado nativamente. Forneça uma imagem inicial e uma descrição textual do movimento desejado, e ele produz imagens suaves e fluidas que dão vida à cena com um acabamento visual premium. Seja a animar fotos de produtos, ilustrações, retratos ou paisagens, este modelo está construído para fornecer o tipo de aspeto cinematográfico e movimento contínuo que antigamente exigia uma configuração de produção completa.
No seu núcleo, o modelo usa a sua imagem inicial e um prompt textual a descrever como a cena deve mover-se. Pode pedir para a câmara orbitar lentamente à volta de um sujeito, para a luz suave se deslocar sobre uma superfície, para a erva balançar suavemente, ou para as sombras se moverem elegantemente pelo enquadramento. O resultado é um vídeo com movimento suave e contínuo e uma sensação genuinamente premium. Como o modelo lê tanto a sua imagem como as suas palavras, mantém o controlo criativo sobre o ritmo, o comportamento da câmara e a atmosfera.
Uma das características destacadas é a geração nativa de áudio. Em vez de adicionar som num passo de edição separado, o modelo pode produzir áudio diretamente ao lado do vídeo. Suporta saída de voz em chinês e inglês, e outras línguas são automaticamente traduzidas para inglês. Quando quiser inglês falado, escrever em minúsculas produz fala natural, enquanto maiúsculas estão reservadas para acrónimos ou nomes próprios para que sejam pronunciados corretamente. Se preferir um clip silencioso, pode simplesmente desligar o áudio e manter as imagens sozinhas.
O modelo dá-lhe controlo significativo sobre a duração. Pode gerar clips desde 3 segundos até um completo de 15 segundos, com 5 segundos como padrão. Durações mais curtas são ótimas para loops rápidos, snippets para redes sociais e fotos de beleza de produtos, enquanto durações mais longas permitem construir uma sequência mais desenvolvida ou contar uma pequena história numa única geração.
Para projetos mais ambiciosos, o modelo suporta geração de vídeo multi-shot. Em vez de um único prompt, pode fornecer uma série de prompts que dividem o seu vídeo em múltiplos shots, permitindo roteirizar uma sequência de momentos distintos num só clip. Pode dirigir exatamente como esses shots estão estruturados ou entregar as rédeas ao modelo e deixá-lo determinar inteligentemente a estrutura dos shots. Isto torna possível ir além de um único take contínuo e criar algo mais próximo de uma cena editada.
Outra capacidade poderosa é o suporte a elementos personalizados. Pode fornecer ao modelo personagens ou objetos específicos que quer que apareçam no vídeo e referenciá-los diretamente no seu prompt usando tags simples como @Element1 ou @Element2. Cada elemento pode ser definido através de um conjunto de imagens — uma imagem frontal principal mais uma a três imagens de referência adicionais de ângulos diferentes — ou através de um vídeo de referência curto. Isto permite manter uma personagem, produto ou objeto consistente e reconhecível ao longo das imagens geradas, o que é inestimável para trabalho de marca, personagens recorrentes e narrativas.
O modelo também permite guiar o final do seu clip. Ao lado da sua imagem inicial, pode fornecer opcionalmente uma imagem final, dando ao modelo um alvo para o qual se mover. Isto é útil quando quer que o movimento termine numa composição ou pose específica, em vez de deixar o final ao acaso.
Vários controlos criativos ajudam a ajustar exatamente o aspeto desejado. Uma definição de adesão ao prompt determina quão fielmente o modelo segue a sua descrição escrita versus quanta liberdade criativa toma — valores mais baixos permitem mais interpretação, valores mais altos mantêm-no alinhado às suas palavras. Pode também usar um prompt negativo para afastar o modelo de qualidades indesejadas; por padrão evita borrões, distorções e baixa qualidade, e pode adicionar os seus próprios termos para excluir outras coisas que não quer ver.
Este modelo é uma escolha natural para uma vasta gama de profissionais criativos. Cineastas e designers de movimento podem prototipar shots cinematográficos e movimentos de câmara sem um equipamento de câmara. Marketers e designers de produtos podem animar fotografia estática de produtos em clips promocionais cativantes. Ilustradores e artistas de conceito podem trazer as suas obras estáticas para o movimento. Criadores de conteúdo social podem produzir vídeo de curta duração polido com som integrado. E qualquer um a trabalhar em peças narrativas pode recorrer à geração multi-shot e elementos personalizados para manter personagens e cenas consistentes numa sequência.
Em termos do que produz, a saída é um ficheiro de vídeo MP4 padrão fácil de descarregar, partilhar ou inserir numa edição maior. A ênfase é em visuais cinematográficos e movimento fluido e credível — o modelo está afinado para fazer as superfícies captarem a luz de forma convincente, objetos moverem-se naturalmente, e o clip geral parecer intencional e refinado em vez de agitado ou artificial.
Algumas coisas valem a pena ter em mente ao trabalhar. Fornece ou um único prompt ou uma sequência multi-prompt, mas não ambos ao mesmo tempo, por isso decida à partida se quer um take contínuo ou uma estrutura multi-shot. Os elementos personalizados precisam de material de referência claro — para elementos baseados em imagens, uma vista frontal mais ângulos adicionais ajudam o modelo a compreender o sujeito completamente. Ao usar áudio com fala, seguir a orientação de minúsculas para fala e maiúsculas para acrónimos dará a saída de voz mais limpa. E como com qualquer ferramenta generativa, um prompt descritivo e específico sobre movimento de câmara, iluminação e ritmo aproximar-se-á notavelmente do resultado que imagina. Com prompts pensados e o rico conjunto de controlos do modelo, pode ir de um único frame a um clip final cinematográfico com som numa única etapa.
Add the image that you want change
Adicione uma imagem opcional para orientar o aspeto, a personagem ou o ambiente
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
Escreva um prompt - O modelo compreende a física, a iluminação e a intenção emocional da sua cena
Clique para gerar o resultado final e transferir um vídeo de qualidade profissional
Animação cinematográfica da natureza com iluminação dinâmica e movimento ambiental — ótimo para conteúdo de viagens ou documentários da natureza.
Perfeito para anúncios de produtos de alta gama, animando vidro, reflexos e movimento de câmara para narrativas visuais de luxo.
Demonstra animação dramática de tempo atmosférico e movimento amplo de câmara, ideal para trailers cinematográficos ou aberturas atmosféricas.
“Animate with subtle natural movements. Add gentle breathing motion to shoulders. Create natural eye blinks every 2-3 seconds. Introduce slight head micro-movements. Hair moves softly as if in gentle breeze. Maintain the warm smile with subtle lip movements. Eyes should have natural catchlight movement. Keep animation subtle and lifelike, not exaggerated. 5 seconds, smooth looping.”
Mude hoje para a síntese guiada por raciocínio

Cinematic video from images fast
0.1 créditos

Animate images into video with audio
10 créditos

Multimodal references to video
10 créditos

Animate image to 1080p video
2.8 créditos

Animate images into cinematic video
0.6 créditos

Cinematic video from images
10 créditos