Cinematic image-to-video with audio
Kling Video v3 Image to Video [Standard] transforma uma única imagem estática em um clipe de vídeo em movimento, cinematográfico, completo com seu próprio áudio gerado nativamente. Forneça uma imagem inicial e uma descrição textual do movimento desejado, e ele produz filmagens suaves e fluidas que dão vida à cena com acabamento visual premium. Seja animando fotos de produtos, ilustrações, retratos ou paisagens, este modelo foi projetado para entregar o tipo de visual cinematográfico e movimento contínuo que antes exigia uma configuração completa de produção.
No cerne, o modelo usa sua imagem inicial e um prompt de texto descrevendo como a cena deve se mover. Você pode pedir para uma câmera orbitar lentamente ao redor de um sujeito, para luz suave se deslocar sobre uma superfície, para grama balançar suavemente ou para sombras se moverem elegantemente pelo quadro. O resultado é um vídeo com movimento suave e contínuo, com uma sensação genuinamente premium. Como o modelo lê tanto sua imagem quanto suas palavras, você mantém o controle criativo sobre ritmo, comportamento da câmera e atmosfera.
Uma das principais características é a geração nativa de áudio. Em vez de adicionar som em uma etapa de edição separada, o modelo produz áudio diretamente junto com o vídeo. Ele suporta saída de voz em chinês e inglês, e outros idiomas são automaticamente traduzidos para o inglês. Quando quiser fala em inglês, escrever em minúsculas produz fala natural, enquanto maiúsculas são reservadas para acrônimos ou nomes próprios para que sejam pronunciados corretamente. Se preferir um clipe silencioso, você pode simplesmente desativar o áudio e manter apenas a filmagem.
O modelo oferece controle significativo sobre o comprimento. Você pode gerar clipes de 3 segundos até completos 15 segundos, com padrão de 5 segundos. Durações mais curtas são ideais para loops rápidos, trechos para redes sociais e fotos de beleza de produtos, enquanto durações mais longas permitem construir uma sequência mais desenvolvida ou contar uma pequena história em uma única geração.
Para projetos mais ambiciosos, o modelo suporta geração de vídeo com múltiplos takes. Em vez de um único prompt, você pode fornecer uma série de prompts que dividem o vídeo em múltiplos takes, permitindo roteirizar uma sequência de momentos distintos em um clipe. Você pode direcionar exatamente como esses takes são estruturados ou entregar as rédeas ao modelo para que ele determine inteligentemente a estrutura dos takes. Isso permite ir além de um único take contínuo e criar algo mais próximo de uma cena editada.
Outra capacidade poderosa é o suporte a elementos personalizados. Você pode fornecer ao modelo personagens ou objetos específicos que deseja que apareçam no vídeo e referenciá-los diretamente no prompt usando tags simples como @Element1 ou @Element2. Cada elemento pode ser definido por um conjunto de imagens — uma imagem frontal principal mais uma a três imagens de referência adicionais de ângulos diferentes — ou por um vídeo de referência curto. Isso mantém um personagem, produto ou objeto específico consistente e reconhecível ao longo da filmagem gerada, o que é inestimável para trabalhos de marca, personagens recorrentes e narrativas.
O modelo também permite guiar o final do seu clipe. Junto com a imagem inicial, você pode fornecer opcionalmente uma imagem final, dando ao modelo um alvo para se mover. Isso é útil quando você quer que o movimento termine em uma composição ou pose específica, em vez de deixar o final ao acaso.
Vários controles criativos ajudam a ajustar exatamente o visual desejado. Uma configuração de adesão ao prompt determina quão fielmente o modelo segue sua descrição escrita versus quanta liberdade criativa ele toma — valores mais baixos permitem mais interpretação, valores mais altos mantêm alinhamento estrito às suas palavras. Você também pode usar um prompt negativo para afastar o modelo de qualidades indesejadas; por padrão, ele evita borrão, distorção e baixa qualidade, e você pode adicionar seus próprios termos para excluir outras coisas que não quer ver.
Este modelo é ideal para uma ampla gama de profissionais criativos. Cineastas e designers de motion podem prototipar takes cinematográficos e movimentos de câmera sem um rig de câmera. Marketers e designers de produtos podem animar fotos estáticas de produtos em clipes promocionais chamativos. Ilustradores e artistas conceituais podem dar movimento às suas artes estáticas. Criadores de conteúdo para redes sociais podem produzir vídeos curtos polidos com som integrado. E qualquer um trabalhando em peças narrativas pode contar com geração de múltiplos takes e elementos personalizados para manter personagens e cenas consistentes em uma sequência.
Em termos do que produz, a saída é um arquivo de vídeo MP4 padrão, fácil de baixar, compartilhar ou inserir em uma edição maior. O foco é em visuais cinematográficos e movimento fluido e convincente — o modelo é ajustado para fazer superfícies captarem luz de forma convincente, objetos se moverem naturalmente e o clipe geral parecer intencional e refinado, em vez de trêmulo ou artificial.
Algumas coisas valem a pena lembrar ao trabalhar. Você fornece um único prompt ou uma sequência de múltiplos prompts, mas não ambos ao mesmo tempo, então decida antecipadamente se quer um take contínuo ou estrutura de múltiplos takes. Elementos personalizados precisam de material de referência claro — para elementos baseados em imagens, uma vista frontal mais ângulos adicionais ajudam o modelo a entender o sujeito completamente. Ao usar áudio com fala, seguir a orientação de minúsculas para fala e maiúsculas para acrônimos dará a saída de voz mais limpa. E como com qualquer ferramenta generativa, um prompt descritivo e específico sobre movimento de câmera, iluminação e ritmo o aproximará notavelmente do resultado imaginado. Com prompts bem pensados e o rico conjunto de controles do modelo, você pode ir de um único frame a um clipe finalizado, cinematográfico e com som em um passo.
Add the image that you want change
Adicione uma imagem opcional para orientar o visual, o personagem ou o ambiente
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
Digite um prompt - o modelo compreende a física, a iluminação e a intenção emocional da sua cena
Clique para gerar o resultado final e baixe um vídeo com qualidade de produção
Animação cinematográfica da natureza com iluminação dinâmica e movimento ambiental — ótima para conteúdo de viagem ou documentários de natureza.
Perfeita para anúncios de produtos de alto padrão, animando vidro, reflexos e movimento de câmera para narrativas visuais de luxo.
Demonstra animação dramática de clima e movimento amplo de câmera, ideal para trailers cinematográficos ou aberturas atmosféricas.
“Animate with subtle natural movements. Add gentle breathing motion to shoulders. Create natural eye blinks every 2-3 seconds. Introduce slight head micro-movements. Hair moves softly as if in gentle breeze. Maintain the warm smile with subtle lip movements. Eyes should have natural catchlight movement. Keep animation subtle and lifelike, not exaggerated. 5 seconds, smooth looping.”
Mude para a síntese guiada por raciocínio hoje mesmo

Animate images into video with audio
10 créditos

Cinematic video from images
10 créditos

Animate images into cinematic video
0.6 créditos

Multimodal references to video
10 créditos

Cinematic video from images fast
0.1 créditos

Animate image to 1080p video
2.8 créditos