Cinematic video with native audio
O Seedance 2.0 Text to Video é o modelo text-to-video mais avançado da ByteDance, concebido para transformar um único prompt escrito em vídeo cinematográfico, pronto para partilhar. Enquanto muitos geradores de vídeo produzem uma única tomada silenciosa, o Seedance 2.0 oferece cenas completas com áudio sincronizado nativo, edição multi-plano, física realista do mundo real e controlo de câmara ao nível de realizador — tudo gerado em conjunto a partir da sua descrição.
No seu núcleo, o modelo lê o seu prompt como um mini-argumento. Pode descrever não só o que acontece, mas como se desenrola através de planos. Por exemplo, um prompt como "Um polvo encontra uma bola de futebol no oceano e chama excitadamente os seus amigos polvos para virem jogar, depois corte para um jogo de futebol de polvos debaixo de água" produzirá um clip que efetivamente corta entre cenas, encenando a ação através de múltiplos planos em vez de confinar tudo a um único fotograma estático. Esta capacidade multi-plano torna possível criar um storyboard de uma curta narrativa numa única geração.
Uma das funcionalidades destacadas é o áudio nativo. Por defeito, o modelo gera uma banda sonora sincronizada juntamente com a imagem, incluindo efeitos sonoros, sons ambientais de fundo e fala sincronizada com os lábios. Isso significa que os personagens podem falar com os movimentos da boca a corresponderem ao diálogo, os ambientes podem ter ambiente realista e as ações podem ser sublinhadas por efeitos sonoros adequados — sem necessidade de uma passada de áudio separada. Se preferir um clip silencioso para adicionar a sua própria banda sonora, a geração de áudio pode ser desligada.
O Seedance 2.0 enfatiza a física do mundo real, pelo que o movimento tende a comportar-se como em filmagens reais: a água flui, os objetos caem e colidem de forma plausível e o movimento tem peso em vez de derivar ou deslizar de forma antinatural. Combinado com o controlo de câmara ao nível de realizador, pode direcionar a sensação de um plano — movimentos de câmara amplos, enquadramento deliberado e ação dinâmica — descrevendo-o no seu prompt.
Opções de resolução e formato
O modelo suporta uma vasta gama de resoluções de saída para se adequar às suas necessidades e fluxo de trabalho. Pode escolher 480p para uma geração mais rápida quando está a iterar uma ideia, 720p como padrão equilibrado, 1080p para trabalho acabado de alta qualidade ou 4K para a maior fidelidade. Esta gama permite delinear conceitos rapidamente em resoluções mais baixas e depois renderizar versões finais polidas em resoluções mais elevadas.
A proporção do aspeto é totalmente flexível. Escolha 16:9 para paisagem padrão, 9:16 para conteúdo vertical/retrato concebido para telemóveis e feeds sociais, 1:1 para publicações quadradas, 4:3 ou 3:4 para enquadramentos clássicos, ou 21:9 para um visual cinematográfico ultralargo. Se não quiser decidir, uma opção automática deixa o modelo escolher o enquadramento que melhor se adequa ao seu prompt.
A duração do clip também é ajustável. Pode definir qualquer duração de 4 a 15 segundos, ou deixar o modelo escolher automaticamente a duração com base no que o seu prompt descreve — útil quando uma cena precisa de um pouco mais de espaço para respirar ou um batimento rápido é tudo o que é necessário.
Para a qualidade de saída final, existe um controlo de qualidade de ficheiro. Uma definição padrão mantém os ficheiros no tamanho predefinido, enquanto uma opção de alta qualidade produz um ficheiro mais rico e maior — útil quando quer a máxima clareza visual para entrega ou edição adicional.
Para quem é destinado
O Seedance 2.0 é uma excelente escolha para realizadores e criadores de vídeo que querem prototipar cenas, animáticas ou sequências curtas completas sem câmara ou equipa. Criadores de redes sociais e marketeers podem produzir clips verticais ou quadrados adaptados a cada plataforma, completos com som. Designers e artistas podem dar vida a conceitos em movimento, explorando visuais estilizados e transformadores. Como o modelo gere cortes, trabalho de câmara e áudio numa única passada, é especialmente valioso para quem precisa de um clip com sensação acabada em vez de imagens brutas para montar mais tarde.
Controlos criativos de um relance
Melhores práticas
Como o modelo responde à estrutura narrativa, escrever o seu prompt como uma lista de planos — notando mudanças de cena com indicações como "corte para" — ajuda-o a entregar a edição multi-plano pela qual é conhecido. Quando está a experimentar, gere em resolução mais baixa e duração mais curta para explorar ideias rapidamente, depois re-renderize o seu favorito em 1080p ou 4K com a opção de alta qualidade para entrega. Se quiser diálogo falado, inclua as falas diretamente no seu prompt para que o modelo as sincronize com os lábios. E quando o enquadramento importa para uma plataforma específica, defina a proporção do aspeto explicitamente em vez de depender da seleção automática.
Cada geração também devolve a seed utilizada para a criar, para que possa acompanhar os resultados à medida que itera. Com a sua combinação de visuais cinematográficos, som sincronizado, movimento do mundo real e narrativa multi-plano, o Seedance 2.0 transforma uma ideia escrita num clip de vídeo completo e atmosférico num único passo.
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
Descreva a cena do seu vídeo com movimento, ângulos de câmara e ambiente
O modelo cria movimento cinematográfico com física e iluminação naturais
Transfira e partilhe o seu vídeo pronto para produção
Aproveita o controlo de câmara ao nível de realizador do Seedance 2.0 com movimentos de câmara multi-etapa complexos, dinâmicas atmosféricas de cena e narrativa cinematográfica ultralarga 16:9 com áudio ambiental sincronizado.
Demonstra a simulação de física do mundo real do Seedance 2.0 com dinâmicas de veículos, transições dramáticas de tempo atmosférico e trabalho de câmara cinematográfico de alta energia adequado para produção de vídeo comercial em paisagem.
Mostra a capacidade do Seedance 2.0 para renderizar fenómenos naturais complexos com comportamento de luz fisicamente preciso, transições suaves de subaquático para superfície e áudio sincronizado imersivo para conteúdo em estilo de documentário cinematográfico.
“Cinematic reveal of a sleek black luxury sports car in a dark studio. Camera starts close on the chrome badge, slowly pulling back while orbiting 180 degrees around the vehicle. Dramatic rim lighting gradually intensifies, highlighting the car's sculptural curves and glossy finish. Reflections dance across the body as the camera moves. Dust particles float in volumetric light beams. Final wide shot reveals the full silhouette against a gradient backdrop. 8 seconds, smooth motion, 24fps cinematic quality.”
Mude hoje para a síntese guiada por raciocínio

Cinematic video from references
0.4 créditos

Film-grade video with audio
0.1 créditos

Fast cinematic video with audio
0.1 créditos

Cinematic video from references
10 créditos

Fast balanced text-to-video generation
1.6 créditos

Text to video with audio
0.3 créditos
Text to video with audio
0.7 créditos
![Kling Video v3 Text to Video [Standard]](https://v3b.fal.media/files/b/0a8cfc9f/dei5OqFRB9HK8AgSHwk8f_9a5eea197b3045d1be55aedb0213f6f9.jpg)
Cinematic text-to-video with audio
4.2 créditos

Frontier 2K text-to-video generation
7.3 créditos