Cinematic video with native audio
Seedance 2.0 Text to Video es el modelo text-to-video más avanzado de ByteDance, diseñado para convertir un único prompt escrito en un vídeo cinematográfico listo para compartir. Mientras que muchos generadores de vídeo producen una sola toma silenciosa, Seedance 2.0 ofrece escenas completas con audio sincronizado nativo, edición multi-toma, física creíble del mundo real y control de cámara a nivel de director — todo generado junto a partir de tu descripción.
En su núcleo, el modelo lee tu prompt como un guion breve. Puedes describir no solo qué sucede, sino cómo se desarrolla a lo largo de las tomas. Por ejemplo, un prompt como «Un pulpo encuentra un balón de fútbol en el océano y llama emocionado a sus amigos pulpos para que vengan a jugar, luego corte a un partido de fútbol de pulpos bajo el mar» producirá un clip que realmente hace cortes entre escenas, representando la acción a través de múltiples tomas en lugar de atrapar todo en un solo fotograma estático. Esta capacidad multi-toma hace posible crear un storyboard de una breve narrativa en una sola generación.
Una de las características destacadas es el audio nativo. Por defecto, el modelo genera una banda sonora sincronizada junto con la imagen, incluyendo efectos de sonido, sonidos ambientales de fondo y habla sincronizada con los labios. Esto significa que los personajes pueden hablar con movimientos de boca que coinciden con el diálogo, los entornos pueden tener una atmósfera realista y las acciones pueden ir acompañadas de efectos de sonido adecuados — sin necesidad de una pasada de audio separada. Si prefieres un clip silencioso para añadir tu propia banda sonora, puedes desactivar la generación de audio.
Seedance 2.0 enfatiza la física del mundo real, por lo que el movimiento tiende a comportarse como en una grabación real: el agua fluye, los objetos caen y chocan de forma plausible, y el movimiento tiene peso en lugar de flotar o deslizarse de manera antinatural. Combinado con el control de cámara a nivel de director, puedes dirigir la sensación de una toma — movimientos de cámara amplios, encuadres deliberados y acción dinámica — describiéndolo en tu prompt.
Opciones de resolución y formato
El modelo soporta una amplia gama de resoluciones de salida para adaptarse a tus necesidades y flujos de trabajo. Puedes elegir 480p para una generación más rápida al iterar en una idea, 720p como valor predeterminado equilibrado, 1080p para trabajos terminados de alta calidad, o 4K para la máxima fidelidad. Esta gama te permite esbozar conceptos rápidamente a resoluciones bajas y luego renderizar versiones finales pulidas a resoluciones más altas.
La relación de aspecto es completamente flexible. Elige 16:9 para paisaje estándar, 9:16 para contenido vertical/retrato diseñado para móviles y redes sociales, 1:1 para publicaciones cuadradas, 4:3 o 3:4 para encuadres clásicos, o 21:9 para un aspecto cinematográfico ultrapanorámico. Si no quieres decidir, una opción automática deja que el modelo elija el encuadre que mejor se adapte a tu prompt.
La duración del clip también es ajustable. Puedes establecer cualquier duración de 4 a 15 segundos, o dejar que el modelo elija automáticamente la longitud en función de lo que describes en tu prompt — útil cuando una escena necesita un poco más de espacio para desarrollarse o un golpe rápido es suficiente.
Para la calidad de salida final, hay un control de calidad de archivo. Una configuración estándar mantiene los archivos en el tamaño predeterminado, mientras que una opción de alta calidad produce un archivo más rico y grande — útil cuando quieres la máxima claridad visual para entrega o edición posterior.
Para quién es
Seedance 2.0 es ideal para cineastas y creadores de vídeo que quieran prototipar escenas, animáticas o secuencias cortas completas sin cámara ni equipo. Creadores de redes sociales y marketeros pueden producir clips verticales o cuadrados adaptados a cada plataforma, completos con sonido. Diseñadores y artistas pueden dar movimiento a conceptos, explorando estilos estilizados y transformadores. Como el modelo maneja cortes, trabajo de cámara y audio en una sola pasada, es especialmente valioso para cualquiera que necesite un clip con sensación terminada en lugar de material bruto para ensamblar después.
Controles creativos de un vistazo
Mejores prácticas
Dado que el modelo responde a la estructura narrativa, escribir tu prompt como una lista de tomas — indicando cambios de escena con indicaciones como «corte a» — ayuda a que entregue la edición multi-toma por la que es conocido. Cuando experimentes, genera a resolución más baja y duración más corta para explorar ideas rápidamente, luego vuelve a renderizar tu favorita en 1080p o 4K con la opción de alta calidad para la entrega. Si quieres diálogo hablado, incluye las líneas directamente en tu prompt para que el modelo las sincronice con los labios. Y cuando el encuadre importe para una plataforma específica, establece la relación de aspecto explícitamente en lugar de depender de la selección automática.
Cada generación también devuelve la semilla utilizada para crearla, para que puedas hacer seguimiento de los resultados al iterar. Con su combinación de visuales cinematográficos, sonido sincronizado, movimiento del mundo real y narrativa multi-toma, Seedance 2.0 convierte una idea escrita en un clip de vídeo completo y atmosférico en un solo paso.
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
Describe la escena de tu vídeo con movimiento, ángulos de cámara y ambiente
El modelo crea movimiento cinematográfico con física e iluminación naturales
Descarga y comparte tu vídeo listo para producción
Aprovecha el control de cámara a nivel director de Seedance 2.0 con movimientos de cámara multi-etapa complejos, dinámicas atmosféricas de escena y narrativa cinematográfica ultrapanorámica 16:9 con audio ambiental sincronizado.
Demuestra la simulación de física del mundo real de Seedance 2.0 con dinámicas de vehículos, transiciones dramáticas de clima y trabajo de cámara cinematográfica de alta energía adecuado para producción de vídeo comercial en paisaje.
Muestra la capacidad de Seedance 2.0 para renderizar fenómenos naturales complejos con comportamiento de luz físicamente preciso, transiciones fluidas de bajo el agua a superficie e inmersivo audio sincronizado para contenido estilo documental cinematográfico.
“Cinematic reveal of a sleek black luxury sports car in a dark studio. Camera starts close on the chrome badge, slowly pulling back while orbiting 180 degrees around the vehicle. Dramatic rim lighting gradually intensifies, highlighting the car's sculptural curves and glossy finish. Reflections dance across the body as the camera moves. Dust particles float in volumetric light beams. Final wide shot reveals the full silhouette against a gradient backdrop. 8 seconds, smooth motion, 24fps cinematic quality.”
Pásate hoy a la síntesis guiada por razonamiento

Text to video with audio
0.3 créditos

Fast cinematic video with audio
0.1 créditos

Fast balanced text-to-video generation
1.6 créditos

Film-grade video with audio
0.1 créditos

Cinematic video from references
10 créditos

Cinematic video from references
0.4 créditos
![Kling Video v3 Text to Video [Standard]](https://v3b.fal.media/files/b/0a8cfc9f/dei5OqFRB9HK8AgSHwk8f_9a5eea197b3045d1be55aedb0213f6f9.jpg)
Cinematic text-to-video with audio
4.2 créditos

Frontier 2K text-to-video generation
7.3 créditos
Text to video with audio
0.7 créditos