Cinematic video with native audio
Seedance 2.0 Text to Video és el model text-a-vídeo més avançat de ByteDance, dissenyat per convertir un únic prompt escrit en un vídeo cinematogràfic, llest per compartir. Mentre que molts generadors de vídeo produeixen una única imatge silent, Seedance 2.0 ofereix escenes completes amb àudio sincronitzat natiu, edició multi-shot, física creïble del món real i control de càmera a nivell de director — tot generat junts a partir de la vostra descripció.
Al seu nucli, el model llegeix el vostre prompt com un petit guió. Podeu descriure no només què passa, sinó com es desenvolupa a través de plans. Per exemple, un prompt com "Un pop troba una pilota de futbol a l'oceà i crida emocionat els seus amics pops per jugar, després tall a un partit de futbol de pops sota el mar" produirà un clip que realment canvia d'escena, escenificant l'acció a través de múltiples plans en lloc de tancar-ho tot en un fotograma estàtic. Aquesta capacitat multi-shot fa possible fer un storyboard d'una narrativa curta en una sola generació.
Una de les característiques destacades és l'àudio natiu. Per defecte, el model genera una banda sonora sincronitzada juntament amb la imatge, incloent efectes de so, sons ambientals de fons i parla sincronitzada amb els llavis. Això significa que els personatges poden parlar amb moviments de boca que coincideixen amb el diàleg, els entorns poden tenir ambient realista i les accions poden estar acompanyades d'efectes de so adequats — sense necessitar un pas d'àudio separat. Si preferiu un clip silent per afegir-hi la vostra pròpia banda sonora, podeu apagar la generació d'àudio.
Seedance 2.0 posa èmfasi en la física del món real, per la qual cosa el moviment sol comportar-se com en imatges reals: l'aigua flueix, els objectes cauen i xoquen de manera plausible, i el moviment té pes en lloc de desplaçar-se o lliscar de forma antinatural. Combinat amb el control de càmera a nivell de director, podeu dirigir la sensació d'un pla — moviments de càmera ampla, encadrat deliberat i acció dinàmica — descrivint-ho en el vostre prompt.
Opcions de resolució i format
El model admet una àmplia gamma de resolucions de sortida per adaptar-se a les vostres necessitats i flux de treball. Podeu triar 480p per a una generació més ràpida quan esteu iterant una idea, 720p com a opció equilibrada per defecte, 1080p per a treballs finals d'alta qualitat o 4K per a la màxima fidelitat. Aquesta gamma us permet esbossar conceptes ràpidament a resolucions més baixes i després renderitzar versions finals polides a resolucions més altes.
La relació d'aspecte és totalment flexible. Trieu 16:9 per a paisatge estàndard, 9:16 per a contingut vertical/portret fet per a mòbils i feeds socials, 1:1 per a publicacions quadrades, 4:3 o 3:4 per a encadrats clàssics, o 21:9 per a un aspecte cinematogràfic ultrapanoràmic. Si no voleu decidir, una opció automàtica deixa que el model esculli l'encadrat que millor s'adapti al vostre prompt.
La durada del clip també és ajustable. Podeu establir qualsevol durada de 4 a 15 segons, o deixar que el model esculli automàticament la longitud basant-se en el que descriu el vostre prompt — pràctic quan una escena necessita una mica més d'espai per respirar o un cop ràpid és tot el que cal.
Per a la qualitat de sortida final, hi ha un control de qualitat de fitxer. Una configuració estàndard manté els fitxers a la mida per defecte, mentre que una opció d'alta qualitat produeix un fitxer més ric i gran — útil quan voleu la màxima claredat visual per a lliurament o edició posterior.
Per a qui és
Seedance 2.0 és ideal per a cineastes i creadors de vídeo que vulguin prototipar escenes, animàtics o seqüències curtes completes sense càmera ni equip. Creadors de contingut per xarxes socials i màrqueters poden produir clips verticals o quadrats adaptats a cada plataforma, complets amb so. Dissenyadors i artistes poden donar moviment als seus conceptes, explorant estils estilitzats i transformadors. Com que el model gestiona talls, treball de càmera i àudio en un sol pas, és especialment valuós per a qualsevol que necessiti un clip amb sensació de finalitzat en lloc de material cru per muntar després.
Controls creatius d'un cop d'ull
Millors pràctiques
Com que el model respon a l'estructura narrativa, escriure el vostre prompt com una llista de plans — assenyalant canvis d'escena amb indicadors com "tall a" — l'ajuda a lliurar l'edició multi-shot per la qual és conegut. Quan experimenteu, genereu a resolucions més baixes i durades més curtes per explorar idees ràpidament, després torneu a renderitzar els vostres favorits en 1080p o 4K amb l'opció d'alta qualitat per a lliurament. Si voleu diàleg parlat, incloeu les línies directament al prompt perquè el model pugui sincronitzar-les amb els llavis. I quan l'encadrat importi per a una plataforma específica, establiu la relació d'aspecte explícitament en lloc de confiar en la selecció automàtica.
Cada generació també retorna la llavor utilitzada per crear-la, perquè pugueu fer seguiment dels resultats mentre itereu. Amb la seva barreja de visuals cinematogràfics, so sincronitzat, moviment del món real i narració multi-shot, Seedance 2.0 converteix una idea escrita en un clip de vídeo complet i atmosfèric en un sol pas.
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
Descriu l'escena del teu vídeo amb moviment, angles de càmera i ambient
El model crea moviment cinematogràfic amb física i il·luminació naturals
Descarrega i comparteix el teu vídeo a punt per publicar
Aproveita el control de càmera a nivell de director de Seedance 2.0 amb moviments de càmera multi-etapa complexos, dinàmiques d'escena atmosfèriques i narració ultrapanoràmica 16:9 cinematogràfica amb àudio ambiental sincronitzat.
Demostra la simulació de física del món real de Seedance 2.0 amb dinàmiques de vehicles, transicions dramàtiques de temps atmosfèric i treball de càmera cinematogràfic d'alta energia adequat per a producció de vídeo comercial en paisatge.
Mostra la capacitat de Seedance 2.0 per renderitzar fenòmens naturals complexos amb comportament de llum físicament precís, transicions sense costures de sota l'aigua a superfície i àudio immersiu sincronitzat per a contingut d'estil documental cinematogràfic.
“Cinematic reveal of a sleek black luxury sports car in a dark studio. Camera starts close on the chrome badge, slowly pulling back while orbiting 180 degrees around the vehicle. Dramatic rim lighting gradually intensifies, highlighting the car's sculptural curves and glossy finish. Reflections dance across the body as the camera moves. Dust particles float in volumetric light beams. Final wide shot reveals the full silhouette against a gradient backdrop. 8 seconds, smooth motion, 24fps cinematic quality.”
Passa't avui a la síntesi guiada per raonament

Text to video with audio
0.3 crèdits
Text to video with audio
0.7 crèdits

Fast cinematic video with audio
0.1 crèdits

Film-grade video with audio
0.1 crèdits
![Kling Video v3 Text to Video [Standard]](https://v3b.fal.media/files/b/0a8cfc9f/dei5OqFRB9HK8AgSHwk8f_9a5eea197b3045d1be55aedb0213f6f9.jpg)
Cinematic text-to-video with audio
4.2 crèdits

Cinematic video from references
10 crèdits

Frontier 2K text-to-video generation
7.3 crèdits

Cinematic video from references
0.4 crèdits

Fast balanced text-to-video generation
1.6 crèdits