Flexible multilingual image generation model

















Wan v2.6 Text to Image és un model de generació d'imatges versàtil que transforma descripcions escrites en visuals acabats, oferint als artistes, dissenyadors i creadors de continguts un camí ràpid de la idea a la imatge. Dissenyat tant per a treballs fotorealistes com estilitzats, llegeix un prompt de text pla i produeix imatges que reflecteixen l'humor, la il·luminació, el subjecte i els detalls que descrius. Sigui que estiguis esbossant art conceptual, il·lustrant una història, construint visuals de màrqueting o explorant direccions creatives, Wan v2.6 et proporciona un punt de partida flexible que respon estretament al que escrius.
Una de les característiques destacades d'aquest model és la seva comprensió bilingüe. Pots escriure prompts en anglès o xinès, i el model els interpreta amb fluïdesa. Això el fa especialment valuós per a creadors que treballen a través de llengües o cultures, i significa que pots descriure la teva visió en la llengua que et sembli més natural sense traduir les teves idees primer. Els prompts poden ser força detallats també — tens espai per a fins a 2.000 caràcters, així que pots afegir especificitats sobre l'entorn, l'atmosfera, l'angle de càmera, l'estil artístic i detalls visuals fins per dirigir el resultat exactament on el vols.
El model funciona només amb text, però també pots proporcionar una única imatge de referència opcional per guiar l'estil de la teva sortida. Quan proporcioneu una referència, el model pot aprofitar el seu aspecte i sensació per informar la imatge generada, cosa útil quan vols visuals nous que coincideixin amb una estètica existent, paleta de marca o tauler d'humor. Les imatges de referència s'accepten en formats comuns com JPEG, PNG, BMP i WEBP, amb resolucions des de 384 fins a 5000 píxels en cada costat.
Controlar el resultat és senzill. Triïu la forma i mida de sortida utilitzant presets convenients — quadrat, retrat i paisatge com quadrat HD, retrat 4:3, retrat 16:9, paisatge 4:3 i paisatge 16:9 — o podeu introduir dimensions exactes quan necessiteu un llenç precís. Si no especifiqueu una mida i heu proporcionat una imatge de referència, la sortida coincideix amb les dimensions de la referència fins a una àrea de 1280 per 1280. Aquesta flexibilitat significa que pots generar visuals dimensionats per a publicacions socials, disposicions d'impressió, escenes de gran pantalla o contingut mòbil vertical sense retallar extra.
A més del teu prompt principal, pots afegir un prompt negatiu per descriure el que vols evitar. És una manera senzilla però efectiva de netejar els resultats — per exemple, allunyar el model de coses com baixa resolució, deformitats o artefactes no desitjats. Tens fins a 500 caràcters per a això, suficient per bloquejar problemes comuns i empènyer el model cap a l'aspecte polit que busques.
Wan v2.6 també pot generar més d'una imatge alhora. Pots sol·licitar fins a cinc imatges en una sola execució, permetent-te explorar variacions de la mateixa idea i triar el millor resultat, tot i que el model pot retornar-ne menys de vegades depenent de la generació. Aquest enfocament per lots és genial per a sessions d'ideació on vols veure múltiples interpretacions d'un concepte recolzades abans de comprometre't amb una direcció.
Per als creadors que valoren la consistència i la repetibilitat, el model admet un control de seed. Establir un seed et permet reproduir un resultat particular o fer petits ajustos controlats a un prompt mantenint l'estructura general estable. És útil quan has arribat a alguna cosa propera al que vols i només necessites ajustar un detall en lloc de començar de nou. Cada generació també informa el seed utilitzat, així que pots desar-lo i tornar a un aspecte que t'ha agradat.
El model produeix imatges en format PNG, un format net i d'alta fidelitat ben adaptat a l'edició posterior, superposicions i integració en treballs de disseny. Els seus exemples de sortida tendeixen a escenes riques i atmosfèriques — pensa en una biblioteca antiga flotant entre núvols amb llum daurada entrant per finestres massives, renderitzada fotorealistament. Aquest tipus de prompt mostra la comoditat del model amb il·luminació complexa, entorns multicapa i detall evocador, però maneja una àmplia gamma de subjectes i estils depenent de com escriguis el teu prompt.
Wan v2.6 també té una capacitat mixta de text i imatge, significatiu en certs modes pot retornar text generat a més de la imatgeria. Això obre possibilitats per a creadors que volen més que una imatge independent, tot i que la força principal del model roman en la generació d'imatges.
La moderació de contingut està integrada i activa per defecte, filtrant tant l'entrada que proporcioneu com les imatges produïdes. Això ajuda a mantenir el contingut generat dins de límits segurs i adequats, important per a treballs creatius professionals i comercials.
En termes de qui en beneficia més: il·lustradors i artistes conceptuals poden visualitzar escenes i personatges ràpidament; dissenyadors gràfics poden generar fons, imatges principals i exploracions estilístiques; màrqueters i creadors de xarxes socials poden produir visuals atractius en les relacions d'aspecte exactes que necessiten; i cineastes i narradors poden construir taulers d'humor i fotogrames de previsualització. El suport de prompts bilingües amplia el seu abast a creadors que treballen en contextos d'anglès i xinès.
Unes notes pràctiques t'ajuden a obtenir els millors resultats. Prompts detallats i descriptius tendeixen a produir imatges més fidels, així que val la pena especificar il·luminació, estil i composició. Utilitzar el prompt negatiu per excloure defectes comuns pot elevar notablement la qualitat de la teva sortida. Generar diverses imatges alhora i comparar-les és una manera eficient de trobar la millor interpretació de la teva idea. I desar el seed d'un resultat que t'encanta et permet revisitar-lo o refinar-lo més tard. En resum, Wan v2.6 Text to Image és una eina capaç i adaptable per convertir idees escrites en visuals polits en un ampli espectre de treballs creatius.
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
Escriu una indicació que descrigui la imatge que vols amb detalls d'estil, il·luminació i composició
El model entén la física, la il·luminació i la intenció emocional de la teva escena
Fes clic per generar el resultat final i descarregar una imatge de qualitat professional
Mostra la capacitat del model per visuals cinematogràfics d'angle ampli amb il·luminació atmosfèrica i aspecte fílmico trendy, perfecte per narracions.

Il·lustra la generació d'escenes vives i aspiracionals amb múltiples persones amb gènere i estil precís, ideal per branding lifestyle modern.

Destaca com el model renderitza complexitat arquitectònica, llum atmosfèrica i detalls fotorealistes, millorant la narració visual moderna i aspiracional.

“High-end studio product photography of premium wireless over-ear headphones in matte black finish. Dramatic three-point lighting with soft key light from upper left, rim light highlighting the ear cup contours, and subtle fill. Clean white seamless backdrop with soft gradient. Sharp focus on texture details of the leather headband and brushed metal accents. Professional advertising quality, 8K resolution, photorealistic rendering.”

Passa't avui a la síntesi guiada per raonament

Fast efficient image generation
6 crèdits
![V4.0q [fast]](https://v3b.fal.media/files/b/0aa0cdc0/4AWx22ZkcZYZBZ73YKkdT.jpg)
Fast text-accurate image generation
0.1 crèdits

Precise structured text-to-image generation
0.2 crèdits

Design-first text to image generation
0.2 crèdits

Detailed images with fine typography
4 crèdits

High-fidelity text-to-image generation
0.1 crèdits

Fast, efficient image generation
6 crèdits

Unified image generation and editing
1.5 crèdits

Fast high-quality text-to-image generation
0.3 crèdits