Flexible multilingual image generation model

















Wan v2.6 Text to Image är en mångsidig bildgenereringsmodell som förvandlar skrivna beskrivningar till färdiga visuella bilder och ger artister, designers och innehållsskapare en snabb väg från idé till bild. Byggd för både fotorealistiskt och stiliserat arbete läser den en vanlig textprompt och producerar bilder som återspeglar stämning, belysning, subjekt och detaljer du beskriver. Oavsett om du skissar konceptkonst, illustrerar en berättelse, bygger marknadsföringsvisualer eller utforskar kreativa riktningar ger Wan v2.6 dig en flexibel startpunkt som svarar nära på det du skriver.
En av modellens mest iögonfallande funktioner är dess tvåspråkiga förståelse. Du kan skriva prompts på engelska eller kinesiska, och modellen tolkar båda flytande. Detta gör den särskilt värdefull för skapare som arbetar över språk- eller kulturgränser, och det betyder att du kan beskriva din vision på det språk som känns mest naturligt utan att översätta dina idéer först. Prompts kan vara ganska detaljerade också – du har utrymme för upp till 2 000 tecken, så du kan lägga in specifika detaljer om miljö, atmosfär, kameravinkel, konstnärlig stil och fina visuella detaljer för att styra resultatet exakt dit du vill.
Modellen arbetar enbart från text, men du kan också tillhandahålla en valfri referensbild för att vägleda utseendet hos din utdata. När du anger en referens kan modellen dra nytta av dess look och känsla för att påverka den genererade bilden, vilket är praktiskt när du vill ha nya visuella element som matchar en befintlig estetik, varumärkespalett eller moodboard. Referensbilder accepteras i vanliga format som JPEG, PNG, BMP och WEBP, med upplösningar från 384 till 5 000 pixlar på varje sida.
Att styra resultatet är enkelt. Du väljer utdatans form och storlek med bekväma förinställningar – fyrkantigt, porträtt och landskap i förhållanden som square HD, portrait 4:3, portrait 16:9, landscape 4:3 och landscape 16:9 – eller så kan du ange exakta mått när du behöver en precis duk. Om du inte anger en storlek och har tillhandahållit en referensbild matchar utdata referensens mått upp till ett område på 1280 x 1280. Denna flexibilitet gör att du kan generera visuella element dimensionerade för sociala inlägg, trycklayouter, bredskärmsscener eller vertikalt mobilinnehåll utan extra beskärning.
Tillsammans med din huvudsakliga prompt kan du lägga till en negativ prompt för att beskriva vad du vill undvika. Detta är ett enkelt men effektivt sätt att rensa upp resultaten – till exempel styra modellen bort från saker som låg upplösning, deformiteter eller oönskade artefakter. Du får upp till 500 tecken för detta, vilket räcker för att stänga ute vanliga problem och driva modellen mot det polerade utseende du eftersträvar.
Wan v2.6 kan också generera mer än en bild åt gången. Du kan begära upp till fem bilder i ett enda körning, vilket låter dig utforska variationer av samma idé och välja det starkaste resultatet, även om modellen ibland kan returnera färre beroende på genereringen. Detta batch-tillvägagångssätt är utmärkt för idégenereringssessioner där du vill se flera tolkningar av ett koncept sida vid sida innan du bestämmer dig för en riktning.
För skapare som värdesätter konsistens och upprepningsbarhet stöder modellen seed-styrning. Genom att ange en seed kan du reproducera ett specifikt resultat eller göra små, kontrollerade justeringar av en prompt samtidigt som du håller den övergripande kompositionen stabil. Detta är användbart när du har hittat något nära det du vill och bara behöver finjustera en detalj istället för att börja om. Varje generering rapporterar också den seed som användes, så du kan spara den och återvända till ett utseende du gillade.
Modellen matar ut bilder i PNG-format, ett rent, högkvalitativt format som är väl lämpat för vidare redigering, lager och integration i designarbete. Dess exempelutdata lutar mot rika, atmosfäriska scener – tänk ett antikt bibliotek som svävar bland moln med gyllene timmens ljus som strömmar in genom massiva fönster, renderat fotorealistiskt. Den typen av prompt visar modellens komfort med komplex belysning, lager-på-lager-miljöer och evocativa detaljer, men den hanterar ett brett spektrum av subjekt och stilar beroende på hur du skriver din prompt.
Wan v2.6 har också en blandad text-och-bild-funktion, vilket innebär att den i vissa lägen kan returnera genererad text tillsammans med bilder. Detta öppnar upp möjligheter för skapare som vill ha mer än en fristående bild, även om modellens primära styrka förblir bildgenerering.
Innehållsmoderering är inbyggd och aktiv som standard, och screenar både den input du anger och de producerade bilderna. Detta hjälper till att hålla genererat innehåll inom säkra och lämpliga gränser, vilket är viktigt för professionellt och kommersiellt kreativt arbete.
När det gäller vilka som gynnas mest: illustratörer och konceptkonstnärer kan snabbt visualisera scener och karaktärer; grafiska designers kan generera bakgrunder, hero-bilder och stilistiska utforskningar; marknadsförare och sociala medie-skapare kan producera iögonfallande visuella element i exakt de bildförhållanden de behöver; och filmskapare och berättare kan bygga moodboards och förvisualiseringsramar. Det tvåspråkiga promptstödet utökar dess räckvidd till skapare som arbetar i engelskspråkiga och kinesiskspråkiga sammanhang lika gärna.
Några praktiska tips hjälper dig att få bästa resultat. Detaljerade, beskrivande prompts tenderar att producera mer trogna bilder, så det lönar sig att specificera belysning, stil och komposition. Att använda den negativa prompten för att utesluta vanliga brister kan märkbart höja kvaliteten på din utdata. Att generera flera bilder på en gång och jämföra dem är ett effektivt sätt att hitta den bästa tolkningen av din idé. Och att spara seeden från ett resultat du älskar låter dig återvända till eller förfina det senare. Sammantaget är Wan v2.6 Text to Image ett kapabelt, anpassningsbart verktyg för att förvandla skrivna idéer till polerade visuella element över ett brett spektrum av kreativt arbete.
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
Skriv en prompt som beskriver din önskade bild med detaljer om stil, ljussättning och komposition
Modellen förstår fysiken, ljussättningen och den känslomässiga avsikten i din scen
Klicka för att generera ditt slutresultat och ladda ner en bild av produktionskvalitet
Visar modellens förmåga att skapa cinematiska, vidvinklade visuella element med atmosfärisk belysning och trendig filmisk look – perfekt för berättande.

Illustrerar generering av livliga, aspirerande scener med flera personer med precisa kön och styling – idealiskt för modern livsstilsvarumärkesbyggande.

Visar hur modellen renderar arkitektonisk komplexitet, atmosfäriskt ljus och fotorealistiska detaljer – förstärker modern, aspirerande visuell berättelse.

“High-end studio product photography of premium wireless over-ear headphones in matte black finish. Dramatic three-point lighting with soft key light from upper left, rim light highlighting the ear cup contours, and subtle fill. Clean white seamless backdrop with soft gradient. Sharp focus on texture details of the leather headband and brushed metal accents. Professional advertising quality, 8K resolution, photorealistic rendering.”

Byt till resonemangsstyrd syntes idag

Detailed images with fine typography
4 krediter

High-fidelity text-to-image generation
0.1 krediter

Precise structured text-to-image generation
0.2 krediter

Unified image generation and editing
1.5 krediter

Flagship multilingual text-to-image generation
0.3 krediter
![V4.0q [fast]](https://v3b.fal.media/files/b/0aa0cdc0/4AWx22ZkcZYZBZ73YKkdT.jpg)
Fast text-accurate image generation
0.1 krediter

Fast, efficient image generation
6 krediter

Fast efficient image generation
6 krediter
![V4.0q [instant]](https://v3b.fal.media/files/b/0aa12d17/6liDSFFStjD4rStlm4CS1.jpg)
Fast text rendering image generation
0.1 krediter