ShortGenius
Et presentem Qwen Image 3 Text to Image

Qwen Image 3 Text to Image

Renders legible in-image text and typography from a plain prompt

High-quality text-to-image generation

Exemple 1
Exemple 1

Qwen Image 3 Text to Image converteix una descripció escrita en una imatge acabada, amb una habilitat excepcional per renderitzar text llegible i tipografia directament dins de l'escena. Tant si voleu un rètol, una targeta, un titular de pòster o una etiqueta que el espectador pugui llegir realment, aquest model tracta les paraules com a elements visuals de primera classe en lloc de la lletra borrosa i confusa que sovint apareix en l'art generat. Això el converteix en una opció natural per a qualsevol que necessiti que la imatge i el text treballin junts en una sola composició.

Al seu nucli, el model llegeix el vostre prompt i construeix una imatge des de zero. Descriviu el que voleu en llenguatge quotidià, i compon el subjecte, l'entorn, l'estil i qualsevol text sobre la imatge que sol·liciteu. Un únic prompt pot gestionar un personatge específic, una acció, un ambient i un missatge escrit alhora —per exemple, un koala nadó maco aguantant una targeta amb un lema llegible mentre baixa per un tobogà d'aigua. El resultat és una imatge coherent on el text s'integra naturalment en l'escena en lloc de semblar enganxat.

Una de les fortaleses més pràctiques del model és el prompting bilingüe. Entén l'anglès i el xinès, així que podeu escriure les instruccions en la llengua que us sembli més natural, i pot renderitzar text en qualsevol de les dues. Els prompts poden arribar fins a 800 caràcters, cosa que us dóna molt d'espai per detallar: composició, ambient, paleta de colors, il·luminació, angle de càmera, notes d'estil i les paraules exactes que voleu que apareguin a la imatge.

El model està etiquetat per a treballs estilitzats, transformació i tipografia, i aquestes etiquetes reflecteixen on brilla. Les sortides estilitzades us permeten inclinar-vos cap a aspectes il·lustrats, gràfics o de disseny en lloc de només fotorealisme. L'enfocament en tipografia significa que els titulars, les targetes manuscrites, les etiquetes de productes i el text de pòsters surten amb un grau de llegibilitat que diferencia aquest model d'eines de text-a-imatge que tenen problemes amb les formes de les lletres. Aquesta combinació el fa especialment útil per a dissenyadors que pensen en termes de disposicions i paraules, no només d'imatges.

Teniu un bon control sobre l'aspecte final. La mida de la imatge és flexible: podeu triar entre presets còmodes —proporcions quadrades, verticals i horitzontals tant en estàndard com en gran pantalla— o establir un ample i alt personalitzats, sempre que la mida total es mantingui entre aproximadament 512×512 i 2048×2048. Aquest rang cobreix des de publicacions quadrades a xarxes fins a pantalles verticals de mòbil i bàners horitzontals. També podeu triar el format de sortida: PNG per a resultats nítids sense pèrdua, JPEG per a fitxers més lleugers o WebP per a un equilibri eficient preparat per a web.

Per dirigir els resultats allunyant-vos del que no voleu, hi ha l'opció de prompt negatiu on podeu llistar qualitats a evitar —com ara baixa resolució, deformitats o qualitat generalment dolenta— ajudant a netejar les sortides i reduir artefactes comuns. Una funció d'expansió de prompt integrada pot reescriure i enriquir automàticament el vostre prompt en segon pla, desenvolupant descripcions escasses per obtenir imatges més detallades i polides sense haver d'escriure instruccions elaborades vosaltres mateixos. Si preferiu control total sobre les paraules exactes, podeu desactivar-la.

Per a la productivitat, podeu generar fins a quatre imatges d'un únic prompt alhora, donant-vos una varietat d'opcions per comparar i triar en un sol pas. Això és pràctic quan exploreu direccions per a un concepte, proveu posicionaments de tipografia o simplement voleu varietat abans de comprometre-vos amb un final. Un control de seed us permet bloquejar la reproductibilitat: reutilitzeu el mateix seed amb el mateix prompt per obtenir resultats consistents, o canvieu'l per explorar variacions noves. El model també informa del seed utilitzat, així que podeu desar-lo i revisitar un aspecte que us agradi.

S'aplica un verificador de moderació de contingut tant al que envieu com al que produeix el model, ajudant a mantenir les generacions adequades. Això s'executa per defecte per donar suport a un ús responsable.

Qui en beneficia més? Els dissenyadors gràfics i marketers que necessiten imatges amb text real i llegible trobaran que la gestió de tipografia és un estalvi de temps genuí —penseu en targetes promocionals, gràfics d'anuncis i bàners socials on el missatge ha de ser part de la imatge. Il·lustradors i creadors d'art estilitzat poden aprofitar l'aspecte de disseny del model per a art editorial, conceptes de personatges i escenes divertides. Creadors de contingut que construeixen miniatures, publicacions i visuals de campanyes en formats quadrats, verticals i horitzontals poden produir art preparat per al format sense retallades extra. Equips bilingües que treballen per a audiències angleses i xineses obtenen suport natiu per a ambdues llengües en una sola eina.

Algunes coses a tenir en compte. És un model de text-a-imatge, així que construeix cada imatge a partir de la vostra descripció escrita; si necessiteu control precís a nivell de píxels sobre una foto existent específica, recordeu que la força aquí és generar imatges noves a partir de paraules. Els prompts estan limitats a 800 caràcters i els negatius a 500, així que centreu-vos en els detalls més importants. La resolució de sortida arriba fins a uns 2048×2048 píxels, ample per a pantalles i la majoria d'usos digitals. Per al text més nítid, ajuda indicar les paraules exactes entre cometes dins del prompt i mantenir el text concís. Quan els resultats no són del tot correctes, ajustar el prompt negatiu o provar un seed nou sovint és la solució més ràpida, i generar diverses imatges alhora us permet triar la millor composició i tipografia.

En resum, Qwen Image 3 Text to Image és un generador versàtil fet per a creadors que volen que les imatges i les paraules convisquin de manera convincent —una elecció sòlida per a disseny, màrqueting i art estilitzat on el text llegible forma part del briefing.

Genera amb el model d'imatge més avançat

A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.

Pas 1

Escriu el teu guió

Escriu una indicació que descrigui la imatge que vols amb detalls d'estil, il·luminació i composició

Pas 2

La IA genera

El model entén la física, la il·luminació i la intenció emocional de la teva escena

Pas 3

Comença a compartir

Fes clic per generar el resultat final i descarregar una imatge de qualitat professional

Més enllà de la indicació: un nou nivell de control

DIORAMA TILT-SHIFT

DIORAMA TILT-SHIFT

Mostra renderitzat isomètric en miniatura amb rètol d'àncora wow, un format tilt-shift compartible popular.

DIORAMA TILT-SHIFT
Exemple destacat 1
L'espera per fi s'ha acabat

Viu la perfecció amb Qwen Image 3 Text to Image

Passa't avui a la síntesi guiada per raonament

Preguntes freqüents

El renderitzat de text és una de les seves fortaleses principals —està especialment dissenyat per a tipografia, així que rètols, targetes, etiquetes i titulars de pòsters surten llegibles en lloc de confosos. Per als millors resultats, poseu les paraules exactes entre cometes dins del prompt i manteniu el text concís.