High-quality text-to-image generation


Qwen Image 3 Text to Image menukar penerangan bertulis kepada imej siap, dengan kebolehan menonjol untuk merender teks dan tipografi yang boleh dibaca secara langsung di dalam adegan. Sama ada anda mahu papan tanda, kad, tajuk poster, atau label yang benar-benar boleh dibaca oleh penonton, model ini menganggap kata-kata sebagai elemen visual utama dan bukan huruf yang kabur dan rosak yang sering muncul dalam seni yang dihasilkan. Ini menjadikannya sesuai secara semula jadi untuk sesiapa sahaja yang memerlukan imej dan teks bekerjasama dalam satu komposisi.
Inti model ini membaca prompt anda dan membina imej dari awal. Anda huraikan apa yang anda mahu dalam bahasa seharian, dan ia menyusun subjek, latar, gaya, dan teks pada imej yang anda minta. Satu prompt boleh mengendalikan watak khusus, tindakan, persekitaran, dan mesej bertulis serentak — contohnya, anak koala comel memegang kad dengan slogan yang boleh dibaca sambil menunggang slaid air. Hasilnya adalah gambar yang koheren di mana teks duduk secara semula jadi dalam adegan bukannya terasa ditempel.
Salah satu kekuatan paling praktikal model ini adalah prompting dwibahasa. Ia memahami bahasa Inggeris dan Cina, jadi anda boleh tulis arahan dalam bahasa mana yang paling semula jadi, dan ia boleh render teks dalam mana-mana bahasa tersebut. Prompt boleh sehingga 800 aksara, yang memberi ruang yang mencukupi untuk huraikan butiran: komposisi, mood, palet warna, pencahayaan, sudut kamera, nota gaya, dan perkataan tepat yang anda mahu muncul dalam imej.
Model ini ditandakan untuk kerja bergaya, transformasi, dan tipografi, dan tag tersebut mencerminkan di mana ia cemerlang. Output bergaya membolehkan anda dorong ke arah rupa ilustrasi, grafik, atau reka bentuk depan bukannya hanya fotorealisme. Fokus tipografi bermakna teks tajuk, kad bertangan, label produk, dan salinan poster keluar dengan tahap kebolehbacaan yang membezakan model ini daripada alat teks-ke-imej yang bergelut dengan bentuk huruf. Gabungan ini menjadikannya sangat berguna untuk pereka yang berfikir dalam susun atur dan kata-kata, bukan hanya imej.
Anda mempunyai kawalan kukuh ke atas rupa akhir. Saiz imej fleksibel: anda boleh pilih preset mudah — nisbah segi empat sama, potret, dan landskap dalam proporsi standard dan skrin lebar — atau tetapkan lebar dan tinggi tersuai, selagi saiz keseluruhan kekal antara kira-kira 512×512 dan 2048×2048. Julat itu meliputi segalanya dari siaran sosial segi empat sama hingga skrin telefon potret dan banner landskap. Anda juga boleh pilih format output, memilih antara PNG untuk hasil tanpa kehilangan yang tajam, JPEG untuk fail lebih ringan, atau WebP untuk keseimbangan efisien sedia web.
Untuk mengelak hasil daripada perkara yang anda tidak mahu, ada pilihan prompt negatif di mana anda boleh senaraikan kualiti untuk dielak — contohnya, resolusi rendah, kecacatan, atau kualiti buruk umum — membantu membersihkan output dan mengurangkan artefak biasa. Ciri pengembangan prompt terbina boleh secara automatik menulis semula dan memperkayakan prompt anda di belakang tabir, mengisi penerangan longgar supaya anda dapat imej lebih terperinci dan polesan tanpa perlu tulis arahan rumit sendiri. Jika anda mahu kawalan penuh ke atas perkataan tepat anda, anda boleh matikan ini.
Untuk produktiviti, anda boleh hasilkan sehingga empat imej dari satu prompt serentak, memberi pelbagai pilihan untuk dibandingkan dan dipilih dalam satu laluan. Itu berguna bila anda meneroka arah untuk konsep, menguji penempatan tipografi, atau sekadar mahu pelbagai sebelum komited pada akhir. Kawalan seed membolehkan anda kunci ketepatan: gunakan semula seed sama dengan prompt sama untuk hasil konsisten, atau tukar untuk teroka variasi baru. Model juga laporkan seed yang digunakan, supaya anda boleh simpan dan lawati semula rupa yang anda suka.
Pemeriksa keselamatan sederhana kandungan digunakan pada apa yang anda hantar dan apa yang model hasilkan, membantu kekalkan penjanaan sesuai. Ini berjalan secara lalai untuk menyokong penggunaan bertanggungjawab.
Siapa paling untung? Pereka grafik dan pemasar yang memerlukan imej dengan salinan sebenar yang boleh dibaca akan jumpa pengendalian tipografi ini penjimatan masa sebenar — fikir kad promosi, grafik pengumuman, dan banner sosial di mana mesej mesti jadi sebahagian daripada gambar. Illustratori dan pencipta seni bergaya boleh sandar pada rupa reka bentuk depan model untuk seni editorial, konsep watak, dan adegan main-main. Pencipta kandungan membina thumbnail, siaran, dan visual kempen merentasi format segi empat sama, potret, dan landskap boleh hasilkan seni sedia format tanpa potongan tambahan. Pasukan dwibahasa bekerja merentasi khalayak Inggeris dan Cina dapat sokongan asli untuk kedua-dua bahasa dalam satu alat.
Beberapa perkara untuk diingat. Ini adalah model teks-ke-imej, jadi ia membina setiap gambar dari penerangan bertulis anda; jika anda perlukan kawalan tepat peringkat piksel ke atas foto sedia ada khusus, ingat kekuatan di sini adalah menjana imej baru dari kata-kata. Prompt dihad sehingga 800 aksara dan prompt negatif 500, jadi fokus pada butiran paling penting. Resolusi output maksimum sekitar 2048×2048 piksel, yang mencukupi untuk skrin dan kebanyakan kegunaan digital. Untuk teks paling tajam, bantu dengan nyatakan perkataan tepat yang anda mahu dalam petikan dalam prompt anda dan kekalkan salinan ringkas. Bila hasil tidak tepat, laraskan prompt negatif atau cuba seed baru sering kali pembetulan tercepat, dan hasilkan beberapa imej serentak membolehkan anda pilih komposisi dan tipografi terbaik.
Secara keseluruhan, Qwen Image 3 Text to Image adalah penjana serba boleh dibina untuk pencipta yang mahu imej dan kata-kata hidup bersama secara meyakinkan — pilihan kukuh untuk reka bentuk, pemasaran, dan seni bergaya di mana teks boleh dibaca adalah sebahagian daripada tugas.
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
Taip gesaan yang menerangkan imej yang anda inginkan dengan butiran gaya, pencahayaan dan komposisi
Model memahami fizik, pencahayaan dan niat emosi babak anda
Klik untuk menjana output akhir anda dan muat turun imej bertaraf produksi
Pamer render miniatur isometrik dengan papan tanda wow-anchor, format tilt-shift popular boleh dikongsi.


Beralih ke sintesis dipandu penaakulan hari ini

Design-first text to image generation
0.2 kredit

Precise structured text-to-image generation
0.2 kredit

Flagship multilingual text-to-image generation
0.3 kredit
![V4.0q [fast]](https://v3b.fal.media/files/b/0aa0cdc0/4AWx22ZkcZYZBZ73YKkdT.jpg)
Fast text-accurate image generation
0.1 kredit

Detailed images with fine typography
4 kredit
![V4.0q [instant]](https://v3b.fal.media/files/b/0aa12d17/6liDSFFStjD4rStlm4CS1.jpg)
Fast text rendering image generation
0.1 kredit

Flexible multilingual image generation model
0.3 kredit

Fast, efficient image generation
6 kredit

Fast high-quality text-to-image generation
0.3 kredit