High-quality text-to-image generation


Qwen Image 3 Text to Image จะแปลงคำอธิบายที่เขียนไว้ให้เป็นภาพสำเร็จรูป โดยมีความสามารถโดดเด่นในการเรนเดอร์ข้อความและตัวพิมพ์ที่อ่านได้โดยตรงภายในฉาก ไม่ว่าคุณจะต้องการป้าย การ์ด หัวข้อโปสเตอร์ หรือฉลากที่ผู้ชมสามารถอ่านได้จริง โมเดลนี้ปฏิบัติต่อคำว่าเป็นองค์ประกอบภาพหลัก ไม่ใช่ตัวอักษรเลอะเทอะเบลอที่มักปรากฏในงานศิลปะที่สร้างขึ้น ทำให้เหมาะอย่างยิ่งสำหรับผู้ที่ต้องการให้ภาพและข้อความทำงานร่วมกันในองค์ประกอบเดียว
ในแกนหลัก โมเดลจะอ่านพรอมต์ของคุณและสร้างภาพจากศูนย์ คุณอธิบายสิ่งที่ต้องการด้วยภาษาทั่วไป และมันจะประกอบด้วยตัวละคร สถานที่ สไตล์ และข้อความบนภาพที่คุณร้องขอ พรอมต์เดียวสามารถจัดการตัวละครเฉพาะ การกระทำ สภาพแวดล้อม และข้อความที่เขียนได้ทั้งหมดพร้อมกัน — เช่น ลูกจิงโจ้ตัวน้อยน่ารักกำลังถือการ์ดที่มีสโลแกนอ่านได้ชัดเจนขณะเล่นสไลเดอร์น้ำ ผลลัพธ์คือภาพที่สอดคล้องกันซึ่งข้อความนั่งอยู่อย่างเป็นธรรมชาติภายในฉากแทนที่จะรู้สึกเหมือนติดแปะ
จุดแข็งที่ใช้งานได้จริงที่สุดอย่างหนึ่งคือการรองรับพรอมต์สองภาษา มันเข้าใจทั้งภาษาอังกฤษและภาษาจีน ดังนั้นคุณสามารถเขียนคำสั่งในภาษาที่รู้สึกเป็นธรรมชาติที่สุด และมันสามารถเรนเดอร์ข้อความในภาษาใดก็ได้ พรอมต์สามารถมีความยาวสูงสุด 800 ตัวอักษร ซึ่งให้พื้นที่เพียงพอในการระบุรายละเอียด: องค์ประกอบ อารมณ์ พาเลตต์สี แสง มุมกล้อง โน้ตสไตล์ และข้อความที่ต้องการให้ปรากฏในภาพอย่างแน่นอน
โมเดลถูกแท็กสำหรับงานสไตล์ การแปลง และตัวพิมพ์ ซึ่งสะท้อนจุดที่มันโดดเด่น ผลลัพธ์สไตล์ช่วยให้คุณผลักดันไปสู่ลุคภาพประกอบ กราฟิก หรือออกแบบนำหน้า แทนที่จะเป็นเพียงโฟโต้รีลลิซึม การเน้นตัวพิมพ์หมายถึงหัวข้อตัวอักษร การ์ดเขียนมือ ฉลากผลิตภัณฑ์ และสำเนาโปสเตอร์ ซึ่งทั้งหมดออกมาด้วยความชัดเจนที่ทำให้โมเดลนี้แตกต่างจากเครื่องมือ text-to-image ที่มีปัญหากับตัวอักษร การผสมผสานนี้ทำให้มีประโยชน์เป็นพิเศษสำหรับนักออกแบบที่คิดในแง่布局และคำ ไม่ใช่แค่ภาพ
คุณมีควบคุมที่มั่นคงเหนือลุคสุดท้าย ขนาดภาพยืดหยุ่น: คุณสามารถเลือกจากพรีเซ็ตที่สะดวก — สี่เหลี่ยม สูงยาว และกว้างยาวในสัดส่วนมาตรฐานและวิดีโอ — หรือตั้งความกว้างและความสูงแบบกำหนดเอง ตราบใดที่ขนาดรวมอยู่ระหว่างประมาณ 512×512 ถึง 2048×2048 ขนาดนั้นครอบคลุมทุกอย่างตั้งแต่โพสต์โซเชียลสี่เหลี่ยม หน้าจอโทรศัพท์สูงยาว และแบนเนอร์กว้างยาว คุณยังสามารถเลือกฟอร์แมตเอาต์พุตได้ ระหว่าง PNG สำหรับผลลัพธ์ที่คมชัดไร้การสูญเสีย JPEG สำหรับไฟล์เบา หรือ WebP สำหรับสมดุลที่เหมาะสำหรับเว็บ
เพื่อนำผลลัพธ์ให้ห่างจากสิ่งที่คุณไม่ต้องการ มีตัวเลือก negative prompt ที่คุณสามารถระบุคุณสมบัติที่ต้องการหลีกเลี่ยง — เช่น ความละเอียดต่ำ ความผิดรูป หรือคุณภาพต่ำโดยรวม — ช่วยให้ทำความสะอาดเอาต์พุตและลดสิ่งประดิษฐ์ทั่วไป ฟีเจอร์ขยายพรอมต์ในตัวสามารถรีไรท์และเสริมพรอมต์ของคุณโดยอัตโนมัติเบื้องหลัง ทำให้คำอธิบายที่บางเบากลายเป็นภาพที่ละเอียดและขัดเกลามากขึ้นโดยไม่ต้องเขียนคำสั่งซับซ้อนเอง หากคุณชอบควบคุมคำพูดที่แน่นอน สามารถปิดได้
เพื่อประสิทธิภาพ คุณสามารถสร้างภาพได้สูงสุดสี่ภาพจากพรอมต์เดียวในคราวเดียว ให้ตัวเลือกที่หลากหลายเพื่อเปรียบเทียบและเลือกในรอบเดียว นั่นมีประโยชน์เมื่อคุณสำรวจทิศทางสำหรับแนวคิด ทดสอบตำแหน่งตัวพิมพ์ หรือเพียงต้องการความหลากหลายก่อนตัดสินใจสุดท้าย ตัวควบคุม seed ช่วยให้ล็อคการทำซ้ำได้: ใช้ seed เดียวกันกับพรอมต์เดียวกันเพื่อผลลัพธ์ที่สอดคล้อง หรือเปลี่ยนเพื่อสำรวจการเปลี่ยนแปลงใหม่ โมเดลยังรายงาน seed ที่ใช้กลับมา ดังนั้นคุณสามารถบันทึกและกลับไปยังลุคที่ชอบ
เครื่องตรวจสอบความปลอดภัยเนื้อหาจะถูกนำไปใช้ทั้งกับสิ่งที่คุณส่งและสิ่งที่โมเดลผลิต ช่วยให้การสร้างเหมาะสม นี่คือค่าเริ่มต้นเพื่อสนับสนุนการใช้งานอย่างรับผิดชอบ
ใครได้ประโยชน์มากที่สุด? นักออกแบบกราฟิกและนักการตลาดที่ต้องการภาพพร้อมสำเนาที่อ่านได้จริงจะพบว่าการจัดการตัวพิมพ์ช่วยประหยัดเวลา — คิดถึงการ์ดโปรโมท กราฟิกประกาศ และแบนเนอร์โซเชียลที่ข้อความต้องเป็นส่วนหนึ่งของภาพ นักวาดภาพประกอบและผู้สร้างงานศิลปะสไตล์สามารถพึ่งพาลุคออกแบบนำหน้าของโมเดลสำหรับงานศิลปะบรรณาธิการ แนวคิดตัวละคร และฉากสนุกสนาน ผู้สร้างเนื้อหาที่สร้าง thumbnails โพสต์ และภาพแคมเปญในฟอร์แมตสี่เหลี่ยม สูงยาว และกว้างยาว สามารถผลิตงานศิลปะพร้อมฟอร์แมตโดยไม่ต้องครอปเพิ่ม ทีมสองภาษาที่ทำงานข้ามผู้ชมภาษาอังกฤษและภาษาจีน ได้รับการสนับสนุนทั้งสองภาษาในเครื่องมือเดียว
มีบางสิ่งที่ควรจำไว้ นี่คือโมเดล text-to-image ดังนั้นมันสร้างภาพทุกภาพจากคำอธิบายที่เขียน; หากคุณต้องการควบคุมระดับพิกเซลที่แม่นยำเหนือภาพที่มีอยู่เฉพาะจำไว้ว่า จุดแข็งคือการสร้างภาพใหม่จากคำ พรอมต์จำกัดที่ 800 ตัวอักษรและ negative prompt ที่ 500 ดังนั้นโฟกัสที่รายละเอียดที่สำคัญที่สุด ความละเอียดเอาต์พุตสูงสุดประมาณ 2048×2048 พิกเซล ซึ่งเพียงพอสำหรับหน้าจอและการใช้งานดิจิทัลส่วนใหญ่ เพื่อตัวอักษรที่คมชัดที่สุด ช่วยให้ระบุคำที่ต้องการในเครื่องหมายคำพูดภายในพรอมต์และให้สำเนาย่อ หากผลลัพธ์ไม่ถูกต้อง การปรับ negative prompt หรือลอง seed ใหม่มักเป็นการแก้ไขที่รวดเร็วที่สุด และการสร้างภาพหลายภาพพร้อมกันช่วยให้คุณเลือกองค์ประกอบและตัวพิมพ์ที่ดีที่สุด
โดยรวม Qwen Image 3 Text to Image คือเครื่องกำเนิดที่หลากหลาย สร้างสำหรับผู้สร้างที่ต้องการให้ภาพและคำอยู่ร่วมกันอย่างน่าเชื่อถือ — ลูกค้าที่แข็งแกร่งสำหรับการออกแบบ การตลาด และงานศิลปะสไตล์ที่ตัวอักษรอ่านได้เป็นส่วนหนึ่งของโจทย์
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
พิมพ์พรอมต์เพื่ออธิบายภาพที่คุณต้องการ พร้อมรายละเอียดสไตล์ แสง และองค์ประกอบภาพ
โมเดลเข้าใจฟิสิกส์ แสง และอารมณ์ที่ต้องการสื่อในฉากของคุณ
คลิกเพื่อสร้างผลลัพธ์สุดท้ายและดาวน์โหลดภาพระดับมืออาชีพ
แสดงการเรนเดอร์มินิเอเจอร์ไอโซเมตริกพร้อมป้ายโชว์จุดเด่น ฟอร์แมตทิลต์ชิฟต์ที่แชร์ยอดนิยม


เปลี่ยนมาใช้การสร้างที่ขับเคลื่อนด้วยการให้เหตุผลได้แล้ววันนี้

Flexible multilingual image generation model
0.3 เครดิต

Precise structured text-to-image generation
0.2 เครดิต

Fast efficient image generation
6 เครดิต

Fast high-quality text-to-image generation
0.3 เครดิต

Detailed images with fine typography
4 เครดิต
![V4.0q [fast]](https://v3b.fal.media/files/b/0aa0cdc0/4AWx22ZkcZYZBZ73YKkdT.jpg)
Fast text-accurate image generation
0.1 เครดิต

Fast, efficient image generation
6 เครดิต

Flagship multilingual text-to-image generation
0.3 เครดิต

High-quality text-to-image with accurate text
1.3 เครดิต