Edit images with text prompts
Qwen Image 3 Image Editing là một mô hình chỉnh sửa ảnh theo lời nhắc, biến đổi hình ảnh hiện có của bạn dựa trên các hướng dẫn ngôn ngữ tự nhiên. Thay vì sử dụng mặt nạ, lớp chồng hoặc loay hoay với công cụ chọn vùng, bạn tải lên hình ảnh tham chiếu và mô tả thay đổi mong muốn bằng lời — mô hình diễn giải ý định của bạn và trả về kết quả đã chỉnh sửa. Được xây dựng trên nền tảng thế mạnh đã được khẳng định của Qwen trong việc render văn bản phức tạp và tuân thủ lời nhắc chính xác, nó được thiết kế dành cho các nhà sáng tạo muốn thực hiện chỉnh sửa nhắm mục tiêu, chân thực một cách nhanh chóng và mô tả những chỉnh sửa đó theo cách họ giải thích cho người khác.
Về cơ bản, mô hình nhận từ một đến ba hình ảnh tham chiếu và một lời nhắc văn bản, sau đó tạo ra hình ảnh mới phản ánh các thay đổi bạn yêu cầu. Một hướng dẫn đơn giản như "Thay những con sói thành những chú cún con nhỏ cực kỳ chân thực với màu sắc khác nhau" là đủ để kích hoạt sự biến đổi chi tiết, mạch lạc. Vì nó chấp nhận nhiều hình ảnh tham chiếu, bạn có thể pha trộn các yếu tố hoặc hướng dẫn chỉnh sửa bằng hơn một nguồn — và thứ tự quan trọng, nên bạn có thể đề cập đến chúng rõ ràng là 'image 1', 'image 2' và 'image 3' trong lời nhắc để kiểm soát chính xác cách sử dụng từng hình. Điều này làm cho nó rất phù hợp với các nhiệm vụ ghép ảnh, chuyển kiểu giữa hai hình ảnh, hoặc kết hợp chủ thể từ một ảnh với bối cảnh từ ảnh khác.
Mô hình xuất hình ảnh ở độ phân giải lên đến 2048×2048, và nó có thể tự động quyết định độ phân giải lý tưởng dựa trên lời nhắc của bạn nếu bạn không chỉ định. Khi muốn kiểm soát nhiều hơn, bạn có thể chọn từ các tỷ lệ khung hình chuẩn — vuông, dọc và ngang ở cả 4:3 và 16:9 — hoặc đặt kích thước tùy chỉnh, miễn là tổng số pixel nằm trong phạm vi hỗ trợ. Hình ảnh hoàn chỉnh có thể xuất dưới dạng PNG, JPEG hoặc WEBP, mang lại sự linh hoạt tùy thuộc vào việc bạn cần chi tiết sắc nét không trong suốt, kích thước tệp nhỏ hơn hay định dạng thân thiện với web.
Một trong những đặc điểm nổi bật được kế thừa từ dòng Qwen là khả năng render văn bản mạnh mẽ. Trong khi nhiều mô hình chỉnh sửa làm méo mó hoặc nhòe chữ cái, mô hình này được xây dựng để xử lý kiểu chữ và văn bản phức tạp đáng tin cậy hơn, làm cho nó trở thành lựa chọn mạnh mẽ cho các chỉnh sửa liên quan đến biển báo, nhãn, áp phích, bao bì hoặc bất kỳ bố cục nào cần chữ dễ đọc. Kết hợp với trọng tâm tuân thủ lời nhắc chính xác, nó có xu hướng theo sát hướng dẫn thay vì lệch sang kết quả liên quan lỏng lẻo — một lợi thế lớn khi bạn có chỉnh sửa cụ thể trong đầu.
Mô hình hỗ trợ lời nhắc bằng tiếng Trung và tiếng Anh, lên đến 800 ký tự, nên bạn có đủ không gian để mô tả chỉnh sửa tinh tế hoặc nhiều bước. Cũng có tính năng tự động viết lại lời nhắc được bật mặc định: nó lặng lẽ tinh chỉnh và mở rộng hướng dẫn của bạn phía sau hậu trường để giúp tạo kết quả tốt hơn, mạch lạc hơn. Nếu bạn muốn giữ nguyên từ ngữ chính xác, bạn có thể tắt nó. Tùy chọn lời nhắc phủ định cho phép bạn hướng mô hình tránh kết quả không mong muốn — bạn có thể liệt kê các đặc tính cần tránh, chẳng hạn như độ phân giải thấp, méo mó hoặc biến dạng, để làm sạch kết quả.
Dành cho các nhà sáng tạo cần tính nhất quán hoặc muốn lặp lại, mô hình cung cấp kiểm soát khả năng tái tạo: bằng cách sử dụng lại cùng giá trị seed, bạn có thể tạo lại kết quả tương đương, hữu ích khi bạn đã tìm được phong cách ưng ý và muốn chỉnh sửa nhỏ mà không phải bắt đầu lại. Bạn cũng có thể tạo đến bốn biến thể cùng lúc từ một lời nhắc, giúp so sánh các lựa chọn cạnh nhau và chọn chỉnh sửa mạnh nhất. Tùy chọn kiểm duyệt nội dung tích hợp kiểm tra cả đầu vào và đầu ra, được bật mặc định.
Ai hưởng lợi nhiều nhất? Nhiếp ảnh gia và người chỉnh sửa ảnh có thể thực hiện thay đổi nhắm mục tiêu — hoán đổi chủ thể, điều chỉnh yếu tố hoặc tái tưởng tượng cảnh — mà không cần mặt nạ thủ công. Nhà thiết kế làm việc với tiếp thị, bao bì hoặc tài sản mạng xã hội có thể dựa vào độ tin cậy render văn bản của mô hình để chỉnh sửa bố cục chứa chữ. Nghệ sĩ khái niệm và họa sĩ minh họa có thể biến bản phác thảo hoặc ảnh tham chiếu thành biến thể cách điệu. Nhà sáng tạo nội dung sản xuất lượng lớn hình ảnh có thể nhanh chóng từ ý tưởng đến chỉnh sửa hoàn chỉnh, tạo nhiều phiên bản và tinh chỉnh bằng lời nhắc phủ định và seed. Vì chấp nhận đến ba hình ảnh tham chiếu, nó cũng tiện lợi cho bất kỳ ai cần hợp nhất hoặc kết hợp nguồn hình ảnh thành một kết quả mạch lạc.
Về thực hành tốt nhất, hình ảnh tham chiếu nên có kích thước từ 384 đến 2048 pixel mỗi cạnh và không lớn hơn 10MB, ở định dạng JPEG, JPG, PNG (không trong suốt) hoặc WEBP. Khi sử dụng nhiều tham chiếu, hãy đặt tên rõ ràng cho chúng trong lời nhắc để mô hình biết nguồn nào dùng cho từng phần chỉnh sửa. Giữ lời nhắc rõ ràng và cụ thể: mô hình thưởng cho hướng dẫn chính xác, và sự tuân thủ từ ngữ của bạn là một trong những đặc chất định hình của nó. Nếu kết quả đầu tiên chưa đúng, điều chỉnh lời nhắc phủ định, thử seed khác hoặc tạo nhiều biến thể cùng lúc đều là cách nhanh để tiếp cận kết quả mong muốn.
Tóm lại, Qwen Image 3 Image Editing biến mô tả ngôn ngữ tự nhiên thành chỉnh sửa ảnh chân thực, độ phân giải cao — với sức mạnh đặc biệt trong việc giữ văn bản dễ đọc và tuân thủ hướng dẫn của bạn một cách trung thành. Đây là công cụ thực tế, linh hoạt cho bất kỳ ai thà mô tả thay đổi còn hơn tự tay vẽ.
Add the image that you want change
Thêm hình ảnh bạn muốn chỉnh sửa hoặc biến đổi
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
Mô tả các chỉnh sửa bạn muốn - thay đổi phong cách, xóa đối tượng hoặc nâng cao chất lượng
Tải về hình ảnh đã chỉnh sửa chuyên nghiệp của bạn
Chuyển sang tạo nội dung dẫn dắt bằng suy luận ngay hôm nay