Edit images with text prompts
Qwen Image 3 Image Editing är en prompt-driven fotoredigeringsmodell som förvandlar dina befintliga bilder baserat på instruktioner på vardagsspråk. Istället för att maskera, lägga lager eller pilla med urvalverktyg laddar du upp en referensbild och beskriver förändringen du vill ha med ord — modellen tolkar din avsikt och returnerar ett redigerat resultat. Byggd på Qwens etablerade styrkor inom komplex textåtergivning och exakt efterlevnad av prompts, är den utformad för skapare som vill göra riktade, trovärdiga redigeringar snabbt och beskriva dessa redigeringar på samma sätt som de skulle förklara dem för en annan person.
I grunden tar modellen en till tre referensbilder och en textprompt, och producerar sedan en ny bild som återspeglar dina önskade förändringar. En enkel instruktion som "Ändra vargarna till extremt realistiska små valpar i olika färger" räcker för att utlösa en detaljerad, sammanhängande transformation. Eftersom den accepterar flera referensbilder kan du blanda element eller styra en redigering med mer än en källa — och ordningen spelar roll, så du kan referera till dem explicit som 'image 1', 'image 2' och 'image 3' i din prompt för att styra exakt hur varje en används. Detta gör den väl lämpad för komposituppgifter, stilöverföringar mellan två bilder eller kombination av ett subjekt från en foto med en miljö från en annan.
Modellen producerar bilder i upplösningar upp till 2048×2048, och den kan automatiskt välja den idealiska upplösningen åt dig baserat på din prompt om du inte anger en. När du vill ha mer kontroll kan du välja bland standardförhållanden — kvadratiska, porträtt- och landskapsformat i både 4:3 och 16:9 — eller ange anpassade mått, så länge den totala pixeltalet håller sig inom det stödda intervallet. Klara bilder kan exporteras som PNG, JPEG eller WEBP, vilket ger flexibilitet beroende på om du behöver transparensfri skarp detalj, mindre filstorlekar eller webbvänliga format.
En av de framträdande egenskaperna från Qwen-linjen är stark textåtergivning. Där många redigeringsmodeller förvränger eller smetar ut bokstäver är denna modell byggd för att hantera typografi och komplex text pålitligare, vilket gör den till ett starkt val för redigeringar som involverar skyltar, etiketter, affischer, förpackningar eller sammansättningar där orden behöver förbli läsbara. Tillsammans med fokus på exakt efterlevnad av prompts tenderar den att följa instruktioner noga istället för att glida iväg till löst relaterade resultat — en betydande fördel när du har en specifik redigering i åtanke.
Modellen stöder prompts på både kinesiska och engelska, upp till 800 tecken, så du har gott om utrymme att beskriva nyanserade eller flerstegsredigeringar. Det finns också en automatisk funktion för omskrivning av prompts som är aktiverad som standard: den förfinar och utökar din instruktion i bakgrunden för att hjälpa till att producera bättre, mer sammanhängande resultat. Om du föredrar att behålla din exakta formulering kan du stänga av den. Ett alternativ för negativ prompt låter dig styra modellen bort från oönskade resultat — du kan lista egenskaper att undvika, som låg upplösning, förvrängning eller deformitet, för att rengöra dina resultat.
För skapare som behöver konsistens eller vill iterera erbjuder modellen en kontroll för reproducerbarhet: genom att återanvända samma seed-värde kan du återskapa ett jämförbart resultat, vilket är användbart när du har landat på ett utseende du gillar och vill göra små justeringar utan att börja om. Du kan också generera upp till fyra variationer samtidigt från en enda prompt, så att du kan jämföra alternativ sida vid sida och välja den starkaste redigeringen. Ett inbyggt innehållsmodereringalternativ kontrollerar både din inmatning och utmatning och är aktiverat som standard.
Vem gynnas mest? Fotografer och retuschörer kan göra riktade förändringar — byta subjekt, justera element eller omforma scener — utan manuell maskering. Designers som arbetar med marknadsföring, förpackningar eller sociala tillgångar kan lita på modellens textåtergivningspålitlighet för att redigera sammansättningar som innehåller ord. Konceptkonstnärer och illustratörer kan förvandla skisser eller referensfoton till stiliserade variationer. Innehållsskapare som producerar stora volymer visuellt material kan snabbt gå från idé till färdig redigering, generera flera tagningar och förfina med negativa prompts och seeds. Eftersom den accepterar upp till tre referensbilder är den också praktisk för alla som behöver slå samman eller kombinera visuella källor till ett sammanhängande resultat.
När det gäller bästa praxis bör referensbilder vara mellan 384 och 2048 pixlar på varje sida och inte större än 10MB, i JPEG, JPG, PNG (utan transparens) eller WEBP-format. När du använder flera referenser, namnge dem explicit i din prompt så modellen vet vilken källa den ska hämta från för varje del av redigeringen. Håll prompts klara och specifika: modellen belönar precisa instruktioner, och dess efterlevnad av din formulering är en av dess definierande egenskaper. Om ditt första resultat inte är helt rätt är justering av den negativa prompten, prova en annan seed eller generera flera variationer samtidigt snabba sätt att närma sig det resultat du vill ha.
Sammanfattningsvis förvandlar Qwen Image 3 Image Editing naturliga språkb beskrivningar till trovärdiga, högupplösta fotoredigeringar — med särskild styrka i att hålla text läsbar och följa dina instruktioner troget. Det är ett praktiskt, flexibelt verktyg för alla som hellre beskriver en förändring än målar in den manuellt.
Add the image that you want change
Lägg till bilden som du vill redigera eller omvandla
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
Beskriv de ändringar du vill ha – stiländringar, borttagning av objekt eller förbättringar
Ladda ner din professionellt redigerade bild
Byt till resonemangsstyrd syntes idag