ShortGenius
Apresentamos o Qwen Image 3 Text to Image

Qwen Image 3 Text to Image

Renders legible in-image text and typography from a plain prompt

High-quality text-to-image generation

Exemplo 1
Exemplo 1

O Qwen Image 3 Text to Image transforma uma descrição escrita numa imagem finalizada, com uma capacidade excecional para renderizar texto legível e tipografia diretamente dentro da cena. Quer pretenda um sinal, um cartão, uma manchete de cartaz ou um rótulo que o espectador consiga realmente ler, este modelo trata as palavras como elementos visuais de primeira classe em vez da caligrafia borrada e distorcida que aparece tão frequentemente na arte gerada. Isso torna-o uma escolha natural para qualquer pessoa que precise de imagem e texto a trabalharem juntos numa única composição.

No seu núcleo, o modelo lê o seu prompt e constrói uma imagem do zero. Descreve o que quer em linguagem quotidiana e ele compõe o sujeito, o cenário, o estilo e qualquer texto na imagem que solicite. Um único prompt pode gerir um personagem específico, uma ação, um ambiente e uma mensagem escrita ao mesmo tempo — por exemplo, um bebé coala adorável a segurar um cartão com um slogan legível enquanto desliza num escorrega de água. O resultado é uma imagem coerente onde o texto se integra naturalmente na cena em vez de parecer colado.

Uma das forças mais práticas do modelo é o prompting bilingue. Ele entende inglês e chinês, pelo que pode escrever as instruções na língua que lhe parecer mais natural, e ele pode renderizar texto em qualquer uma delas. Os prompts podem ter até 800 carateres, o que dá espaço amplo para detalhar: composição, humor, paleta de cores, iluminação, ângulo de câmara, notas de estilo e as palavras exatas que quer que apareçam na imagem.

O modelo está etiquetado para trabalhos estilizados, transformação e tipografia, e essas etiquetas refletem onde ele brilha. As saídas estilizadas permitem avançar para aparências ilustradas, gráficas ou viradas para o design em vez de apenas fotorealismo. O foco na tipografia significa que texto de manchete, cartões caligrafados à mão, rótulos de produtos e cópias de cartazes saem com um grau de legibilidade que distingue este modelo de ferramentas text-to-image que têm dificuldades com formas de letras. Esta combinação torna-o especialmente útil para designers que pensam em layouts e palavras, não só em imagens.

Tem controlo sólido sobre o aspeto final. O tamanho da imagem é flexível: pode escolher predefinições convenientes — rácios quadrado, retrato e paisagem tanto em proporções standard como widescreen — ou definir largura e altura personalizadas, desde que o tamanho total se mantenha entre cerca de 512×512 e 2048×2048. Essa gama cobre tudo, desde publicações quadradas em redes sociais a ecrãs de telemóvel em retrato e banners em paisagem. Pode também escolher o formato de saída, optando por PNG para resultados nítidos sem perdas, JPEG para ficheiros mais leves ou WebP para um equilíbrio eficiente pronto para a web.

Para evitar elementos indesejados, há uma opção de negative prompt onde pode listar qualidades a evitar — por exemplo, baixa resolução, deformidades ou qualidade geralmente pobre — ajudando a limpar as saídas e reduzir artefactos comuns. Uma funcionalidade integrada de expansão de prompt pode reescrever e enriquecer automaticamente o seu prompt nos bastidores, desenvolvendo descrições escassas para obter imagens mais detalhadas e polidas sem ter de escrever instruções elaboradas. Se preferir controlo total sobre as palavras exatas, pode desativá-la.

Para produtividade, pode gerar até quatro imagens a partir de um único prompt de uma vez, dando-lhe uma variedade de opções para comparar e escolher numa única passada. Isso é útil quando explora direções para um conceito, testa posicionamentos de tipografia ou simplesmente quer variedade antes de se comprometer com um final. Um controlo de seed permite fixar a reprodutibilidade: reutilize o mesmo seed com o mesmo prompt para obter resultados consistentes, ou mude-o para explorar variações novas. O modelo também reporta o seed utilizado, pelo que pode guardá-lo e revisitar um aspeto que gostou.

Um verificador de segurança de moderação de conteúdo é aplicado tanto ao que submete como ao que o modelo produz, ajudando a manter as gerações apropriadas. Isto executa por defeito para apoiar o uso responsável.

Quem beneficia mais? Designers gráficos e marketeers que precisam de imagens com cópias reais e legíveis vão encontrar no manuseamento de tipografia um verdadeiro poupador de tempo — pense em cartões promocionais, gráficos de anúncios e banners sociais onde a mensagem tem de fazer parte da imagem. Ilustradores e criadores de arte estilizada podem apostar nos aspetos virados para o design do modelo para arte editorial, conceitos de personagens e cenas lúdicas. Criadores de conteúdo que constroem thumbnails, publicações e visuais de campanhas em formatos quadrado, retrato e paisagem podem produzir arte pronta para o formato sem cortes extra. Equipas bilingues que trabalham com audiências em inglês e chinês obtêm suporte nativo para ambas as línguas numa única ferramenta.

Algumas coisas a ter em mente. Trata-se de um modelo text-to-image, pelo que constrói cada imagem a partir da sua descrição escrita; se precisar de controlo preciso ao nível de píxeis sobre uma foto existente específica, recorde que a força aqui está em gerar imagens novas a partir de palavras. Os prompts estão limitados a 800 carateres e os negative prompts a 500, pelo que foque-se nos detalhes mais importantes. A resolução de saída atinge o máximo em torno de 2048×2048 píxeis, o que é amplo para ecrãs e a maioria dos usos digitais. Para texto mais nítido, ajuda declarar as palavras exatas que quer entre aspas no seu prompt e manter a cópia concisa. Quando os resultados não estão bastante certos, ajustar o negative prompt ou experimentar um novo seed é frequentemente a correção mais rápida, e gerar várias imagens de uma vez permite selecionar a melhor composição e tipografia.

No geral, o Qwen Image 3 Text to Image é um gerador versátil construído para criadores que querem que imagens e palavras vivam juntas de forma convincente — uma escolha forte para design, marketing e arte estilizada onde texto legível faz parte do briefing.

Gere com o modelo de imagem mais avançado

A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.

Passo 1

Escreva o seu cenário

Escreva um prompt que descreva a imagem pretendida com detalhes de estilo, iluminação e composição

Passo 2

A IA gera

O modelo compreende a física, a iluminação e a intenção emocional da sua cena

Passo 3

Comece a partilhar

Clique para gerar o resultado final e transferir uma imagem de qualidade profissional

Para além do prompt: um novo nível de controlo

DIORAMA TILT-SHIFT

DIORAMA TILT-SHIFT

Mostra renderização miniatura isométrica com um cartaz âncora-wow, um formato tilt-shift partilhável popular.

DIORAMA TILT-SHIFT
Exemplo em destaque 1
A espera finalmente terminou

Experimente a perfeição com o Qwen Image 3 Text to Image

Mude hoje para a síntese guiada por raciocínio

Perguntas frequentes

A renderização de texto é uma das suas forças definidoras — está especificamente orientado para tipografia, pelo que sinais, cartões, rótulos e manchetes de cartazes saem legíveis em vez de distorcidos. Para melhores resultados, coloque as palavras exatas que quer entre aspas dentro do seu prompt e mantenha a cópia concisa.