ShortGenius
Apresentamos o Qwen Image 3 Text to Image

Qwen Image 3 Text to Image

Renders legible in-image text and typography from a plain prompt

High-quality text-to-image generation

Exemplo 1
Exemplo 1

Qwen Image 3 Text to Image transforma uma descrição escrita em uma imagem finalizada, com uma habilidade excepcional para renderizar texto legível e tipografia diretamente dentro da cena. Seja um letreiro, um cartão, uma manchete de pôster ou um rótulo que o espectador possa realmente ler, este modelo trata as palavras como elementos visuais de primeira classe, em vez da caligrafia borrada e distorcida que frequentemente aparece em artes geradas. Isso o torna ideal para qualquer um que precise de imagem e texto trabalhando juntos em uma única composição.

No fundo, o modelo lê seu prompt e constrói uma imagem do zero. Você descreve o que quer em linguagem cotidiana, e ele compõe o sujeito, o cenário, o estilo e qualquer texto na imagem que você solicitar. Um único prompt pode lidar com um personagem específico, uma ação, um ambiente e uma mensagem escrita ao mesmo tempo — por exemplo, um filhote de coala fofo segurando um cartão com um slogan legível enquanto desliza em um escorregador aquático. O resultado é uma imagem coerente onde o texto se integra naturalmente à cena, em vez de parecer colado.

Uma das forças mais práticas do modelo é o suporte a prompts bilíngues. Ele entende inglês e chinês, então você pode escrever suas instruções na linguagem que parecer mais natural, e ele pode renderizar texto em qualquer uma delas. Prompts podem ter até 800 caracteres, o que dá espaço amplo para detalhar: composição, humor, paleta de cores, iluminação, ângulo de câmera, notas de estilo e o texto exato que você quer na imagem.

O modelo é marcado para trabalhos estilizados, transformações e tipografia, e essas marcas refletem onde ele brilha. Saídas estilizadas permitem explorar visuais ilustrados, gráficos ou voltados para design, além do fotorealismo puro. O foco em tipografia significa que textos de manchetes, cartões caligrafados à mão, rótulos de produtos e cópias de pôsteres saem com um grau de legibilidade que diferencia este modelo de ferramentas de texto-para-imagem que lutam com formas de letras. Essa combinação o torna especialmente útil para designers que pensam em layouts e palavras, não só em imagens.

Você tem controle sólido sobre o visual final. O tamanho da imagem é flexível: você pode escolher predefinições práticas — proporções quadradas, retrato e paisagem em tamanhos padrão e widescreen — ou definir largura e altura personalizadas, desde que o tamanho total fique entre cerca de 512×512 e 2048×2048. Essa faixa cobre desde posts quadrados em redes sociais até telas de celular em retrato e banners em paisagem. Você também pode escolher o formato de saída: PNG para resultados nítidos e sem perda, JPEG para arquivos mais leves ou WebP para um equilíbrio eficiente pronto para web.

Para evitar elementos indesejados, há a opção de prompt negativo, onde você lista qualidades a evitar — como baixa resolução, deformidades ou qualidade ruim em geral —, ajudando a limpar as saídas e reduzir artefatos comuns. Um recurso de expansão automática de prompt pode reescrever e enriquecer seu prompt nos bastidores, desenvolvendo descrições esparsas para imagens mais detalhadas e polidas sem que você precise escrever instruções elaboradas. Se preferir controle total sobre o texto exato, pode desativá-lo.

Para produtividade, você pode gerar até quatro imagens de um único prompt de uma vez, dando uma variedade de opções para comparar e escolher em uma passada só. Isso é útil ao explorar direções para um conceito, testar posicionamentos de tipografia ou simplesmente querer variedade antes de decidir o final. O controle de seed permite reprodutibilidade: reutilize o mesmo seed com o mesmo prompt para resultados consistentes, ou mude para explorar variações novas. O modelo também informa o seed usado, para que você possa salvar e revisitar um visual que gostou.

Um verificador de moderação de conteúdo de segurança é aplicado tanto ao que você envia quanto ao que o modelo produz, ajudando a manter as gerações apropriadas. Isso roda por padrão para apoiar o uso responsável.

Quem se beneficia mais? Designers gráficos e profissionais de marketing que precisam de imagens com texto real e legível vão achar o manuseio de tipografia um verdadeiro economizador de tempo — pense em cartões promocionais, gráficos de anúncios e banners sociais onde a mensagem faz parte da imagem. Ilustradores e criadores de arte estilizada podem explorar os visuais voltados para design do modelo em artes editoriais, conceitos de personagens e cenas lúdicas. Criadores de conteúdo produzindo thumbnails, posts e visuais de campanha em formatos quadrados, retrato e paisagem podem criar arte pronta para o formato sem cortes extras. Equipes bilíngues trabalhando com públicos em inglês e chinês têm suporte nativo para ambas as línguas em uma única ferramenta.

Algumas coisas a ter em mente. Este é um modelo de texto-para-imagem, então ele constrói cada imagem a partir da sua descrição escrita; se precisar de controle preciso em nível de pixel sobre uma foto existente específica, lembre-se de que a força aqui é gerar novas imagens a partir de palavras. Prompts são limitados a 800 caracteres e prompts negativos a 500, então foque nos detalhes mais importantes. A resolução de saída chega a cerca de 2048×2048 pixels, o que é amplo para telas e a maioria dos usos digitais. Para o texto mais nítido, ajuda declarar as palavras exatas entre aspas no seu prompt e manter o texto conciso. Quando os resultados não saem perfeitos, ajustar o prompt negativo ou tentar um novo seed é frequentemente a correção mais rápida, e gerar várias imagens de uma vez permite escolher a melhor composição e tipografia.

No geral, Qwen Image 3 Text to Image é um gerador versátil feito para criadores que querem imagens e palavras convivendo de forma convincente — uma escolha forte para design, marketing e arte estilizada onde texto legível faz parte do briefing.

Gere com o modelo de imagem mais avançado

A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.

Passo 1

Escreva seu cenário

Digite um prompt descrevendo a imagem desejada com detalhes de estilo, iluminação e composição

Passo 2

A IA gera

O modelo compreende a física, a iluminação e a intenção emocional da sua cena

Passo 3

Comece a compartilhar

Clique para gerar o resultado final e baixe uma imagem com qualidade de produção

Além do prompt: um novo nível de controle

DIORAMA TILT-SHIFT

DIORAMA TILT-SHIFT

Exibe renderização isométrica em miniatura com placa de sinalização como âncora impressionante, um formato tilt-shift compartilhável popular.

DIORAMA TILT-SHIFT
Exemplo em destaque 1
A espera finalmente acabou

Experimente a perfeição com o Qwen Image 3 Text to Image

Mude para a síntese guiada por raciocínio hoje mesmo

Perguntas frequentes

A renderização de texto é uma de suas forças definidoras — ele é especificamente projetado para tipografia, então letreiros, cartões, rótulos e manchetes de pôsteres saem legíveis, não distorcidos. Para melhores resultados, coloque as palavras exatas entre aspas no seu prompt e mantenha o texto conciso.