Detailed images with fine typography

















GPT Image 2 és l'últim model de text-a-imatge d'OpenAI, dissenyat per convertir indicacions escrites en imatges ricament detallades amb un talent excepcional per a la tipografia fina. Mentre que molts generadors d'imatges fallen en les lletres —produint text confús, distorsionat o sense sentit—, aquest model està dissenyat per representar paraules netes i llegibles directament dins de la imatge. Això el converteix en una opció ideal per a treballs creatius on el text i les visuals han de conviure: pòsters, conceptes d'empaquetatge, il·lustracions editorials, maquetacions de senyals i qualsevol composició on les paraules importin tant com la imatge.
Al seu nucli, GPT Image 2 pren una descripció textual i produeix imatges d'alt detall. Podeu escriure des d'una frase curta fins a una indicació elaborada de diverses frases —les indicacions poden ser molt llargues, donant-vos espai per descriure l'escena, l'ambient, l'il·luminació, la composició, l'estil i el text exacte que voleu que aparegui. Per exemple, podeu demanar una imatge realista d'estil fotogràfic lligada a coordenades precises i una data, que el model interpreta per construir una escena creïble. Aquesta resposta a indicacions detallades i descriptives és un dels seus trets creatius més forts.
El model és flexible quant a les dimensions de sortida. Podeu triar entre predefinits còmodes per a formats quadrat, retrat i paisatge, introduir la vostra amplada i alçada personalitzades o deixar que el model decideixi i triï la mida que millor s'adapti a la vostra indicació. Les mides personalitzades admeten un ampli rang, amb un màxim de 3840 píxels per vora, relacions d'aspecte fins a 3:1 i un generós pressupost de píxels —per tant, podeu crear des de peces altes de retrat fins a paisatges cinematogràfics amples i gran format d'alta resolució. Ambdós dimensions han de ser múltiples de 16, cosa que manté la sortida neta i consistent.
La qualitat està totalment en les vostres mans. Podeu ajustar la sortida a detall baix, mitjà o alt segons l'aspecte que busqueu, o seleccionar un mode automàtic que deixa que el model esculli el nivell de qualitat millor per a la vostra indicació concreta. Els ajustos més alts ofereixen resultats més refinats i detallats, mentre que els més baixos són útils per a esbossos ràpids i iteracions. Això us dona un flux de treball pràctic: esbossos ideals en un ajust més lleuger, després comprometeu els favorits a alt detall per a la peça final.
Podeu generar fins a quatre imatges alhora a partir d'una sola indicació, ideal per explorar variacions i comparar opcions costat a costat abans d'escollir una direcció. Les imatges acabades es poden lliurar en formats PNG, JPEG o WebP, perquè pugueu adaptar la sortida a les vostres necessitats —PNG per a gràfics nítids i fluxos amb transparència, JPEG per a fitxers més lleugers i WebP per a un equilibri de qualitat i mida quan prepareu imatges per al web.
Qui en beneficia més? Els dissenyadors que treballen en maquetacions, anuncis i branding agrauran la tipografia fiable i la capacitat de veure paraules representades amb precisió en context. Il·lustradors i artistes conceptuals poden confiar en la comprensió detallada de les indicacions per construir escenes intricades. Marketers i creadors de continguts poden produir ràpidament visuals per a publicacions socials, campanyes i maquetacions, generant diverses variacions per provar què ressona. Cineastes i artistes de storyboards poden utilitzar-lo per visualitzar escenes i ambients a partir de descripcions escrites. Com que el model gestiona tant imatgeria d'estil fotorealista com composicions carregades de text, s'adapta a un ampli ventall de disciplines creatives en lloc d'un sol nínxol.
La combinació de funcions fomenta un enfocament iteratiu i exploratori. Comenceu amb una indicació detallada que descrigui exactament el que voleu —incloent qualsevol text que hagi d'aparèixer—, trieu un format que s'adapti al vostre ús previst i genereu un lot d'opcions. Si voleu anar ràpid, baixeu el nivell de qualitat i deixeu que el lot us guiï la direcció; quan hagueu trobat la composició que us agrada, regenereu-la en alt detall per a un final polit. Les opcions automàtiques de mida i qualitat són pràctiques quan preferiu confiar en el judici del model en lloc d'ajustar cada paràmetre manualment.
Algunes notes pràctiques a tenir en compte. El nivell de qualitat té un efecte real en l'aspecte final, així que val la pena experimentar per trobar el nivell que s'adapti a cada projecte. Les dimensions personalitzades han de respectar les regles de mida del model —múltiples de 16, un màxim de 3840 píxels per vora i una relació d'aspecte no més ampla de 3:1—, així que si una mida personalitzada no s'accepta, ajustar-la a aquests límits ho resoldrà. I tot i que el model destaca en la representació de tipografia en comparació amb els generadors d'imatges típics, els resultats més clars s'obtenen escrivint el text exacte que voleu en la vostra indicació i descrivint com ha d'aparèixer en l'escena.
En resum, GPT Image 2 és un generador d'imatges versàtil i centrat en els detalls amb una força característica en tipografia. Tant si esteu creant un pòster que necessita titulars llegibles, un concepte de producte amb etiquetes llegibles, una escena fotorealista a partir d'una descripció precisa o un conjunt de variacions ràpides per explorar una direcció creativa, us ofereix un control flexible sobre mida, qualitat, format i quantitat —tot a partir d'una sola indicació escrita.
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
Escriu una indicació que descrigui la imatge que vols amb detalls d'estil, il·luminació i composició
El model entén la física, la il·luminació i la intenció emocional de la teva escena
Fes clic per generar el resultat final i descarregar una imatge de qualitat professional
Mostra composicions cinematogràfiques amples amb il·luminació atmosfèrica perfecta per a narracions de marques de viatges i estil de vida.

Demostra la representació intricada de tipografia en senyals i reflexos en una escena urbana nocturna ricament detallada.

Destaca la il·luminació interior realista, textures i ambient càlid per a visuals de marques de llar i estil de vida.

“High-end studio product photography of premium wireless over-ear headphones in matte black finish. Dramatic three-point lighting with soft key light from upper left, rim light highlighting the ear cup contours, and subtle fill. Clean white seamless backdrop with soft gradient. Sharp focus on texture details of the leather headband and brushed metal accents. Professional advertising quality, 8K resolution, photorealistic rendering.”

Passa't avui a la síntesi guiada per raonament

Fast high-quality text-to-image generation
0.3 crèdits
![V4.0q [instant]](https://v3b.fal.media/files/b/0aa12d17/6liDSFFStjD4rStlm4CS1.jpg)
Fast text rendering image generation
0.1 crèdits

Unified image generation and editing
1.5 crèdits

Flagship multilingual text-to-image generation
0.3 crèdits

Fast, efficient image generation
6 crèdits

Fast efficient image generation
6 crèdits

High-quality text-to-image with accurate text
1.3 crèdits

Flexible multilingual image generation model
0.3 crèdits

Precise structured text-to-image generation
0.2 crèdits