Flexible multilingual image generation model

















Wan v2.6 Text to Image는 다양한 이미지를 생성할 수 있는 모델로, 문장으로 설명한 내용을 완성된 시각화로 빠르게 전환해 아티스트, 디자이너, 콘텐츠 크리에이터가 아이디어에서 이미지까지 신속하게 도달할 수 있도록 해줍니다. 사실적인 사진부터 감각적인 스타일까지 모두 지원하며, 단순한 텍스트 프롬프트를 입력하면, 프롬프트에 담긴 분위기, 조명, 주제, 디테일을 반영한 이미지를 만듭니다. 컨셉 아트 스케치, 스토리 일러스트, 마케팅 비주얼 제작, 창의적 방향성 탐구 등 어떠한 작업에도 Wan v2.6은 텍스트만으로도 원하는 결과를 유연하게 제공합니다.
이 모델의 가장 특별한 기능 중 하나는 이중 언어(중국어/영어) 이해력입니다. 프롬프트를 영어 또는 중국어로 자유롭게 작성할 수 있으며, 모델이 모두 자연스럽게 해석합니다. 언어의 장벽 없이 자연스러운 언어로 아이디어를 설명할 수 있어 다국적·다문화 창작자에게 특히 유용합니다. 프롬프트는 최대 2,000자까지 작성할 수 있어, 배경, 분위기, 카메라 각도, 예술적 스타일, 세밀한 시각적 디테일까지 구체적으로 Layer를 쌓아 원하는 결과를 세밀하게 조정할 수 있습니다.
오직 텍스트만 사용할 수도 있지만, 참고 이미지를 하나 업로드하면 결과 이미지의 스타일을 더욱 세밀하게 컨트롤할 수 있습니다. 참고 이미지를 제공하면, 기존 브랜드 팔레트, 무드보드 등 특정 미적 감각과 잘 어울리는 새로운 이미지를 만들 때 유용합니다. 참고 이미지는 JPEG, PNG, BMP, WEBP 등 다양한 포맷을 지원하며, 한 변의 해상도는 384 ~ 5000 픽셀까지 허용됩니다.
결과물의 형태와 크기는 간편한 프리셋(정사각형, 세로형, 가로형 등)으로 선택하거나, 직접 사이즈를 입력해 맞춤형 캔버스로 조절할 수 있습니다. 프리셋은 square HD, portrait 4:3, portrait 16:9, landscape 4:3, landscape 16:9 등이 있으며, 사이즈 지정 없이 참고 이미지를 사용하면 최대 1280x1280 영역까지 참고 이미지의 비율로 출력됩니다. 이처럼 유연한 크기 설정으로, SNS, 인쇄, 와이드스크린, 모바일 등 다양한 목적에 맞는 이미지를 별도 크롭 없이 바로 생성할 수 있습니다.
프롬프트와 함께 '네거티브 프롬프트'를 추가해 제외하고 싶은 요소를 명시할 수도 있습니다. 이는 흔한 오류(저화질, 왜곡, 원치 않는 아티팩트 등)를 걸러내고 더 다듬어진 결과를 얻는 데 효과적입니다. 네거티브 프롬프트는 최대 500자까지 입력 가능합니다.
Wan v2.6은 한 번에 여러 이미지를 생성할 수도 있습니다. 한 번에 최대 5개까지 이미지 생성 요청이 가능해, 같은 아이디어의 다양한 변형을 비교해 최적의 이미지를 선택할 수 있습니다. 상황에 따라 생성 이미지 수는 변동될 수 있습니다. 여러 버전을 동시에 받아볼 수 있어 아이데이션 및 컨셉 작업에 매우 효과적입니다.
일관성과 재현성을 중시하는 창작자를 위해 시드(Seed) 컨트롤 기능도 지원합니다. 시드를 설정하면 동일한 결과를 재현하거나, 전체 구성을 유지하면서 세부만 조금씩 조정할 수 있습니다. 원하는 결과를 찾았다면 해당 시드를 저장해두면 언제든지 동일한 무드로 재생성 및 수정이 가능합니다. 이미지 생성 시 모든 시드는 결과와 함께 제공되므로 자유롭게 저장·활용이 가능합니다.
이미지는 PNG 포맷으로 출력되어, 편집, 레이어 합성, 다양한 디자인 작업에 잘 어울립니다. 예시 이미지는 풍부하고 몽환적인 분위기, 예를 들어 구름 사이에 떠 있는 고대 도서관, 대형 창문으로 쏟아지는 황금빛, 극사실적 묘사 등 복잡한 조명과 환경, 감정적인 디테일도 잘 표현됩니다. 프롬프트에 따라 다양한 주제와 스타일을 자연스럽게 처리할 수 있습니다.
Wan v2.6은 텍스트+이미지 혼합 출력도 지원합니다(일부 모드 한정). 즉, 생성된 이미지와 함께 텍스트도 함께 제공 가능해, 단일 이미지를 넘어 새로운 활용을 할 수 있습니다. 그러나 모델의 핵심 강점은 역시 이미지 생성입니다.
콘텐츠 모더레이션 기능이 내장되어 기본적으로 활성화되어 있으며, 입력과 결과물을 모두 스크리닝하여 안전하고 적합한 생성 결과를 제공합니다. 이는 전문적·상업적 창작 환경에 매우 중요합니다.
가장 큰 수혜자는 일러스트레이터, 컨셉 아티스트, 그래픽 디자이너, 마케터, 소셜 크리에이터, 영화 제작자, 스토리텔러 등으로, 빠르게 장면과 캐릭터를 시각화하거나, 배경/메인 이미지/스타일 실험, SNS용 완벽한 비율의 비주얼 생성, 무드보드·프리비주얼 구성에 적합합니다. 이중 언어 프롬프트 지원으로 영어·중국어 환경의 창작자 모두에게 유용합니다.
효과적인 사용 팁을 몇 가지 더하자면, 세밀하고 구체적으로 프롬프트를 작성할수록 더욱 정교한 이미지가 나옵니다. 네거티브 프롬프트로 흔한 오류를 미리 걸러내면 결과 품질이 크게 향상됩니다. 여러 이미지를 한 번에 생성해 비교하면, 원하는 아이디어의 최적 해석을 신속하게 찾을 수 있습니다. 마음에 드는 결과의 시드를 저장해두면, 동일한 무드로 언제든 재생·수정할 수 있습니다. 종합적으로 Wan v2.6 Text to Image는 광범위한 크리에이티브 워크플로우에서 텍스트 아이디어를 고품질 비주얼로 바꿔주는 매우 유연하고 강력한 도구입니다.
A woman kneeling in darkness, illuminated by a warm, radiant beam of light emerging from her raised hand.
스타일, 조명, 구도 등 원하는 이미지를 설명하는 프롬프트를 입력하세요
모델이 장면의 물리, 조명, 감정적 의도를 이해합니다
클릭하여 최종 결과물을 생성하고 프로덕션 수준의 이미지를 다운로드하세요
트렌디한 영화 룩, 대각 와이드샷, 분위기 있는 조명 등 스토리텔링에 어울리는 시네마틱 이미지를 자유롭게 제작합니다.

여러 인물이 등장하는 활기차고 현대적인 라이프스타일 브랜드 씬을 생성하며, 성별/스타일링도 정밀하게 표현합니다.

건축의 복잡함과 공간의 분위기, 극사실적 디테일까지 세련된 이야기 전달에 어울리는 이미지를 압도적으로 출력합니다.

“High-end studio product photography of premium wireless over-ear headphones in matte black finish. Dramatic three-point lighting with soft key light from upper left, rim light highlighting the ear cup contours, and subtle fill. Clean white seamless backdrop with soft gradient. Sharp focus on texture details of the leather headband and brushed metal accents. Professional advertising quality, 8K resolution, photorealistic rendering.”

오늘 바로 추론 기반 생성으로 전환하세요

Flagship multilingual text-to-image generation
0.3 크레딧

High-quality text-to-image with accurate text
1.3 크레딧

Fast, efficient image generation
6 크레딧

High-fidelity text-to-image generation
0.1 크레딧

Detailed images with fine typography
4 크레딧

Design-first text to image generation
0.2 크레딧

Precise structured text-to-image generation
0.2 크레딧

Fast high-quality text-to-image generation
0.3 크레딧

Fast efficient image generation
6 크레딧