창작 팀은 여러 레퍼런스를 결합하고, 주체나 제품을 보존하며, 이미지를 처음부터 다시 만들지 않고 텍스트를 업데이트해야 하는 경우가 많습니다. Qwen-Image-Edit-Plus(Qwen-Image-Edit-2509로도 출시됨)는 이러한 작업을 하나의 프롬프트 기반 워크플로우로 통합합니다.
Qwen-Image를 기반으로 구축된 이 20B MMDiT 모델은 다중 이미지 합성 및 국소 편집에 대한 더 많은 제어가 필요한 마케터, 디자이너, 이커머스 팀, 크리에이터를 위해 설계되었습니다.
Qwen-Image-Edit-Plus를 선택하는 이유
이미지 생성은 탐색에 유용하지만, 프로덕션 작업은 반복 가능성에 의존합니다: 올바른 사람, 제품, 레이아웃, 텍스트가 각 수정 사항에서 유지되어야 합니다. Qwen-Image-Edit-Plus는 이미 작동하는 요소를 잃지 않으면서 팀이 반복할 수 있도록 제어 가능하고 높은 충실도의 편집에 중점을 둡니다.
핵심 이점
- 더 정밀한 수정: 프롬프트를 의도된 변경에 집중시키면서 targeted 조정이나 광범위한 변환을 수행합니다.
- 이중 언어 텍스트 편집: 글꼴, 색상, 재질 속성과 함께 중국어 및 영어 카피를 수정합니다.
- 강화된 일관성: 새로운 포즈, 스타일, 시장, 캠페인 자산 전반에서 알아볼 수 있는 사람과 제품을 보존합니다.
핵심 기능
- 다중 이미지 편집: 사람 + 사람, 사람 + 제품, 또는 사람 + 시장과 같은 레퍼런스를 결합합니다. 최상의 결과를 위해 하나에서 세 개의 입력 이미지를 사용하세요.
- 사람 일관성: 인물 스타일과 포즈 변환 전반에서 얼굴 신원을 보존합니다.
- 제품 일관성: 포스터, 배치, 캠페인 변형을 만들면서 제품 신원을 유지합니다.
- 텍스트 일관성: 주변 디자인을 유지하면서 글꼴, 색상, 재질과 함께 카피를 변경합니다.
올바른 편집 모드 선택
이 모델의 핵심 혁신은 이미지 편집에 대한 이중 접근 방식입니다.
-
외형 수준 편집: 이는 외과적, 저수준 변경을 위한 것입니다. 전문 수준의 인페인팅이라고 생각하세요. 목표는 이미지의 다른 모든 영역을 절대 건드리지 않으면서 특정 변경을 수행하는 것입니다. 이는 개체 제거, 새 요소 추가, 또는 결점 수정과 같은 작업에 이상적입니다.
-
의미론 수준 편집: 이는 고수준, 창작적 변환을 위한 것입니다. 모델은 핵심 의미와 콘텐츠를 보존하는 한 이미지 전반에 걸쳐 더 광범위한 픽셀 변경을 수행할 수 있습니다. 이는 스타일 전송, 개체 회전, 또는 최종 출력이 원래와 스타일적으로 다르지만 의미론적으로 일관된 IP 제작에 완벽합니다.
다중 이미지 워크플로우 작동 방식
Qwen-Image-Edit-Plus의 아름다움은 직관적인 프롬프트 기반 인터페이스에 있습니다. 다음은 수행할 수 있는 작업과 사용할 프롬프트의 예시입니다.
예시: 세 개의 레퍼런스로 이미지 합성
목표: 세 개의 별도 레퍼런스에서 사람, 드레스, 포즈를 결합하는 패션 이미지를 만듭니다.
- 레퍼런스 이미지를 업로드합니다:
- 이미지 1: 소녀의 인물 사진.
- 이미지 2: 검은 드레스 사진.
- 이미지 3: 특정 포즈를 취하는 모델 이미지.
- 결합 방법을 설명합니다:
패션 사진 스타일로, 이미지 1의 소녀가 이미지 2의 검은 드레스를 입고 이미지 3의 포즈를 취하는 이미지를 만드세요.
집중 편집으로 시작하세요
하나의 명확한 목표와 하나에서 세 개의 강력한 레퍼런스 이미지로 시작하세요. 어떤 요소가 변경되어야 하고, 어떤 요소가 변경되지 않아야 하며, 필요한 시각적 결과를 명시하세요. 합성이 올바르면 별도의 패스에서 텍스트, 색상, 조명 또는 재질을 개선하세요.


