技術記事

Qwen-Image-Edit-Plus:複数画像の合成と文字編集

Qwen-Image-Edit-Plusが最大3枚の参照画像を組み合わせ、人物や商品を維持しながら、中国語と英語のテキストをより細かく編集する仕組みを紹介します。

Qwen Image Team

予想読了時間
約 4 分
文字数
約 637 文字

制作現場では、複数の参照素材を組み合わせ、人物や商品を保ったまま、画像を一から作り直さずにテキストだけを更新したい場面がよくあります。Qwen-Image-Edit-Plus(Qwen-Image-Edit-2509としても公開)は、こうした作業をプロンプトベースの一つのワークフローにまとめます。

Qwen-Imageを基盤とする20B MMDiTモデルで、複数画像の合成や局所編集を細かく制御したいマーケター、デザイナー、ECチーム、クリエイター向けに設計されています。


Qwen-Image-Edit-Plusを選ぶ理由

画像生成はアイデア探索に役立ちますが、制作には再現性が欠かせません。人物、商品、レイアウト、テキストが改稿のたびに崩れないことが重要です。Qwen-Image-Edit-Plusは、既に機能している要素を失わずに反復できる、制御性と忠実度の高い編集に重点を置いています。

主な利点

  • より正確な修正: 目的の変更にプロンプトを集中させ、局所的な調整から大きな変換まで行えます。
  • 2言語のテキスト編集: 中国語と英語の文言に加え、フォント、色、素材感も変更できます。
  • 一貫性の向上: ポーズ、スタイル、場面、キャンペーン素材が変わっても、人物や商品の特徴を維持します。

中核機能

  • 複数画像編集: 人物+人物、人物+商品、人物+場面などの参照を合成できます。入力画像は1〜3枚が最適です。
  • 人物の一貫性: 肖像スタイルやポーズを変えても顔の同一性を保ちます。
  • 商品の一貫性: ポスター、配置案、キャンペーンのバリエーションでも商品らしさを保ちます。
  • テキストの一貫性: 周囲のデザインを維持しながら、文言、フォント、色、素材を変更します。

適切な編集モードを選ぶ

本モデルの重要な革新は、画像編集に二つのアプローチを採用している点です。

  • 外観レベル編集:低レベルで外科的な変更に向きます。プロ向けのインペインティングのように、指定箇所以外を完全に保ったまま特定の変更を加えます。オブジェクトの削除、要素の追加、欠陥の修正に最適です。

  • セマンティックレベル編集:高レベルの創造的な変換に向きます。中心的な意味と内容を維持する限り、画像全体のピクセルを広く変更できます。スタイル変換、オブジェクトの回転、原画と意味的に一貫したIP制作に適しています。


複数画像ワークフローの仕組み

Qwen-Image-Edit-Plusの魅力は、直感的なプロンプトベースの操作にあります。ここでは実行できる作業と使用するプロンプトを紹介します。

例:3枚の参照画像から1枚を合成する

目的: 別々の参照画像にある人物、ドレス、ポーズを組み合わせたファッション画像を作成する。

  1. 参照画像をアップロード:
  • 画像1:女性のポートレート。
  • 画像2:黒いドレスの写真。
  • 画像3:モデルが特定のポーズを取る画像。
  1. 組み合わせ方を記述:

In the style of a fashion photo, create an image of the girl from Image 1, wearing the black dress from Image 2, and in the pose from Image 3.

複数の入力画像

目的を絞った編集から始める

明確な目標と、品質の高い1〜3枚の参照画像を用意します。変更する要素、維持する要素、必要な仕上がりを指定してください。構図が整ったら、テキスト、色、照明、素材を別々の工程で調整します。

関連記事

    Qwen-Image-Edit-Plus:複数画像の合成と文字編集