Les équipes créatives doivent souvent combiner plusieurs références, préserver un sujet ou un produit, et mettre à jour du texte sans reconstruire une image de zéro. Qwen-Image-Edit-Plus, également publié sous le nom de Qwen-Image-Edit-2509, réunit ces tâches dans un même flux de travail piloté par prompt.
Basé sur Qwen-Image, ce modèle MMDiT de 20B s’adresse aux spécialistes du marketing, designers, équipes e-commerce et créateurs qui souhaitent mieux maîtriser la composition multi-image et les retouches localisées.
Pourquoi choisir Qwen-Image-Edit-Plus
La génération d’images est utile pour explorer des pistes, mais la production exige de la reproductibilité : la bonne personne, le bon produit, la mise en page et le texte doivent résister à chaque révision. Qwen-Image-Edit-Plus privilégie une retouche contrôlée et haute fidélité, afin que les équipes puissent itérer sans perdre les éléments qui fonctionnent déjà.
Principaux avantages
- Des révisions plus précises : effectuez un ajustement ciblé ou une transformation plus large tout en gardant le prompt centré sur le changement recherché.
- Retouche de texte bilingue : modifiez les contenus chinois et anglais, ainsi que la police, la couleur et les propriétés des matériaux.
- Une cohérence renforcée : conservez des personnes et des produits reconnaissables dans de nouvelles poses, de nouveaux styles, de nouvelles scènes et de nouveaux supports de campagne.
Fonctionnalités essentielles
- Retouche multi-image : combinez des références telles que personne + personne, personne + produit ou personne + scène. Pour de meilleurs résultats, utilisez une à trois images d’entrée.
- Cohérence des personnes : préservez l’identité faciale à travers différents styles de portrait et changements de pose.
- Cohérence des produits : conservez l’identité d’un produit lors de la création d’affiches, de placements et de variantes de campagne.
- Cohérence du texte : modifiez le contenu, mais aussi la police, la couleur et le matériau, tout en préservant le design environnant.
Choisir le bon mode de retouche
L’une des innovations majeures de ce modèle réside dans sa double approche de la retouche d’images.
-
Retouche au niveau de l’apparence : conçue pour des modifications chirurgicales et localisées. Il s’agit en quelque sorte d’une retouche par remplissage de niveau professionnel. L’objectif est d’appliquer un changement précis en laissant absolument intactes toutes les autres zones de l’image. Ce mode est idéal pour supprimer un objet, ajouter un nouvel élément ou corriger un défaut.
-
Retouche au niveau sémantique : destinée aux transformations créatives de haut niveau. Le modèle peut modifier plus largement les pixels de l’image, à condition d’en préserver le sens et le contenu essentiels. Ce mode convient parfaitement au transfert de style, à la rotation d’objets ou à la création de propriété intellectuelle, lorsque le résultat final diffère sur le plan stylistique tout en restant fidèle à l’original sur le plan sémantique.
Fonctionnement du flux multi-image
Qwen-Image-Edit-Plus se distingue par son interface intuitive pilotée par prompt. Voici quelques exemples de ce que vous pouvez réaliser, ainsi que les prompts à utiliser.
Exemple : composer une image à partir de trois références
Objectif : créer une image de mode qui combine une personne, une robe et une pose provenant de trois références distinctes.
- Importez les images de référence :
- Image 1 : le portrait d’une jeune femme.
- Image 2 : la photo d’une robe noire.
- Image 3 : l’image d’un mannequin prenant une pose précise.
- Décrivez la manière de les combiner :
In the style of a fashion photo, create an image of the girl from Image 1, wearing the black dress from Image 2, and in the pose from Image 3.
Commencer par une retouche ciblée
Partez d’un objectif clair et d’une à trois images de référence de qualité. Indiquez les éléments à modifier, ceux qui doivent rester inchangés et le résultat visuel souhaité. Une fois la composition correcte, affinez séparément le texte, la couleur, l’éclairage ou les matériaux.


