Zespoły kreatywne często muszą połączyć kilka materiałów referencyjnych, zachować osobę lub produkt i zaktualizować tekst bez tworzenia obrazu od podstaw. Qwen-Image-Edit-Plus, wydany także jako Qwen-Image-Edit-2509, łączy te zadania w jednym procesie opartym na promptach.
Ten model MMDiT o 20B parametrach, zbudowany na Qwen-Image, jest przeznaczony dla marketerów, projektantów, zespołów e-commerce i twórców, którzy potrzebują większej kontroli nad kompozycjami z wielu obrazów i lokalnymi poprawkami.
Dlaczego Qwen-Image-Edit-Plus?
Generowanie obrazów pomaga w poszukiwaniu pomysłów, ale produkcja wymaga powtarzalności: właściwa osoba, produkt, układ i tekst muszą przetrwać każdą wersję. Qwen-Image-Edit-Plus skupia się na kontrolowanej edycji o wysokiej zgodności, aby zespoły mogły iterować bez utraty elementów, które już działają.
Najważniejsze zalety
- Precyzyjniejsze poprawki: wprowadzaj punktową zmianę lub szerszą transformację, koncentrując prompt na zamierzonym efekcie.
- Dwujęzyczna edycja tekstu: zmieniaj treści chińskie i angielskie, a także krój, kolor i właściwości materiału.
- Większa spójność: zachowuj rozpoznawalne osoby i produkty w nowych pozach, stylach, scenach i materiałach kampanii.
Główne możliwości
- Edycja wielu obrazów: łącz referencje osoba + osoba, osoba + produkt lub osoba + scena. Najlepsze wyniki daje od jednego do trzech obrazów wejściowych.
- Spójność osoby: zachowuj tożsamość twarzy między stylami portretu i zmianami pozy.
- Spójność produktu: utrzymuj tożsamość produktu w plakatach, lokowaniach i wariantach kampanii.
- Spójność tekstu: zmieniaj treść, krój, kolor i materiał, zachowując otaczający projekt.
Wybierz właściwy tryb edycji
Ważną innowacją modelu jest podwójne podejście do edycji obrazu.
-
Edycja na poziomie wyglądu służy do chirurgicznych zmian niskiego poziomu. Działa jak profesjonalny inpainting: modyfikuje wskazany element, pozostawiając wszystkie pozostałe obszary bez zmian. Nadaje się do usuwania obiektu, dodawania elementu i naprawiania niedoskonałości.
-
Edycja na poziomie semantycznym służy do twórczych transformacji wysokiego poziomu. Model może szerzej zmieniać piksele, o ile zachowuje główny sens i zawartość obrazu. Sprawdza się przy transferze stylu, obracaniu obiektów i tworzeniu własności intelektualnej, gdy rezultat różni się stylistycznie, ale pozostaje semantycznie zgodny z oryginałem.
Jak działa proces z wieloma obrazami?
Siłą Qwen-Image-Edit-Plus jest intuicyjny interfejs oparty na promptach. Oto przykładowe zadanie i właściwy prompt.
Przykład: kompozycja z trzech referencji
Cel: stworzyć obraz modowy łączący osobę, sukienkę i pozę z trzech osobnych materiałów.
- Prześlij obrazy referencyjne:
- Obraz 1: portret dziewczyny.
- Obraz 2: zdjęcie czarnej sukienki.
- Obraz 3: modelka w określonej pozie.
- Opisz sposób połączenia:
In the style of a fashion photo, create an image of the girl from Image 1, wearing the black dress from Image 2, and in the pose from Image 3.
Zacznij od jednej konkretnej zmiany
Określ jeden cel i przygotuj od jednego do trzech dobrych referencji. Wskaż, co ma się zmienić, co pozostać bez zmian i jakiego efektu potrzebujesz. Gdy kompozycja będzie poprawna, dopracuj tekst, kolor, światło i materiały w osobnych krokach.


