技术文章

面向建筑与设计工作流的 Qwen-Image-Edit-2509

了解建筑师和设计师如何使用 Qwen-Image-Edit-2509 进行可控的局部编辑、视觉姿势引导、风格探索与迭代式概念开发。

Qwen Image Team

预计阅读时间
约 3 分钟
字数
约 533 字

更快地从概念走向多种方案

建筑与设计团队常常花数小时制作一张渲染图;当客户要求更换材质、氛围或姿势时,又要重复整个过程。Qwen-Image-Edit-2509 能根据自然语言和视觉指令探索不同方案,同时保留图像中应当稳定不变的部分。

这套工作流可以实现什么

想象一下:让一座现代玻璃塔楼立即呈现出中国传统纹样的风格,或把普通城市照片变成超写实的未来场景。

Qwen-Image-Edit-2509 能理解提示词所描述的主体、结构与约束,因此适合早期概念探索、局部修改和姿势驱动的构图。以下示例展示了三项实用能力。


1. 在遵守约束的前提下进行局部修改

这项能力的核心价值,是让用户能够对图像进行精确、局部的修改,同时严格保留其他所有元素。

  • 示例 1 展示:
    • 用户给出了一条复杂的多部分指令:更改背景(Set the background to evening)、
    • 修改服装(Change the skirt to shiny latex yoga pants)、
    • 并改变表情(Make the expression a smile)。
姿势调整示例 1姿势调整示例 2姿势调整示例 3
  • 关键突破:
    • 更重要的是,AI 严格遵守了 Do not change anything else 这一约束。模型在完成三项不同修改的同时,没有影响主体姿势、光照或任何未指定细节,实现了高度准确且可控的编辑。

2. 把视觉结构作为指令

这项能力使 AI 能够理解抽象、非像素级的指令并将其应用于图像,从而实现更高级的结构控制。

  • 示例 2 展示:
    • 社区用户发现,“火柴人可以用作姿势指令”(棒人間がポーズ指示に使える)。
火柴人姿势参考依据参考生成的姿势
  • 关键突破:
    • Qwen-Image-Edit-2509 会把简单的火柴人轮廓理解为三维姿势指令,并将结构引导准确映射到图中人物,生成所需姿态。这突破了纯文字描述复杂姿势的局限,为用户提供了更直观、更强大的身体结构控制方式。

3. 通过多轮迭代细化结构

这项能力提供了完整的控制流程,即使初始图像已经生成,用户仍可继续编辑主体的核心结构。

  • 示例 3 展示:
    • 该功能称为 pose and repose。
初始人物姿势再次调整后的人物姿势
  • 关键突破:
    • AI 不仅支持在生成时指定姿势(pose),还允许用户对现有图像中的人物再次调整姿态(repose)。重新摆姿势时,服装、面部特征和环境纹理等其他细节不会变形。这体现了 Qwen-Image-Edit-2509 在整个创意工作流中对关键结构元素持续、可靠的控制能力。

何时使用 Qwen-Image-Edit-2509

以下场景适合使用这套工作流:

  • 快速把一张草图转化为多种风格化的高质量渲染图。
  • 对任意图像进行微小而精准的编辑。
  • 用简单的线稿控制人物姿势。

用于生产时,请先准备清晰的源图像,每次只提出一组相互关联的修改,并明确指出必须保持不变的元素。先检查几何结构和身份一致性,再细化材质、光照和呈现细节。

相关文章

    面向建筑与设计工作流的 Qwen-Image-Edit-2509