Skip to main content
Qwen-Image-Edit 是 Qwen-Image 的图像编辑版本。它基于20B的Qwen-Image模型进一步训练,成功将Qwen-Image的文本渲染特色能力拓展到编辑任务上,以支持精准的文字编辑。此外,Qwen-Image-Edit将输入图像同时输入到Qwen2.5-VL(获取视觉语义控制)和VAE Encoder(获得视觉外观控制),以同时获得语义/外观双重编辑能力。 模型特性 特性包括:
  • 精准文字编辑: Qwen-Image-Edit支持中英双语文字编辑,可以在保留文字大小/字体/风格的前提下,直接编辑图片中文字,进行增删改。
  • 语义/外观 双重编辑: Qwen-Image-Edit不仅支持low-level的视觉外观编辑(例如风格迁移,增删改等),也支持high-level的视觉语义编辑(例如IP制作,物体旋转等)
  • 强大的跨基准性能表现: 在多个公开基准测试中的评估表明,Qwen-Image-Edit 在编辑任务中均获得SOTA,是一个强大的图像生成基础模型。
官方链接:

ComfyOrg Qwen-Image-Edit 直播回放

Qwen-Image-Edit ComfyUI 原生工作流示例

请确保你的 ComfyUI 已经更新。本指南里的工作流可以在工作流模板中找到。如果找不到,可能是 ComfyUI 没有更新。如果加载工作流时有节点缺失,可能原因有:
  1. 你用的不是最新版(每夜版)。
  2. 启动时有些节点导入失败。

Qwen Image Edit

使用 Qwen-Image-Edit 的 20B MMDiT 模型,通过精确的双语文本编辑以及语义/外观双重编辑能力来编辑图像。 Qwen-Image-Edit 工作流预览

在 Comfy Cloud 上运行

在云端 GPU 上运行此工作流,无需任何设置

下载工作流

下载 JSON,或在模板库中搜索 “Qwen Image Edit”
输入素材 上传此文件到对应的 LoadImage 节点:

image_qwen_image_edit_input_image.png

LoadImage 节点 78 · image_qwen_image_edit_input_image.png
image_qwen_image_edit_input_image.png
示例输出
输入图像Qwen-Image-Edit 示例输出

1. 工作流文件

2. 模型下载

全部模型都可以在 Comfy-Org/Qwen-Image_ComfyUIComfy-Org/Qwen-Image-Edit_ComfyUI 中找到 Diffusion 模型 LoRA 文本编码器 VAE 模型存储位置

3. 按步骤完成工作流

步骤图
  1. 模型加载
    • 确保 Load Diffusion Model 节点加载了 qwen_image_edit_fp8_e4m3fn.safetensors
    • 确保 Load CLIP 节点加载了 qwen_2.5_vl_7b_fp8_scaled.safetensors
    • 确保 Load VAE 节点加载了 qwen_image_vae.safetensors
  2. 图像加载
    • 确保 Load Image 节点上传了要编辑的图像
  3. 提示词设置
    • CLIP Text Encoder 节点中设置提示词
  4. Scale Image to Total Pixels 节点会将输入图像缩放至总像素为 100 万像素,
    • 主要是为了避免 2048x2048 等超大输入图像导致的输出图像质量损失
    • 如果你熟悉输入图像的尺寸,可以使用 Ctrl+B 绕过此节点
  5. 如果你想使用 4 步 Lighting LoRA 来加速图像生成,可以选择 LoraLoaderModelOnly 节点,然后按 Ctrl+B 启用它
  6. 对于 KSampler 节点的 stepscfg 设置,我们在节点下方添加了注释,你可以测试最佳参数设置
  7. 点击 Queue 按钮,或使用快捷键 Ctrl(cmd) + Enter 运行工作流