- 精准文字编辑: Qwen-Image-Edit支持中英双语文字编辑,可以在保留文字大小/字体/风格的前提下,直接编辑图片中文字,进行增删改。
- 语义/外观 双重编辑: Qwen-Image-Edit不仅支持low-level的视觉外观编辑(例如风格迁移,增删改等),也支持high-level的视觉语义编辑(例如IP制作,物体旋转等)
- 强大的跨基准性能表现: 在多个公开基准测试中的评估表明,Qwen-Image-Edit 在编辑任务中均获得SOTA,是一个强大的图像生成基础模型。
ComfyOrg Qwen-Image-Edit 直播回放
Qwen-Image-Edit ComfyUI 原生工作流示例
Qwen Image Edit
使用 Qwen-Image-Edit 的 20B MMDiT 模型,通过精确的双语文本编辑以及语义/外观双重编辑能力来编辑图像。
在 Comfy Cloud 上运行
在云端 GPU 上运行此工作流,无需任何设置
下载工作流
下载 JSON,或在模板库中搜索 “Qwen Image Edit”
LoadImage 节点:
image_qwen_image_edit_input_image.png
LoadImage 节点 78 · image_qwen_image_edit_input_image.png


1. 工作流文件
2. 模型下载
全部模型都可以在 Comfy-Org/Qwen-Image_ComfyUI 或 Comfy-Org/Qwen-Image-Edit_ComfyUI 中找到 Diffusion 模型 LoRA 文本编码器 VAE 模型存储位置3. 按步骤完成工作流

- 模型加载
- 确保
Load Diffusion Model节点加载了qwen_image_edit_fp8_e4m3fn.safetensors - 确保
Load CLIP节点加载了qwen_2.5_vl_7b_fp8_scaled.safetensors - 确保
Load VAE节点加载了qwen_image_vae.safetensors
- 确保
- 图像加载
- 确保
Load Image节点上传了要编辑的图像
- 确保
- 提示词设置
- 在
CLIP Text Encoder节点中设置提示词
- 在
- Scale Image to Total Pixels 节点会将输入图像缩放至总像素为 100 万像素,
- 主要是为了避免 2048x2048 等超大输入图像导致的输出图像质量损失
- 如果你熟悉输入图像的尺寸,可以使用
Ctrl+B绕过此节点
- 如果你想使用 4 步 Lighting LoRA 来加速图像生成,可以选择
LoraLoaderModelOnly节点,然后按Ctrl+B启用它 - 对于 KSampler 节点的
steps和cfg设置,我们在节点下方添加了注释,你可以测试最佳参数设置 - 点击
Queue按钮,或使用快捷键Ctrl(cmd) + Enter运行工作流