在 ComfyUI 中部署 Qwen-Image 2.1:模型、工作流与显存设置

在 ComfyUI 中部署 Qwen-Image 2.1:模型、工作流与显存设置

Qwen-Image 2.1 把文生图和图像编辑放进了同一个模型,视觉生成部分为 7B 参数。下面整理在 ComfyUI 中准备模型、摆放文件和加载工作流的步骤。

相比此前约 20B、BF16 模型文件约 40.9GB 的体量,这次主模型的 BF16 文件约 14.2GB,INT8 版本约 7.26GB。这里说的是文件大小,运行时还要加载文本编码器、VAE,并占用额外内存。

网上也有“3.05GiB 显存出图”的配置记录,它只能作为特定环境的个例,不能直接当成通用最低配置。能否运行还取决于量化、系统内存、卸载策略、分辨率和工作流。

Qwen-Image 2.1 官方模型评测对比图

主要功能

同一个模型既可以根据提示词生成图片,也可以根据输入图片和指令修改画面,支持原生 2K 级别输出。官方列出的宽高比包括 2048×2048、2752×1536 等;下面截图的 2752×2752 是示例设置,不把它当成所有工作流的统一分辨率上限。

模型支持带 Alpha 通道的 RGBA 透明图像、透明图层编辑和主体提取,最多可以使用 10 张参考图,并改进了文字、材质和细节表现。图标、Logo、产品素材等只是功能场景示例,实际商用还需要相应许可。

Qwen-Image 2.1 在 ComfyUI 中的节点连接示例

模型许可

Qwen-Image 2.1 使用 Qwen Research License Agreement,许可中的非商业用途限定为研究或评估。学习和测试也应在这些条款范围内进行,不能概括成所有个人用途都可以随意使用。

商品图、广告图等商业用途需要另行取得商业许可,官方联系地址为 model-business@notice.qwencloud.com。下载、修改或分发模型时,也需遵守协议中的许可副本、修改标记和署名通知要求。

1. 安装或更新 ComfyUI

首次安装可以使用 Comfy Desktop 官方下载页,根据操作系统要求完成安装。

已经安装的环境需要更新到包含 Qwen-Image 2.1 支持的版本。桌面版从软件内检查更新;Windows 便携版使用 update 文件夹里的 update_comfyui.bat。通过 Git 安装的环境,先进入该 ComfyUI 对应的 Python 环境,再更新代码和依赖:

cd ComfyUI
git pull
pip install -r requirements.txt

只更新代码而没有更新依赖,也可能导致模板或节点仍然缺失。桌面稳定版的功能时间可能晚于开发版,应结合官方更新说明确认所用版本。

Comfy Desktop 官方下载页面

2. 下载模型

这里使用 Comfy-Org/Qwen-Image-2.1 提供的 ComfyUI 重打包文件,原始模型仓库是 Qwen/Qwen-Image-2.1。

进入“Files and versions”,基础工作流需要主模型、文本编码器和 VAE 三类文件。仓库后续可能增加其他目录,按所用工作流的需求下载即可。

主模型:diffusion_models

  • qwen_image_2.1_bf16.safetensors:BF16 精度,资源充足时可选。
  • qwen_image_2.1_int8_convrot.safetensors:INT8 量化,文件体积较小。
Qwen-Image 2.1 主模型文件列表

文本编码器:text_encoders

按资源情况选择一种:

  • qwen3vl_8b_bf16.safetensors
  • qwen3vl_8b_int8_convrot.safetensors
  • qwen3vl_8b_w4a8.safetensors:这三种选项中更偏向节省资源的量化方案。
Qwen-Image 2.1 文本编码器和提示词增强模型文件列表

VAE:vae

下载 qwen_image_2.1_vae_bf16.safetensors。

Qwen-Image 2.1 VAE 文件列表

text_encoders 中还有两个以 qwen3.5_9b_qwen_image_2.1_pe_ 开头、每个约 9GB 多的提示词增强模型,需要配合 TextGenerate 节点使用。t2i 用于文生图提示词,i2i 用于图像编辑提示词,把简短描述扩展得更详细。基础工作流不必加载它们,资源紧张时可先跳过。

下载较慢时,可以选可信的镜像或支持断点续传、多线程的下载工具,并核对文件名、来源和完整性。

3. 放置模型文件

以 INT8 文件为例,目录结构如下:

ComfyUI/
└── models/
    ├── diffusion_models/
    │   └── qwen_image_2.1_int8_convrot.safetensors
    ├── text_encoders/
    │   └── qwen3vl_8b_int8_convrot.safetensors
    └── vae/
        └── qwen_image_2.1_vae_bf16.safetensors

Windows 便携版的对应目录:

对应关系:

qwen_image_2.1_int8_convrot.safetensors → ComfyUI_windows_portable\ComfyUI\models\diffusion_models\

qwen3vl_8b_int8_convrot.safetensors → ComfyUI_windows_portable\ComfyUI\models\text_encoders\

qwen_image_2.1_vae_bf16.safetensors → ComfyUI_windows_portable\ComfyUI\models\vae\

提示词增强模型同样放进 text_encoders。放好后重启 ComfyUI,使加载节点重新发现这些文件。

4. 加载工作流

Comfy-Org 的 workflow_templates 仓库提供三个对应模板:

下载 JSON 后拖入 ComfyUI,也可以在支持该模型的模板库中搜索“Qwen Image 2.1”。三个模板可以分别从上面的官方链接下载,额外个人打包版本目前没有可核对的下载附件。

加载后检查三个模型节点:Load Diffusion Model 选择主模型,Load CLIP 选择文本编码器,Load VAE 选择 VAE。确认连接和文件正确后填写提示词,按 Ctrl+Enter 提交运行。

需要透明背景时,在提示词中明确描述 RGBA、Alpha 通道和透明背景,并使用支持该输出的工作流。已有图片需要提取主体时,使用背景移除模板,输入图片后检查透明区域和边缘效果。

文生图、图像编辑和背景移除三个工作流示例

显存不足时的调整

  1. 先尝试 INT8 主模型和 W4A8 文本编码器,降低模型加载开销。
  2. 按所用启动方式加入 --lowvram 参数。它可能增加内存卸载和等待时间,不能保证所有显卡都能运行。
  3. 暂时不加载两个提示词增强模型,先把基础工作流配置好。
显存调整部分的趣味配图

常见问题

  • 搜不到模板:检查 ComfyUI 版本以及工作流模板依赖是否都已更新,稳定版与开发版可能存在时间差。
  • 模型下拉框为空:检查文件目录、下载完整性,并重新启动 ComfyUI。
  • 模型名称混淆:本教程使用 Qwen-Image-2.1。带 2509、2512 等标记的其他版本不能仅凭名称相似就混用,下载时确认仓库和工作流对应关系。

较小的视觉模型和量化文件降低了本地尝试的资源开销。是否适合自己的显卡,仍应按具体环境判断;透明图片生成和背景移除的商业使用,按模型许可取得授权后再开展。

Qwen-Image 2.1 教程结尾配图

项目资料

© 版权声明
THE END
喜欢就支持一下吧
点赞0 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容