Qwen-Image 2.1是什么?ComfyUI官方AI文生图模型仓库速览:完整文件结构与能力一览
【免费下载链接】Qwen-Image-2.1项目地址: https://ai.gitcode.com/hf_mirrors/Comfy-Org/Qwen-Image-2.1
Qwen-Image 2.1 是 ComfyUI 官方适配的新一代AI 文生图模型,本仓库为其提供开箱即用的模型文件包。仓库内包含扩散模型、文本编码器和 VAE 三大类权重,覆盖文本生图与图像编辑两大核心能力,支持 BF16、INT8、W4A8 多种量化格式,新手只需将文件放入对应目录即可运行。
仓库整体结构一览
仓库非常精简,采用 ComfyUI 标准的models/子目录组织方式,共 3 个功能目录、8 个模型文件:
Qwen-Image-2.1/ ├── 📄 README.md # 安装与使用说明 ├── 📂 diffusion_models/ # 扩散模型(核心生图能力) ├── 📂 text_encoders/ # 文本/视觉编码器(理解提示词) └── 📂 vae/ # VAE(图像解码器)官方说明见 README.md,它同时提供了 ComfyUI 目录放置规范和官方工作流模板(Text-to-image 与 Image Edit 两种)。
核心能力:文生图 + 图像编辑
Qwen-Image 2.1 提供两类主流工作流:
- 🎨文本生图(Text-to-image):输入文字提示词,直接生成高质量图像
- ✏️图像编辑(Image Edit):对已有图像进行局部修改或风格化处理
官方为这两种场景各提供了一套现成的 ComfyUI 工作流模板,导入后即可拖拽运行,无需自己搭图。
完整文件结构与量化版本详解
下面逐一说明每个文件的用途和体积,方便按需下载。
1️⃣ 扩散模型(diffusion_models/)
扩散模型是"画师",负责实际生成像素:
| 文件 | 精度 | 体积 | 适用场景 |
|---|---|---|---|
| qwen_image_2.1_bf16.safetensors | BF16 全精度 | 约 13.3 GB | 显存充足(≥24GB),追求最高画质 |
| qwen_image_2.1_int8_convrot.safetensors | INT8 量化 | 约 6.8 GB | 显存有限(8~16GB)的日常选择 |
💡新手建议:显存低于 16GB 时优先选 INT8 版,画质损失很小,速度更快。
2️⃣ 文本编码器(text_encoders/)
文本编码器负责"读懂"你的提示词(及参考图),分为两套体系:
Qwen3-VL 8B 通用编码器(3 个量化版本):
| 文件 | 精度 | 体积 | 说明 |
|---|---|---|---|
| qwen3vl_8b_bf16.safetensors | BF16 | 约 16.3 GB | 全精度,体积最大 |
| qwen3vl_8b_int8_convrot.safetensors | INT8 | 约 8.7 GB | 均衡之选 |
| qwen3vl_8b_w4a8.safetensors | W4A8 | 约 5.9 GB | 极致省显存 |
Qwen3.5 9B 专用 Prompt 编码器(2 个场景版本):
| 文件 | 用途 |
|---|---|
| qwen3.5_9b_qwen_image_2.1_pe_t2i.int8_convrot.safetensors | Text-to-Image 场景专用,约 8.8 GB |
| qwen3.5_9b_qwen_image_2.1_pe_i2i.int8_convrot.safetensors | Image-to-Image(图像编辑)场景专用,约 8.8 GB |
📌 文件名中的t2i/i2i后缀表明编码器按任务场景优化,做文生图选t2i版,做图像编辑选i2i版。
3️⃣ VAE 解码器(vae/)
qwen_image_2.1_vae_bf16.safetensors(约 644 MB)负责将潜空间张量解码为最终可见图像,体积小巧,必装。
如何快速安装到 ComfyUI
安装步骤只需三步,非常简单:
- 下载模型文件:clone 仓库获取全部模型
git clone https://gitcode.com/hf_mirrors/Comfy-Org/Qwen-Image-2.1 - 按目录复制:将 3 个子目录中的文件分别放入 ComfyUI 的
models/对应位置:
📂 ComfyUI/ └── 📂 models/ ├── 📂 diffusion_models/ ← 放入扩散模型 ├── 📂 text_encoders/ ← 放入文本编码器 └── 📂 vae/ ← 放入 VAE- 导入工作流运行:打开 ComfyUI,导入官方工作流模板(文生图 / 图像编辑二选一),选择对应模型节点参数,点击生成即可。
量化版本怎么选?一张表帮你决定
| 显存 | 推荐组合 | 预计总下载量 |
|---|---|---|
| 24GB+ | 扩散 BF16 + 编码器 BF16 + VAE | 约 30 GB |
| 12~16GB | 扩散 INT8 + 编码器 INT8 + VAE | 约 15 GB |
| 8GB 及以下 | 扩散 INT8 + 编码器 W4A8 + VAE | 约 11 GB |
常见问题(FAQ)
Q1:必须全部下载吗?不需要。VAE 必装;扩散模型选一个精度版本;文本编码器按需挑选(通用 VL 版与 9B 专用版二选一,或搭配使用)。
Q2:int8_convrot、w4a8 这些后缀是什么意思?它们代表不同的量化方案:int8_convrot为 INT8 权重+卷积旋转量化,w4a8为 4 比特权重 + 8 比特激活量化。量化越激进,文件越小、显存占用越低,全精度(BF16)画质上限最高。
Q3:这个仓库里的文件能单独使用吗?各模型文件相互独立,可单独取用。例如已有 Qwen3-VL 编码器,就只需下载扩散模型和 VAE。
总结
Qwen-Image 2.1 仓库为 ComfyUI 用户提供了完整的 AI 文生图模型套装:1 个扩散模型(2 种精度)+ 5 种文本编码器 + 1 个 VAE,配合官方两套工作流模板,从下载、放置到出图三步搞定。无论你是想体验文字直接画图,还是对现有图片做编辑,这个仓库都是当前 ComfyUI 生态下值得关注的选择 🚀
【免费下载链接】Qwen-Image-2.1项目地址: https://ai.gitcode.com/hf_mirrors/Comfy-Org/Qwen-Image-2.1
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考