AB
AiBoss站
快讯

阿里 Qwen 发布 Qwen-Image-2.1-Turbo:8 步出图的 7B 图像模型

阿里 Qwen 团队发布 Qwen-Image-2.1-Turbo,是其开源权重模型 Qwen-Image-2.1 的加速版本,去噪步数由默认 40 步降至 8 步,架构仍为 7B,并同步提供托管 API。

核心事实

据 MarkTechPost 报道,阿里巴巴 Qwen 团队发布了 Qwen-Image-2.1-Turbo,这是其开放权重模型 Qwen-Image-2.1 的加速检查点。该版本在相同的 7B 视觉生成架构上,把去噪步数从基础模型默认的 40 步压缩到 8 步,同时保留 2K 输出与图像编辑能力,并提供托管 API 选项。

技术细节方面,模型采用 32 层单流 DiT 与块因果注意力,文本编码器为 Qwen3-VL 8B,VAE 为 64 通道 RGBA 自编码器,支持原生透明通道;采样使用 Flow Matching 与 Euler 离散调度。官方推荐配置已随检查点保存,可通过 Diffusers 的 QwenImage21Pipeline 加载,在 CUDA GPU 上以 BF16 运行。

背景与影响

对开发者而言,8 步意味着在同等架构下减少约 5 倍的去噪步数,配合前缀 KV 缓存复用文本与参考图上下文,可降低推理开销。模型卡展示覆盖人像、人体姿态、透明图、排版海报与 UI 布局等类别,编辑示例包括单图变换、多参考合成与四图室内合成;基础模型据称支持最多 10 张参考图及圆形、涂抹标注或蒙版形式的局部编辑。

托管侧,阿里云 Model Studio 同时上线 Turbo 与 Pro 两个端点。据该报道,qwen-image-2.1-turbo 在多数地区为每张图 0.1 元人民币、限速 120 RPM,qwen-image-2.1-pro 为每张 0.25 元、20 RPM。价格与可用区域可能调整,请以官网当前信息为准。

限制与来源

需要注意,Turbo 采用 Qwen 研究许可,仅限研究用途,商业自托管需另行获得授权。Qwen 未公布 Turbo 的显存最低要求;报道中引用的 11 GB(GGUF)与 24 GB(INT8/FP8)为 Unsloth 对基础模型的估算,并非官方数据。此外,目前尚无 Turbo 专属基准成绩,报道中提到的 Qwen-Image-Bench 60.28 分属于基础模型 Qwen-Image-2.1,且为厂商自报数值。运行环境要求从源码安装 Diffusers、transformers>=5.17.0,并依赖尚未合并的 Diffusers PR #14950;仅设置 num_inference_steps 不会覆盖已保存的采样计划,需显式传入 sigmas,且其他调度方案据称未经测试。

本文信息来自 MarkTechPost 报道,相关规格与许可细节以 Qwen 官方模型卡与官网当前信息为准。