快讯
阿里开源 Qwen-Image-2.1:70 亿参数图像模型据称超越闭源对手
阿里 Qwen 团队发布开源权重模型 Qwen-Image-2.1,其视觉生成部分仅 70 亿参数,团队称在自建基准上超过多数闭源模型,但独立评测尚未出炉。模型支持透明图层生成与编辑,可同时处理最多十张参考图,研究许可禁止商用。
阿里发布开源权重图像模型 Qwen-Image-2.1
据 the-decoder.com 报道,阿里巴巴 Qwen AI 团队发布了用于图像生成与编辑的开源权重模型 Qwen-Image-2.1。团队称,其视觉生成部分仅有 70 亿参数,却在 Qwen 自建的基准测试上超过多数闭源模型。报道同时指出,独立第三方基准测试结果尚未公布,上述性能说法尚未获官方之外的确认。
功能与获取方式
据素材描述,该模型可原生生成和编辑透明图像(RGBA),便于用户隔离对象或修改透明图层上的文字;一次最多可处理十张参考图,用于合影、虚拟试穿或房间设计等场景,并可通过圆圈、蒙版或手绘标记引导局部编辑。Qwen 表示,架构调整与 KV 缓存复用提升了推理速度,在涉及多张参考图时尤为明显。模型已在 Hugging Face、GitHub 和 Model Scope 上线,并提供 Hugging Face 演示。
限制与来源
素材提到,该模型可在 3090 等消费级 GPU 上运行,但这一表述来自 Qwen 方面,实际硬件需求与运行效果可能因配置而异。其研究许可禁止商业使用,商业用户需另行向 Qwen 申请许可。关于参数规模、功能支持、许可条款与可用地区,均请以 Qwen 官网及各平台当前公布的信息为准。本文信息源自 the-decoder.com 的报道,未做独立验证。