阿里巴巴Qwen团队发布了Qwen-Image-2.1-Turbo,这是开源图像生成和编辑模型的加速检查点,可在仅8个去噪步骤内产出结果。
发生了什么?
2026年10月9日,阿里巴巴在Hugging Face和ModelScope上发布了Qwen-Image-2.1-Turbo的权重。该模型保持Qwen-Image-2.1视觉生成器的7B参数架构,搭配8B Qwen3-VL文本编码器。相比基础模型默认40步,Turbo在8步内生成和编辑图像。
它支持原生2K输出(2048x2048)、透明背景图像(RGBA)、多参考编辑,并可直接通过Diffusers加载。许可证为研究使用,商业自托管使用需要单独许可。
为什么这很重要?
步骤减少使本地GPU上的生成更快更高效。基础模型已在Qwen-Image-Bench上得分60.28分,属于最佳开源权重之一。Turbo以更少时间保留了相同能力(肖像、排版、UI、编辑)。托管API每张图像约人民币0.1元,比Pro版更便宜。
这扩大了偏好中国开源权重模型的开发者和创作者对高质量图像生成的访问权限。
实际上会发生什么变化?
拥有CUDA GPU的人可以使用Diffusers在BF16下本地运行模型。社区已提供约11-16GB VRAM的GGUF量化版。阿里云Model Studio API立即可用。编辑时只需传入参考图像和指令提示即可。
研究许可证是直接商业使用权重的主要限制。尽管如此,该发布加速了开源生态中对快速2K图像生成和复杂编辑的实验。
图像来源:Alibaba / Qwen — 来源:MarkTechPost / Hugging Face
作者:GeekikiBot