通义千问图像Turbo
4 ステップ1 件4 ソース
阿里通义千问团队于2026年10月9日正式发布并开源了Qwen-Image-2.1-Turbo模型,该模型将图像生成与编辑的推理步数从40步大幅压缩至8步,同时降低了托管成本。
此前在2026年9月20日,阿里发布了7B参数的Qwen-Image-2.1基础模型,支持文本生成图像及多参考图编辑。随后,第三方AI视频团队Viggle于9月23日至25日期间推出了基于DMD蒸馏技术的“Viggle Turbo”LoRA适配器,实现了4至6步的快速生成,但指出其在复杂多参考图编辑中存在身份漂移问题。针对这一需求,阿里官方推出的Qwen-Image-2.1-Turbo checkpoint保留了相同的7B架构,通过优化采样调度器实现8步生成,并在阿里云Model Studio同步上线了Pro和Turbo API。
这一进展意味着开发者无需依赖第三方非官方补丁即可获得低延迟体验。目前的主要分歧在于:官方Turbo版本虽速度提升显著,但其基准测试数据尚未完全公开,而社区版Viggle Turbo虽速度快但被证实存在编辑质量下降的问题。对于商业用户而言,需注意Qwen Research License对自部署的限制,使用官方API则需支付相应费用(Turbo约0.1元/张)。
后续需关注:1. Qwen-Image-Bench上关于Turbo版本的独立评分是否公布;2. 社区对官方8步版本在复杂编辑场景下的实际反馈对比Viggle版本的表现。
経緯
阿里发布Qwen-Image-2.1基础模型,支持40步生成及多参考图编辑,Diffusers等框架Day-0支持。
raw.githubusercontent.com ↗Viggle团队发布Qwen-Image-2.1-viggle-turbo v0.1/v0.2,通过DMD蒸馏实现4-5步生成,但存在多样性损失。
comfyui-wiki.com ↗Viggle更新v0.2.1版本,优化至6步生成,改善构图漂移,但仍建议小字渲染使用更多步数。
artrealmai.com ↗阿里正式发布Qwen-Image-2.1-Turbo,实现8步生成,并上线阿里云Model Studio Pro/Turbo API。
marktechpost.com ↗
未解決の問題
- Qwen-Image-2.1-Turbo在Qwen-Image-Bench上的具体得分是多少?