通义千问开源 Qwen-Image-2.1:7B 小模型实现文生图、透明图与重编辑一体化
2026/09/21 10:28阅读量 3
通义千问团队开源了 Qwen-Image-2.1 模型,这是一个参数量仅为 7B 的小型图像生成模型。该模型集成了文本生成图像、透明背景生成以及图像重编辑等多种功能于一体,旨在提供轻量级且高效的图像处理解决方案。
事件概述
通义千问(Qwen)团队正式开源了 Qwen-Image-2.1 模型。这是一款参数量仅为 70 亿(7B)的小型多模态图像模型,其核心特点在于将多种图像生成与处理能力整合在一个统一的架构中。
核心信息
- 模型规模:7B 参数,属于小型模型范畴,相较于大型基座模型具有更低的部署门槛和资源消耗。
- 功能集成:
- 文生图(Text-to-Image):支持根据文本描述直接生成高质量图像。
- 透明图生成:具备生成带有透明背景图像的能力,便于后续设计或合成使用。
- 重编辑(Re-editing):支持对已有图像进行局部修改或风格调整等重编辑操作。
- 技术定位:通过“全合一”的设计,Qwen-Image-2.1 试图在保持模型轻量化的同时,覆盖用户从生成到后期处理的主要需求场景。
值得关注
Qwen-Image-2.1 的开源标志着在垂直领域轻量化图像模型上的进一步探索。对于需要快速部署、资源受限或对隐私有较高要求的开发者而言,这种多功能集成的小模型提供了比调用大型 API 更灵活的选择。
