阿里千问开源Qwen-Image-2.1:7B参数全能图像模型,原生支持透明图生成与编辑
SmartHey9月20日消息,阿里千问今日正式开源其最新图像生成模型——Qwen-Image-2.1。该模型是当前兼顾生成质量、推理效率与部署成本的高性能开源图像模型。
Qwen-Image-2.1创新性地将文生图(Text-to-Image)与图像编辑(Image Editing)能力统一于单一大模型架构中;其视觉生成主干仅含70亿参数,却原生支持Alpha通道,可直接生成及编辑带透明背景的图像,无需额外后处理。

据官方介绍,本次发布的Qwen-Image-2.1具备四大核心优势:
小模强效,极致性价比:采用精简模型结构与深度推理优化,在有限算力下仍保持高保真生成效果,显著降低训练与推理成本。
原生透明,创改一体:支持根据自然语言提示直接输出PNG格式透明图像,并内置透明图层编辑能力,实现精准抠图、图层叠加与Alpha域微调。
全能编辑,多图协同:最多可同时参考10张输入图像,大幅提升局部重绘、人像细节保留、商品纹理还原等复杂编辑任务的准确性与一致性。
真实质感,美学升级:全面优化文字渲染清晰度、人物光影层次与材质细节表现,使生成图像在排版规范性、人物神态自然度及整体艺术感上更趋专业级水准。

