阿里开源Qwen-Image-2.1:7B参数支持透明图与10图参考
AI摘要
由 AI 生成 · 仅供参考
阿里千问今日开源图像模型Qwen-Image-2.1,该模型整合文生图与编辑功能,视觉生成部分仅7B参数,原生支持透明图像生成与编辑,并允许最多10张参考图输入,旨在平衡生成质量与计算成本。
驱动中国9月20日消息,阿里千问正式开源Qwen-Image-2.1图像模型。作为千问图像系列的新成员,该模型在生成效果、推理效率与使用成本之间寻求平衡,将文生图与图像编辑功能整合于同一架构中。
Qwen-Image-2.1的视觉生成部分参数规模为7B。通过轻量的模型结构与推理优化,该模型在保持生成质量的同时降低了计算成本。其核心特性之一是原生支持透明图像的生成与编辑,用户可根据提示词生成普通图像或透明图像,并支持对透明图层进行编辑与抠图操作。
在编辑能力方面,Qwen-Image-2.1支持最多10张参考图输入。这一功能增强了局部编辑效果,提升了人像与商品的保真度,并覆盖多种编辑任务场景。此外,模型在文字排版、人物光影及细节表现上进行了优化,旨在提升生成结果的整体美感。
目前,该模型已在GitHub、HuggingFace及ModelScope平台上线,开发者可通过上述渠道获取模型权重及相关资源。
版权声明:本文由驱动中国整理发布,转载需注明出处与原文链接。如有疑问请联系
editor@qudong.com。
本文价值
★★★★★
3.7
3 人已评
登录后为本文打分
评论加载中…