阿里开源Qwen-Image-2.1:7B参数支持透明图与10图参考

AI 驱动中国 陈默 927次阅读
分享 Q
AI摘要
由 AI 生成 · 仅供参考

阿里千问今日开源图像模型Qwen-Image-2.1,该模型整合文生图与编辑功能,视觉生成部分仅7B参数,原生支持透明图像生成与编辑,并允许最多10张参考图输入,旨在平衡生成质量与计算成本。

驱动中国9月20日消息,阿里千问正式开源Qwen-Image-2.1图像模型。作为千问图像系列的新成员,该模型在生成效果、推理效率与使用成本之间寻求平衡,将文生图与图像编辑功能整合于同一架构中。

Qwen-Image-2.1的视觉生成部分参数规模为7B。通过轻量的模型结构与推理优化,该模型在保持生成质量的同时降低了计算成本。其核心特性之一是原生支持透明图像的生成与编辑,用户可根据提示词生成普通图像或透明图像,并支持对透明图层进行编辑与抠图操作。

在编辑能力方面,Qwen-Image-2.1支持最多10张参考图输入。这一功能增强了局部编辑效果,提升了人像与商品的保真度,并覆盖多种编辑任务场景。此外,模型在文字排版、人物光影及细节表现上进行了优化,旨在提升生成结果的整体美感。

目前,该模型已在GitHub、HuggingFace及ModelScope平台上线,开发者可通过上述渠道获取模型权重及相关资源。

版权声明:本文由驱动中国整理发布,转载需注明出处与原文链接。如有疑问请联系 editor@qudong.com
本文价值 3.5 2 人已评
登录后为本文打分
网友评论0 条评论
正在回复 的评论取消
评论加载中…
🔐

登录后参与互动

评论、点赞均可赚积分
连续签到、邀请好友也有奖励 🎁

电脑端: 微信扫码登录 微信内: 一键登录
我要投稿有独家观点或行业线索?向驱动中国投稿,审核采用后署名发布并获积分奖励。 去投稿 ›

微信扫一扫

打开微信「扫一扫」,分享本文到朋友圈或好友