← 返回 2026-09-21 简报

阿里开源的Qwen-Image-2.1声称仅凭70亿参数即可在图像生成领域超越闭源模型

语音播报
摘要
事件:阿里Qwen团队发布开源图像生成模型Qwen-Image-2.1,声称其仅凭70亿参数即可在自建基准测试中超越多数闭源竞品。 要点:模型原生支持RGBA透明图像生成与编辑,可单次处理多达十张参考图进行人像合成或虚拟试穿。 影响:该模型可在RTX 3090等消费级显卡运行,降低部署门槛,但研究许可限制商用,企业需单独申请授权。

简短新闻
复制链接到剪贴板
分享本文
前往评论区
阿里巴巴开源权重的Qwen-Image-2.1声称仅凭70亿参数即可在图像生成方面超越闭源模型
马蒂亚斯·巴斯蒂安
查看马蒂亚斯·巴斯蒂安的LinkedIn个人资料
2026年9月20日

阿里巴巴的Qwen AI团队发布了Qwen-Image-2.1,这是一个用于图像生成和编辑的开源权重模型。该团队声称,其视觉生成组件仅拥有70亿参数,却在Qwen自己的基准测试中击败了大多数闭源模型,尽管独立的基准测试结果仍在等待中。它可以在强大的消费级GPU(如RTX 3090)上运行。

Qwen表示,这张集体照是由每个人的个人照片拼接而成的。| 图片来源:阿里巴巴 / Qwen

该模型原生支持生成和编辑透明图像(RGBA),使用户能够隔离对象或在透明图层上更改文本。它一次可处理多达十张参考图像,适用于集体照、虚拟试穿或室内设计,而圆圈、蒙版或绘制的标记则用于引导局部编辑。Qwen表示,架构的改变以及KV缓存的复用加速了推理过程,尤其是在使用多张参考图像时。

Qwen-Image-2.1已在Hugging Face、GitHub和Model Scope上提供,并配有Hugging Face演示版本。其研究许可证禁止商业用途,因此企业用户必须向Qwen申请单独的许可证。

广告

没有炒作的人工智能新闻——由人工策划

订阅THE DECODER,享受无广告阅读、每周AI通讯、每年六次的独家“AI雷达”前沿报告、完整档案访问权限以及评论区的访问权。

立即订阅
来源:Qwen
关于本文提问...
搜索

← 返回简报