简短新闻
复制链接到剪贴板
分享本文
前往评论区
阿里巴巴开源权重的Qwen-Image-2.1声称仅凭70亿参数即可在图像生成方面超越闭源模型
马蒂亚斯·巴斯蒂安
查看马蒂亚斯·巴斯蒂安的LinkedIn个人资料
2026年9月20日
阿里巴巴的Qwen AI团队发布了Qwen-Image-2.1,这是一个用于图像生成和编辑的开源权重模型。该团队声称,其视觉生成组件仅拥有70亿参数,却在Qwen自己的基准测试中击败了大多数闭源模型,尽管独立的基准测试结果仍在等待中。它可以在强大的消费级GPU(如RTX 3090)上运行。
Qwen表示,这张集体照是由每个人的个人照片拼接而成的。| 图片来源:阿里巴巴 / Qwen
该模型原生支持生成和编辑透明图像(RGBA),使用户能够隔离对象或在透明图层上更改文本。它一次可处理多达十张参考图像,适用于集体照、虚拟试穿或室内设计,而圆圈、蒙版或绘制的标记则用于引导局部编辑。Qwen表示,架构的改变以及KV缓存的复用加速了推理过程,尤其是在使用多张参考图像时。
Qwen-Image-2.1已在Hugging Face、GitHub和Model Scope上提供,并配有Hugging Face演示版本。其研究许可证禁止商业用途,因此企业用户必须向Qwen申请单独的许可证。
广告
没有炒作的人工智能新闻——由人工策划
订阅THE DECODER,享受无广告阅读、每周AI通讯、每年六次的独家“AI雷达”前沿报告、完整档案访问权限以及评论区的访问权。
立即订阅
来源:Qwen
关于本文提问...
搜索