阿里推出开放式图像生成模型Qwen-Image-2.1,挑战闭源解决方案
阿里巴巴的Qwen团队推出了名为Qwen-Image-2.1的新模型,具有开放权重,专注于图像生成与编辑。该模型的亮点在于其拥有70亿参数,并声称在图像生成的表现上超越了许多闭源模型。这样的参数规模意味着,模型能够在强大的消费级GPU上运行,普通开发者的显卡便能完成任务,无需复杂的硬件设施。
Qwen-Image-2.1不仅支持文字生成图像,亦具备图像编辑功能,具有两项显著的能力:其一是支持处理透明度,另一是可以同时接收多达十张参考图。这个十张参考图的上限值得关注,因为多图输入通常用于风格迁移、角色一致性及多素材融合等应用,输入的图像数量直接影响到模型的上下文理解能力,而十张则提供了相对充裕的选择空间。
尽管模型开源,但使用上存在一定限制。Qwen-Image-2.1采用研究许可证,明确禁止用于商业目的。若想将其用于商业产品,用户需单独申请商业许可证。这一限制明确了目标用户:研究者和个人开发者可自由体验其功能,而企业用户需要遵循授权程序。虽然开放权重降低了试用成本,但并没有放宽商用的要求。 龙8国际登录
结合70亿参数、适用于消费级GPU的特性以及多图输入和编辑能力,这一模型的推出旨在将图像生成技术从云端服务带回到本地设备上。至于其在实际评测中是否真的超越闭源模型,仍待独立评估的结果来验证。
博阿斯谈波尔图当主席的感受及教练生涯的选择
篮球教会你如何团队协作,如何在挑战中找到自己!...