阿里开源了全新图像模型 Qwen-Image-Layered,能实现类似 Photoshop 的图层级图像编辑功能。
阿里开源的全新图像生成模型 Qwen-Image-Layered 代表了在图像处理和生成领域的一项重大进步。该模型首次实现了对图像进行类似 Photoshop 的图层理解和编辑,使得 AI 图像编辑更加精准、灵活。通过采用自研架构,Qwen-Image-Layered 能够将图片“拆解”为多个图层,并实现几乎“零漂移”的精确编辑,解决了传统 AI 图像生成中的一致性难题。
这种能力得益于千问团队引入的 RGBA-VAE 编码技术,在 RGB 图像基础上增加了 Alpha 通道来表示透明度图层,以及创新的 VLD-MMDiT 架构和图层级 3D 位置编码。这些技术共同作用,让模型能够自动补全被遮挡部分的背景纹理,从而获得更深层次的空间理解能力。为了训练这一能力,开发团队还利用了海量的专业 PSD 文件中的真实图层逻辑,使模型具备了专业设计师般的分层思维。
Qwen-Image-Layered 的推出对于创意产业具有重要意义,它不仅提升了数字内容创作的效率,也为广告设计、UI 界面设计、影视后期处理等专业领域带来了革新性的变化。此外,该模型已经在魔搭社区和 HuggingFace 开源,开发者和企业可以免费下载使用。
阿里在全球范围内开源了近400个千问模型,全球下载量已突破7亿次,衍生模型数量超过18万个,展示了其在大模型领域的领先地位。通义大模型服务也已覆盖超过100万客户,成为中国企业级市场中最受欢迎的大模型之一。这表明阿里在推动 AI 技术的发展及其应用方面走在了前列。






