【通义千问图像大模型2.1版本正式开源:轻量化设计性能出众,实现创作编辑功能融合】 来自千问大模型官方消息,其于近期正式开源Qwen-Image-2.1,这款全新图像大模型在生成效果、推理运行效率和使用成本三者间实现了极...
【通义千问图像大模型2.1版本正式开源:轻量化设计性能出众,实现创作编辑功能融合】 来自千问大模型官方消息,其于近期正式开源Qwen-Image-2.1,这款全新图像大模型在生成效果、推理运行效率和使用成本三者间实现了极佳平衡。Qwen-Image-2.1把文生图功能和图像编辑能力整合到同一模型架构内,视觉生成模块仅拥有70亿参数,还能够原生支持透明图像的生成与编辑操作。 本次更新迭代的模型核心亮点主要体现在四个方面: 1. 小参数模型效果强劲,性价比突出:依托轻量化的模型架构设计和推理环节的深度优化,在图像生成质量和算力消耗成本之间找到了最优平衡点,使用门槛大幅降低。 2. 原生支持透明通道,创作修改一体化:可根据用户输入的提示词生成常规图像或者带透明背景的图像,同时还支持透明图层的编辑操作以及智能抠图功能,满足多元设计需求。 3. 全场景编辑能力完善,多区域细节保留:最高支持同时导入10张参考图,局部编辑效果、人像与商品图的还原保真能力显著增强,能够覆盖绝大部分日常图像编辑任务场景。 4. 生成质感更趋真实,文字美观人物自然:针对文字排版效果、人物光影呈现以及细节纹理表现做了专项优化,最终生成的内容视觉美感大幅提升,更符合实际使用需求。
编辑回复