告别AI标准脸!阿里Wan2.7-Image发布:能写A4纸论文,还能像素级“捏脸”
Wan2.7-Image:骨相捏脸、3K token印刷、9图一致性全上了
阿里今天直接上线了Wan2.7-Image模型,有开发者试了说它彻底终结了AI生图的“标准脸”问题,能从骨相、眼眸到五官细微处精确控制。
告别AI脸
- Wan2.7-Image显著强化了虚拟角色捏脸功能。有用户测试发现,可以从骨相、眼眸到五官细微处进行全方位定制,精确控制鹅蛋脸、丹凤眼、深邃眼窝等具体特征。
- 体验者反馈,这一进步彻底终结了以往AI生成人像千篇一律的机械感,实现了真正的个性化表达。群里在传之前AI生图那种雷同脸的问题被直接干掉了。
调色盘与印刷级文字
- 在艺术表现力方面,模型全新支持**“调色盘”功能**。体验者说只要一键提取参考图的色调占比(比如马蒂斯的红色系或梵高的黄色系),就能精准迁移到新作品上。
- 另外,Wan2.7-Image在长文本渲染上表现惊人,支持最高3K token输入(约3000个字符,相当于打印一整页A4纸的复杂公式、表格),达到印刷级质量,并且支持12种语言(覆盖主流语种)。有测试者直接把满页数学公式丢进去,输出看起来跟打印出来没差别。
交互式编辑与多主体一致性
- 模型具备强大的交互式编辑能力。开发者试了后表示,通过精确框选就能实现元素的对齐、移动或替换——比如框选图中人物互换位置,或者把冰块替换成水果,实现“指哪改哪”的像素级操控。
- 同时,模型最多支持9图多主体一致性。群里在传生成AI女团或家具组合时,能完美保持风格与特征的统一,不会出现一人一画风的情况。
底层与赋能
- Wan2.7-Image采用生成与理解统一架构,在共享隐空间(Latent Space)实现语义映射。有技术博主分析,这意味着模型不再靠猜文字来拟合像素,而是具备了底层语义认知。
- 目前该模型已同步上线Wan2.7-Image-pro版本,提供更稳定的构图与精准理解。
- 该模型现已广泛应用于短剧制作(一人分饰多角)、电商广告(模特图一生多)、教育研究及社交娱乐等领域。
如何体验
用户可通过阿里云百炼平台调用API,或前往万相官网直接体验。地址: https://tongyi.aliyun.com/wan
百炼国内站: https://bailian.console.aliyun.com/cn-beijing?tab=api#/api/?type=model&url=3026980
百炼国际站: https://modelstudio.console.alibabacloud.com/ap-southeast-1?tab=api#/api/?type=model&url=3026980
接下来就看Midjourney、Stable Diffusion这些模型怎么跟上,毕竟长文本渲染和个性化捏脸这块,阿里直接甩了张硬底牌出来。
来源: aibase阅读原文