返回新闻列表

告别AI标准脸!阿里Wan2.7-Image发布:能写A4纸论文,还能像素级“捏脸”

文章提及的 AI 工具ima阿里云百炼

Wan2.7-Image:骨相捏脸、3K token印刷、9图一致性全上了

阿里今天直接上线了Wan2.7-Image模型,有开发者试了说它彻底终结了AI生图的“标准脸”问题,能从骨相、眼眸到五官细微处精确控制。

告别AI脸

  • Wan2.7-Image显著强化了虚拟角色捏脸功能。有用户测试发现,可以从骨相、眼眸到五官细微处进行全方位定制,精确控制鹅蛋脸、丹凤眼、深邃眼窝等具体特征。
  • 体验者反馈,这一进步彻底终结了以往AI生成人像千篇一律的机械感,实现了真正的个性化表达。群里在传之前AI生图那种雷同脸的问题被直接干掉了。

调色盘与印刷级文字

  • 在艺术表现力方面,模型全新支持**“调色盘”功能**。体验者说只要一键提取参考图的色调占比(比如马蒂斯的红色系或梵高的黄色系),就能精准迁移到新作品上。
  • 另外,Wan2.7-Image在长文本渲染上表现惊人,支持最高3K token输入(约3000个字符,相当于打印一整页A4纸的复杂公式、表格),达到印刷级质量,并且支持12种语言(覆盖主流语种)。有测试者直接把满页数学公式丢进去,输出看起来跟打印出来没差别。

交互式编辑与多主体一致性

  • 模型具备强大的交互式编辑能力。开发者试了后表示,通过精确框选就能实现元素的对齐、移动或替换——比如框选图中人物互换位置,或者把冰块替换成水果,实现“指哪改哪”的像素级操控。
  • 同时,模型最多支持9图多主体一致性。群里在传生成AI女团或家具组合时,能完美保持风格与特征的统一,不会出现一人一画风的情况。

底层与赋能

  • Wan2.7-Image采用生成与理解统一架构,在共享隐空间(Latent Space)实现语义映射。有技术博主分析,这意味着模型不再靠猜文字来拟合像素,而是具备了底层语义认知。
  • 目前该模型已同步上线Wan2.7-Image-pro版本,提供更稳定的构图与精准理解。
  • 该模型现已广泛应用于短剧制作(一人分饰多角)、电商广告(模特图一生多)、教育研究及社交娱乐等领域。

如何体验

用户可通过阿里云百炼平台调用API,或前往万相官网直接体验。地址: https://tongyi.aliyun.com/wan

百炼国内站: https://bailian.console.aliyun.com/cn-beijing?tab=api#/api/?type=model&url=3026980

百炼国际站: https://modelstudio.console.alibabacloud.com/ap-southeast-1?tab=api#/api/?type=model&url=3026980

接下来就看Midjourney、Stable Diffusion这些模型怎么跟上,毕竟长文本渲染和个性化捏脸这块,阿里直接甩了张硬底牌出来。

来源: aibase阅读原文

其他新闻

查看全部