返回新闻列表

告别 AI 标准脸:阿里发布 Wan2.7-Image,开启“千人千面”新时代

文本核心速览
  1. Wan2.7-Image正式发布阿里大模型团队发布图像生成与编辑统一模型Wan2.7-Image,在人像定制、色彩控制和长文本渲染方面实现质的飞跃,旨在打破AI图像的千篇一律感。
  2. 千人千面个性化捏脸用户可通过提示词精准控制骨相、眼形等五官细节,告别标准化AI脸,极大提升人像定制的自由度,实现虚拟角色“捏脸”。
  3. 精准调色盘复刻大师配色模型支持提取参考图颜色占比,精准复刻梵高明黄等大师配色,实现色彩控制的工业化精度,让用户随心调配色调。
  4. 3K Token超长文本渲染支持12种语言,可渲染一页A4纸大小复杂文字、表格或公式,达到印刷级质量,有效解决AI生成文字模糊、变形问题。
  5. 交互式编辑与多主体统一用户可通过框选实现像素级逻辑替换(如冰块变水果),并支持最多12张组图多主体风格统一,大幅降低专业内容生产门槛。

Wan2.7-Image能复刻梵高黄,还能在一页A4纸上印刷3K Token的文字

阿里大模型团队今天在云百炼上架了Wan2.7-Image的API,万相官网也开放了体验。这个模型能让人像定制精确到骨头形状和眼形(杏仁眼、丹凤眼随便选),颜色控制能复刻参考图的色占比,比如梵高的明黄或毕加索的冷蓝,文字渲染支持12种语言,最高能渲染一页A4纸大小的表格或公式,而且不糊。相比前代,它在人像定制化、色彩控制以及长文本渲染方面提速明显——有内测的用户说,这次终于不用对着AI脸和文字鬼画符发愁了。

核心升级

Wan2.7-Image 引入了三项让群里炸锅的功能,直接打破了AI出图的“千篇一律”感:

  • 千人千面:强化了虚拟角色“捏脸”能力。用户通过提示词就能控制骨相、眼形(如杏仁眼、丹凤眼)及五官细节,彻底告别标准化 AI 脸。有设计师试了说有去整容医院面诊的错觉。
  • 精准调色盘:全新支持色彩控制功能。用户可以提取参考图的颜色占比,无论是梵高的明黄还是毕加索的冷蓝,都能精准复刻到新生成的作品中。电商美工试了说终于不用手动调色调半天了。
  • 3K Token 超长文本渲染:解决了 AI 写字的难题,支持多达12种语言,最高可渲染一页 A4纸大小的复杂文字、表格或公式,且达到印刷级质量。有开发者试了说,这相当于让模型能看懂一整页数学试卷还抄得工工整整。

交互式编辑

在图像编辑领域,Wan2.7-Image 推出了“交互式编辑”功能。用户只需通过精准框选,即可在指定区域实现元素的添加、对齐、移动甚至像素级的逻辑替换——比如把冰块替换为水果,同时保持环境光影不变。有视频创作者试了说,这种强度像用PS蒙版但AI自动补全了周围细节。此外,该模型支持多达12张的组图生成,并能确保多主体(如合影、家具组合)在不同画面中的风格与特征高度统一。群里在传这功能最适合短剧分镜,因为主角脸和衣服可以从头到尾不跑偏。

架构与认知

有开发者试了说,Wan2.7-Image 采用了生成与理解统一的模型架构。通过在共享隐空间(Latent Space)实现语义映射,模型不再是盲目地猜测文字对应的像素,而是真正具备了底层语义认知。内测用户反馈,这意味着你告诉它“把冰块换成水果”,它知道冰块是冷的、透明的、硬的,换成水果后要保留环境光影和反射效果,而不是简单贴一张水果贴图。

接下来盯着看它能不能吃掉传统修图师的饭碗——毕竟现在连冰块换水果都能做到光影不变,短剧导演和电商设计师可能是最快受益的,而还在靠“抽卡”出图的AI工具们估计要连夜改架构了。

来源: aibase阅读原文

其他新闻

查看全部