阿里AI开源即体验！全面接入通义APP，首创电影级美学控制系统

7月28日晚，阿里AI“四连发”再落一子，电影级视频生成模型通义万相Wan2.2正式开源，并全面接入通义APP。手机用户只需在通义APP中输入文本或图片，即可化身“AI导演”，借助Wan2.2首创的美学控制系统，生成具备电影级质感的1080P高清视频。目前，用户单次可生成5秒视频，并可通过多轮提示词进一步完成短剧制作。未来，通义万相还将继续提升单次视频生成的时长，让视频创作更高效。

据介绍，Wan2.2首创的美学控制系统，直接将光影、色彩、镜头语言三大电影美学元素装进模型，可以随意组合60多个直观可控的参数，在构图、微表情、复杂调度等能力上媲美专业电影水平。例如，用户输入“黄昏”“柔光”“边缘光”“暖色调”“中心构图”等关键词，模型可自动生成落日余晖的浪漫画面；使用“冷色调”“硬光”“平衡构图”“低角度”的组合，则可以生成接近科幻片的画面效果。同时，Wan2.2还支持智能美学词响应、智能参数联动，用户只需简单描述，模型即可解析创作意图，并自动协调相关参数，大幅提升生成效率。

此外，Wan2.2在人物面部表情、多人交互、复杂运动等维度上也实现了显著提升。例如，模型不仅能生成“大笑”“惊恐”等经典情绪，还能更细腻地刻画“思考时不经意的挑眉”“强忍泪水时的嘴唇颤抖”等精细微表情，增强画面的情绪表现力。Wan2.2还深度优化了对力学、光学、流体力学等物理规律的模拟，可精准还原物体碰撞、光影折射、流体流动等真实动态，显著提升了视频生成的真实感与可控性。

案例1-输入提示词：视频展示了一位三十多岁的黑人女性在黄昏色调的复古滤镜下，平静地坐在行驶中的地铁车厢内。周围人群来回走动，形成明显的运动模糊，而她始终保持清晰，象征着混乱中的静止。柔和的光线与电影画质营造出喜怒无常的环境氛围，突显她在喧嚣世界中的沉稳与内敛，呈现出强烈的现实主义风格。通义万相Wan2.2即可精准理解提示词中的美学词，并生成一段复古且富有文艺感的视频。

案例2-输入提示词：白天，晴天光，边缘光，暖色调，低饱和度，极端全景，平衡构图，画面中有两名穿着宇航服的人，他们正站在一片广阔的水域中。他们都穿着白色为主、带有深色拼接和标记的厚重宇航服，并头戴配有面罩的头盔。位于前方的人正朝着观看者的方向涉水前行，水面淹及他的大腿，他的面部表情严肃。另一人站在他身后稍远的位置，同样身处水中。在他们身后，一艘外形具有未来感的飞行器停泊在水面上。这艘飞行器有着扁平、宽大的机翼和棱角分明的设计。整个场景的背景是布满云彩的天空和无边无际的水面。通义万相Wan2.2可生成一段复刻电影《星际穿越》中宇航员在米勒星球的经典画面。

Wan2.2此次开源的文生视频模型和图生视频模型均为业界首个使用MoE架构的视频生成模型，总参数量为27B，激活参数14B，均由高噪声专家模型和低噪专家模型组成，分别负责视频的整体布局和细节完善，在同等参数规模下，计算资源消耗降低约50%，有效缓解了视频生成处理Token过长带来的算力压力，可进一步提升生成效率和用户体验。

自今年2月以来，通义万相已连续开源文生视频、图生视频、首尾帧生视频和全能编辑等多款模型，相关功能均可在通义APP直接体验。

（责任编辑：何欣）