东苑 发表于 2025-7-29 09:07

阿里巴巴开源视频生成模型通义万相 Wan2.2,首创电影美学控制系统

阿里开源视频生成模型「通义万相 Wan2.2」,此次共开源文生视频(Wan2.2-T2V-A14B)、图生视频(Wan2.2-I2V-A14B)和统一视频生成(Wan2.2-IT2V-5B)三款模型,其中文生视频模型和图生视频模型均为业界首个使用 MoE 架构的视频生成模型,总参数量为 27B,激活参数 14B;同时,首创电影美学控制系统,光影、色彩、构图、微表情等能力媲美专业电影水平。

开发者可在 GitHub、HuggingFace、魔搭社区下载模型和代码,企业可在阿里云百炼调用模型 API,用户还可在通义万相官网和通义 App 直接体验。



据官方介绍,通义万相 2.2 率先在视频生成扩散模型中引入 MoE 架构,有效解决视频生成处理 Token 过长导致的计算资源消耗大问题。Wan2.2-T2V-A14B、Wan2.2-I2V-A14B 两款模型均由高噪声专家模型和低噪专家模型组成,分别负责视频的整体布局和细节完善,在同参数规模下,可节省约 50% 的计算资源消耗,在模型能力上,通义万相 2.2 在复杂运动生成、人物交互、美学表达、复杂运动等维度上也取得了显著提升。



Wan2.2 还首创了「电影美学控制系统」,光影、色彩、构图、微表情等能力媲美专业电影水平。例如,用户输入「黄昏」、「柔光」、「边缘光」、「暖色调」「中心构图」等关键词,模型可自动生成金色的落日余晖的浪漫画面;使用「冷色调」、「硬光」、「平衡图」、「低角度」的组合,则可以生成接近科幻片的画面效果。

com2 发表于 2025-7-29 09:53

谢谢楼主分享!

billy211 发表于 2025-7-29 09:55

{:6_220:}{:6_220:}

yzszh64 发表于 2025-7-29 10:22

谢谢分享。

wing6 发表于 2025-7-29 10:35

看看新闻

yjwxxxy 发表于 2025-7-29 12:49

支持,非常给力![喝彩]
页: [1]
查看完整版本: 阿里巴巴开源视频生成模型通义万相 Wan2.2,首创电影美学控制系统