
7月28日晚,阿里开源电影级视频生成模型通义万相Wan2.2。据介绍,Wan2.2直接将光影、色彩、镜头语言三大电影美学元素装进模型,可以随意组合60多个直观可控的参数,大幅提升电影级画面的制作效率。
通义万相官方展示了《星际穿越》、《布达佩斯大饭店》、《海上钢琴师》等电影的经典画面,目前该模型单次可生成5s的高清视频,用户可通过多轮提示词进一步完成短剧制作,未来通义万相还将继续提升单次视频生成的时长,让视频创作更高效。
据介绍,Wan2.2此次共开源文生视频(Wan2.2-T2V-A14B)、图生视频(Wan2.2-I2V-A14B)和统一视频生成(Wan2.2-TI2V-5B)三款模型,其中文生视频模型和图生视频模型均为业界首个使用MoE架构的视频生成模型,总参数量为27B,激活参数14B,均由高噪声专家模型和低噪专家模型组成,分别负责视频的整体布局和细节完善,在同参数规模下,可节省约50%的计算资源消耗,有效解决视频生成处理Token过长导致的计算资源消耗大问题,同时在复杂运动生成、人物交互、美学表达、复杂运动等维度上也取得了显著提升。
通义万相还开源了一款5B小尺寸的统一视频生成模型,单一模型同时支持文生视频和图生视频,可在消费级显卡部署。该模型采用了高压缩率3D VAE架构,时间与空间压缩比达到高达 4×16×16,信息压缩率提升至 64,均实现了开源模型的最高水平,仅需22G显存(单张消费级显卡)即可在数分钟内生成5秒高清视频,是目前24帧每秒、720P像素级视频生成速度最快的基础模型之一。
即日起,开发者可在GitHub、HuggingFace、魔搭社区下载模型和代码,企业可在阿里云百炼调用模型API,用户还可在通义万相官网和通义APP直接体验。
自今年2月以来,通义万相已连续开源文生视频、图生视频、首尾帧生视频和全能编辑等多款模型,在开源社区的下载量已超500万,是开源社区最受欢迎的视频生成模型之一。
猜你喜欢





派拉蒙喊话好莱坞:不要被 AI 吓倒,电...
IT之家 8 月 8 日消息,据《商业内幕》今日报道,新成立的派拉蒙 Skydance 联合公司的掌门人大卫・埃里森向整个好莱坞传达了一个明确的信号 —— 不要...
READ MORE最新发布
-
女子在景区摸马肚子被狠咬一口
综合新闻, 2025-08-08 -
女子在景区摸马肚子被狠咬一口
综合新闻, 2025-08-08 -
女子在景区摸马肚子被狠咬一口
综合新闻, 2025-08-08 -
官宣:HEROIC将下放gr1ks,租借Alkaren
综合新闻, 2025-08-08 -
派拉蒙喊话好莱坞:不要被 AI 吓倒,电影业要积极拥抱它
综合新闻, 2025-08-08
热门
-
女子在景区摸马肚子被狠咬一口
- 作者
- 2025-08-08
-
女子在景区摸马肚子被狠咬一口
- 作者
- 2025-08-08
-
女子在景区摸马肚子被狠咬一口
- 作者
- 2025-08-08
-
官宣:HEROIC将下放gr1ks,租借...
- 作者
- 2025-08-08
-
派拉蒙喊话好莱坞:不要被 AI 吓倒,电...
- 作者
- 2025-08-08
-
女子在景区摸马肚子被狠咬一口
- 作者
- 2025-08-08
-
女子在景区摸马肚子被狠咬一口
- 作者
- 2025-08-08
-
女子在景区摸马肚子被狠咬一口
- 作者
- 2025-08-08
-
官宣:HEROIC将下放gr1ks,租借...
- 作者
- 2025-08-08
-
派拉蒙喊话好莱坞:不要被 AI 吓倒,电...
- 作者
- 2025-08-08