【软盟资讯 · 7×24快讯】 8月29日消息,阿里云正式发布并开源全新多模态视频生成模型通义万相Wan2.2-S2V。该模型极大简化视频制作流程,仅需提供一张静态图片和一段音频,即可生成面部表情自然、口型与音频高度一致、肢体动作流畅的电影级数字人视频。模型支持分钟级长视频稳定生成,手势、表情、姿态皆可联动,并具备跨域泛化能力,可自然驱动卡通人物、动物形象、二次元角色及艺术风格化人像。其提供480P与720P两档分辨率,兼顾效率与画质,适用于短视频、数字人、轻量影视等场景。(来源:快科技、阿里云)
【软盟观察】 Wan2.2-S2V的”一张图+一段音频即可生成动态数字人”,把AI视频创作的门槛降到了前所未有的低度。当萌宠说话、动漫角色唱歌都能实现精准音画同步,数字人内容生产正从”专业团队专属”走向”人人可用”。这也再次印证了中国AI在开源生态上的策略——高频开源、以生态占领应用场景。随着音视频大模型持续迭代,AI正从”文字创作”加速迈向”多模态内容生产”,这将是内容产业下一轮变革的催化剂。