Alibaba’s new open-source AI model turns photos into film-quality clips | 阿里巴巴新开源AI模型将照片转化为电影级片段
阿里巴巴集团旗下的AI与云计算部门近日发布了Wan2.2-S2V模型,这是其最新的开源人工智能模型,能够根据静态图片和音频片段生成具有电影品质的富有表现力的角色视频。该模型是阿里云Wan2.2系列的一部分,采用了“专家混合(MoE)”架构,成为行业内首个包含此技术的大型视频生成模型。Wan2.2-S2V利用先进的音频驱动动画技术,能够呈现逼真的角色表现,包括自然对话和音乐表演,还能在场景中无缝处理多个角色。
阿里云表示,Wan2.2-S2V可以帮助专业内容创作者实现更精准的视觉表现,满足特定的故事讲述和设计需求。这一模型得益于其庞大的视听数据集,专为影视制作场景优化。该模型现已在Hugging Face、GitHub和阿里云的ModelScope开源社区提供下载,体现了中国AI公司通过开源策略不断缩小与国际同行的差距,推动行业创新发展。
via SCMP Full Text Feed
阿里巴巴集团旗下的AI与云计算部门近日发布了Wan2.2-S2V模型,这是其最新的开源人工智能模型,能够根据静态图片和音频片段生成具有电影品质的富有表现力的角色视频。该模型是阿里云Wan2.2系列的一部分,采用了“专家混合(MoE)”架构,成为行业内首个包含此技术的大型视频生成模型。Wan2.2-S2V利用先进的音频驱动动画技术,能够呈现逼真的角色表现,包括自然对话和音乐表演,还能在场景中无缝处理多个角色。
阿里云表示,Wan2.2-S2V可以帮助专业内容创作者实现更精准的视觉表现,满足特定的故事讲述和设计需求。这一模型得益于其庞大的视听数据集,专为影视制作场景优化。该模型现已在Hugging Face、GitHub和阿里云的ModelScope开源社区提供下载,体现了中国AI公司通过开源策略不断缩小与国际同行的差距,推动行业创新发展。
via SCMP Full Text Feed