阿里云今天宣布旗下视觉生成基座模型万相 2.1(Wan)开源。
此次开源采用最宽松的 Apache2.0 协议,14B 和 1.3B 两个参数规格的全部推理代码和权重全部开源,同时支持文生视频和图生视频任务,全球开发者都可在 Github、HuggingFace 和魔搭社区下载体验。

14B 万相模型在指令遵循、复杂运动生成、物理建模、文字视频生成等方面表现突出,在评测集 VBench 中,万相 2.1 以总分 86.22% 的成绩超越 Sora、Luma、Pika 等国内外模型,位列榜首。
1.3B 版本测试结果不仅超过了更大尺寸的开源模型,甚至还接近部分闭源模型,同时能在消费级显卡运行,据称“仅需 8.2GB 显存就可以生成 480P 视频”,给广大业内外人士提供了非常好的开发和使用工具。

开源地址:
Github:https://github.com/Wan-Video
HuggingFace:https://huggingface.co/Wan-AI