阿里万相2.6重磅发布:国内首个支持角色扮演的全能视频生成模型登场

12.16 作为国内首个集成角色扮演能力的视频生成模型,万相2.6不仅支持基于文本或音频驱动的视频创作,还能在15秒内生成包含多镜头多角色音画同步的连贯叙事内容,被官方称为当前全球功能最全面的视频生成模型

阿里近日正式推出其多模态生成模型“通义万相2.6”,标志着其在AI视频与图像生成领域的又一次重大跃迁。作为国内首个集成角色扮演能力的视频生成模型,万相2.6不仅支持基于文本或音频驱动的视频创作,还能在15秒内生成包含多镜头、多角色、音画同步的连贯叙事内容,被官方称为“当前全球功能最全面的视频生成模型”。


2025-12-16_141033_660

 

相较于前代版本,万相2.6在影视级内容生成方面实现了显著突破。其“角色扮演”功能可复现输入视频中人物的外观与音色,并依提示生成人与人、人与物乃至多人互动的动态场景。更引人注目的是“多镜头叙事”能力:用户只需提供简短提示,模型即可自动生成具有逻辑连贯性的分镜脚本,并在不同镜头间保持角色与场景的一致性。

 

在图像生成方面,万相2.6同样展现出商用级别的精细控制力。新模型强化了对艺术风格的理解与融合能力,能精准还原肌理、笔触与色彩等美学要素,并支持从一张参考图中迁移构图、光影乃至整体视觉语言。同时,写实人像生成效果大幅优化,人物神态自然、肤质逼真,显著削弱了传统AI图像中的“塑料感”。

 

此外,万相2.6还推出了图文混排、多图融合及美学要素迁移等创新功能,特别适用于海报设计、信息图表与插画创作等专业场景。模型现已同步上线阿里云百炼平台与万相官网,面向开发者与内容创作者开放使用。

 

随着生成式AI从“能用”迈向“好用”乃至“专业可用”,万相2.6的发布不仅体现了阿里在AIGC赛道的技术积累,也为影视、广告、游戏等视觉密集型行业提供了全新的创作基础设施。