轻量化+全开源:腾讯推 HunyuanVideo 1.5,14G显存即可部署AI视频生成

11.21 HunyuanVideo1.5不仅开源模型权重,还同步开放推理代码,成为目前主流开源视频生成模型中少有的全公开方案,大幅降低开发者和创作者的使用门槛

今日,腾讯混元大模型团队正式开源其新一代视频生成模型 HunyuanVideo 1.5,并同步在“元宝”平台上线相关功能。该模型基于 Diffusion Transformer(DiT)架构,参数规模为8.3B,定位为轻量级但高性能的AI视频生成工具,支持5至10秒高清视频内容的自动生成。


2025-11-21_145258_706

 

与当前多数闭源视频模型不同,HunyuanVideo 1.5 不仅开源模型权重,还同步开放推理代码,成为目前主流开源视频生成模型中少有的“全公开”方案,大幅降低开发者和创作者的使用门槛。

 

该模型支持“文生视频”与“图生视频”双模式,兼容中英文输入。用户只需提供一段文字描述,或上传一张图片配合简短提示,即可快速生成细节丰富、运动自然的短视频。例如,在“手提箱中长出迷你英式花园”等复杂指令下,模型能精准还原主体、光影与动态过程,展现出高度的语义理解与视觉一致性控制能力。

 

技术上,HunyuanVideo 1.5 引入 SSTA 稀疏注意力机制,结合多阶段渐进训练策略,有效提升运动连贯性与指令遵循精度。更引人注目的是,模型对硬件要求极为友好——仅需14GB显存的消费级显卡即可流畅运行,显著优于同类模型动辄需高端GPU的部署条件。

 

目前,该能力已在“元宝”最新版本中上线,用户可通过一句话或一张图直接生成视频,涵盖写实、动画等多种风格,并支持在视频画面中嵌入中英文文本,进一步拓展内容创作边界。

 

随着AI视频生成从实验室走向大众创作,腾讯此举不仅推动了AIGC生态的开源化进程,也为轻量化、高可用的视频AI工具树立了新标杆。


试用:
https://hunyuan.tencent.com/video/zh?tabIndex=0