12月16日,字节跳动旗下 Seed 团队正式发布新一代音视频联合生成模型——Seedance 1.5 Pro。与前代产品 Seedance 1.0 专注于提升动作生成稳定性与视频质量“下限”不同,1.5 Pro 把目光投向了内容创作的“上限”,在视听协同、动态张力与叙事连贯性三大维度上实现跨越式升级。

此次升级的核心在于“音视频原生融合”。Seedance 1.5 Pro 不再是先生成画面再配音的“拼接式”方案,而是从底层模型架构出发,同步生成匹配语音、口型、语调与节奏的音视频内容。这种原生协同能力使生成人物的唇形与语言高度一致,即便在多语种甚至方言场景下,也能精准还原语音韵律与情感张力。
更引人注目的是其电影级运镜能力。模型具备自发的镜头调度逻辑,可完成长镜头跟随、希区柯克式变焦等高难度运镜操作,并实现画面色调、剪辑节奏的专业化控制。这一突破意味着 AI 不再只是“生成画面”,而开始具备“导演思维”,能主动构建具有视觉冲击力的镜头语言。
在语义理解方面,1.5 Pro 强化了对上下文与叙事逻辑的解析能力,使得生成内容在段落衔接、情绪铺排与角色表现上更具整体性。这为短视频、广告片乃至短剧等专业内容生产提供了更可靠的 AI 辅助工具。
据官方表示,该模型在多项关键指标的综合评测中已达到“业界前列”水平。

Seedance 1.5 pro 视频生成能力评测

Seedance 1.5 pro 音频生成能力评测
目前,Seedance 1.5 Pro 已在字节跳动旗下即梦 AI 与豆包 App正式上线。用户可通过豆包选择“照片动起来”功能,上传图像并输入提示词,一键生成带声视频,体验音画同步的创作流程。
从 Seedance 1.0 的稳扎稳打,到 1.5 Pro 的大胆跃升,字节跳动正加速推动 AI 视频生成从“可用”走向“专业可用”。随着音视频多模态生成能力的不断成熟,AI 内容创作的边界或将迎来新一轮扩展。