快手可灵AI发布音画同出模型可灵2.6, 一键生成“有声音的动态世界”

12.4 此次发布的可灵2.6版本提供两条核心创作路径一是文生音画,用户只需输入一句话,即可自动生成一条包含动态画面人声音效和背景氛围的完整音视频

12月3日晚,快手旗下可灵AI通过官方公众号宣布,其首个音画同出模型可灵2.6正式上线。该模型能够实现单次生成同时产出画面、自然语音、匹配音效及环境氛围,被官方称为“打通‘音’‘画’两个世界”的创新技术。


2025-12-04_090133_519

 

可灵2.6版本提供两条核心创作路径:一是“文生音画”,用户只需输入一句话,即可自动生成一条包含动态画面、人声、音效和背景氛围的完整音视频;二是“图生音画”,可将静态图片转化为带有语音和动态效果的视频内容,实现“让静态画面开口说话、动起来”。

 

这一技术突破标志着AI生成内容从单一模态向多模态深度融合演进。传统AI生成往往需分步处理画面与音频,而可灵模型通过端到端生成,大幅降低了视频创作门槛,让用户能更快速、直观地实现创意表达。其应用场景可覆盖短视频创作、教育内容、营销素材等多个领域。

 

随着AIGC竞争进入音画协同新阶段,快手此次技术创新不仅丰富了其AI工具生态,也为行业探索多模态生成提供了新方向。


体验链接:

https://app.klingai.com/cn/image-to-video/frame-mode/new