12月3日晚,快手旗下可灵AI通过官方公众号宣布,其首个音画同出模型可灵2.6正式上线。该模型能够实现单次生成同时产出画面、自然语音、匹配音效及环境氛围,被官方称为“打通‘音’‘画’两个世界”的创新技术。

可灵2.6版本提供两条核心创作路径:一是“文生音画”,用户只需输入一句话,即可自动生成一条包含动态画面、人声、音效和背景氛围的完整音视频;二是“图生音画”,可将静态图片转化为带有语音和动态效果的视频内容,实现“让静态画面开口说话、动起来”。
这一技术突破标志着AI生成内容从单一模态向多模态深度融合演进。传统AI生成往往需分步处理画面与音频,而可灵模型通过端到端生成,大幅降低了视频创作门槛,让用户能更快速、直观地实现创意表达。其应用场景可覆盖短视频创作、教育内容、营销素材等多个领域。
随着AIGC竞争进入音画协同新阶段,快手此次技术创新不仅丰富了其AI工具生态,也为行业探索多模态生成提供了新方向。
体验链接:
https://app.klingai.com/cn/image-to-video/frame-mode/new