谷歌DeepMind团队发布Veo 3.1视频生成模型,支持竖屏与4K输出

1.14 通过引入更先进的时序建模技术,新版本能够更好地理解参考图片中的关键元素,并在视频生成过程中保持这些元素的一致性

deepmindV3.1


核心看点:谷歌DeepMind团队于2026年1月14日正式推出Veo 3.1视频生成模型,强化场景一致性并新增移动端优化功能。


1月14日,谷歌DeepMind团队正式宣布Veo 3.1视频生成AI模型的重大更新。此次升级最引人注目的新功能是支持原生竖屏视频生成和4K超分辨率输出,专门针对YouTube Shorts、TikTok等移动端短视频平台进行优化。据官方介绍,Veo 3.1现在允许用户上传参考图片(官方称为"Image Ingredients"或"图像要素"),并基于这些素材图片生成高度一致的视频内容,显著提升了故事表达的连贯性和视觉质量。


技术突破详解:Veo 3.1在场景一致性方面实现了重大改进,解决了此前版本在长视频生成中容易出现的画面跳跃和风格不统一问题。通过引入更先进的时序建模技术,新版本能够更好地理解参考图片中的关键元素,并在视频生成过程中保持这些元素的一致性。此外,4K超分辨率功能使得生成的视频可以直接用于高质量内容创作,无需额外的后期处理。


该模型目前通过Gemini API和Vertex AI平台提供预览版服务,仅对付费用户开放,定价结构与Veo 3版本保持一致。这一策略表明谷歌正在稳步推进其商业化进程,同时通过API接口收集开发者反馈以进一步优化产品。


市场影响分析:Veo 3.1的发布正值视频生成AI市场竞争白热化阶段。虽然此次更新被业界视为"重要但非颠覆性的迭代",但其针对移动端的专门优化显示了谷歌对短视频市场的重视。随着全球短视频内容消费持续增长,支持原生竖屏和4K输出的功能将为内容创作者提供更便捷的工具,有望在专业视频制作领域获得广泛应用。