以色列知名AI公司Lightricks近日正式发布了其最新的开源AI视频基础模型——LTX-2,此举被业界视为对OpenAI的Sora和Google等巨头在AI视频生成领域的一次有力挑战。

LTX-2的核心突破在于其革命性的音画同步生成能力。与市面上大多数只能生成无声视频、需后期人工配音的AI工具不同,LTX-2能够在单一的扩散过程中同时生成画面与声音,确保角色口型与语音、爆炸的光效与音效、行走节奏与脚步声等元素完美同步。这一技术显著提升了生成视频的真实感与叙事连贯性,为专业内容创作铺平了道路。

在画质方面,LTX-2支持最高4K分辨率和50帧每秒的输出,其画面质量已达到电影级别。据官方介绍,LTX-2是首个能够稳定生成原生4K视频的开源AI模型,这意味着创作者可以直接将其产出用于电影、广告或高端宣传片,而不再局限于概念草图或低质动画。

为了满足专业创作者的多样化需求,LTX-2提供了极高的创作自由度。该模型支持文本、图片和草图等多种输入方式,允许用户对镜头角度、物体动作和时间节奏等进行精细控制。此外,模型内置了LoRA(Low-Rank Adaptation)微调机制,用户仅需少量素材即可训练出具有专属风格的模型,确保在不同场景下视觉风格的一致性。
Lightricks将LTX-2定位为一个“完整的AI创意引擎”,旨在为真实的工作流服务。其高效的生成速度和高达50%的计算成本降低,有望进一步推动高质量AI视频创作的普及化,为内容创作者、广告公司乃至独立电影人带来前所未有的生产力变革。