12月1日,人工智能初创公司Runway正式推出其新一代文本到视频生成模型Gen 4.5。该模型能够根据文本提示生成高清晰度视频,在运动表现、人物动作、镜头语言及物理规律的还原上展现出显著进步。
据独立AI基准测试与分析机构Artificial Analysis发布的Video Arena排行榜显示,Gen 4.5凭借1246分的Elo评分位居榜首。该榜单采用盲评机制,由用户对不同模型生成的视频进行匿名对比并投票。在该榜单中,谷歌的Veo 3排名第二,而OpenAI的Sora 2 Pro则位列第七。

Runway首席执行官克里斯托瓦尔·瓦伦苏埃拉在采访中表示,一家仅百人规模的公司,凭借专注与创新,同样能够挑战科技巨头。他透露,Gen 4.5的内部代号为“David”(大卫),象征着“以小博大”的精神,并称此次发布是公司七年积累的成果。瓦伦苏埃拉强调,在当前生成式AI领域,必须防止技术被少数几家公司所垄断。
成立于2018年的Runway,专注于AI视频模型与“世界模型”的研发,其技术旨在通过学习现实世界的视频和观测数据,更精准地模拟物理特性。公司客户涵盖媒体、影视工作室、品牌、设计师及学生等多元群体。据PitchBook数据,Runway当前估值已达35.5亿美元。
目前,Gen 4.5正逐步向所有Runway用户开放,并将于本周末前全面上线。该模型将通过Runway的平台、API及部分合作伙伴渠道提供,公司还预告了未来将推出更多重大更新。