Runway 发布视频模型 Gen-4:可保持场景中角色、地点和物体的高度一致性

4.1 Gen-4在生成具有高度动态感和逼真运动效果的视频方面表现卓越,同时在主体物体和风格的一致性对用户指令的精准遵循度以及对现实世界规律的理解方面,均达到了同类顶尖水平

人工智能(AI)初创公司 Runway 本周一发布了最新研发的 AI 视频生成模型 Gen-4,声称这是目前为止保真度最高的 AI 驱动视频生成工具之一。


gen4 

新发布的 Gen-4 模型现已开始向 Runway 的个人及企业客户推送。据 Runway 介绍,该模型的核心优势在于能够在不同的视频场景中保持角色、地点和物体的高度一致性,维持“连贯的世界环境”,并且能够从场景内的不同视角和位置重新生成元素。


   


 Runway 在官方博客中指出:“Gen-4 能够有效利用视觉参考资料,并结合用户的文本指令,创造出风格、主体、地点等要素保持一致的新图像和视频,整个过程无需进行模型微调或额外的专门训练。Gen-4 在生成具有高度动态感和逼真运动效果的视频方面表现卓越,同时在主体、物体和风格的一致性、对用户指令的精准遵循度以及对现实世界规律的理解方面,均达到了同类顶尖水平。Runway Gen-4 的发布,也标志着视觉生成模型在模拟真实世界物理规律的能力方面取得了一个重要的里程碑。”

 

Gen-4 是通过对海量的视频数据进行训练而成的。通过学习这些数据中的模式,模型得以生成全新的合成视频片段。由代表好莱坞动画师和漫画家的动画协会(Animation Guild)在 2024 年委托进行的一项研究显示,在已经采用 AI 技术的电影制作公司中,高达 75% 的公司在引入该技术后,出现了裁减、合并岗位或直接取消职位的现象。该研究同时预测,到 2026 年,生成式 AI 可能会冲击超过 10 万个美国娱乐行业的工作岗位。


本网链接:国际大模型/多模态大模型/视频
https://aiyxl.com/world_model.html 

Gen-4 链接:
https://runwayml.com/