OpenAI发布Sora 2,打造AI版“抖音”社交应用

10.1 用户不仅可以自己出现在视频中,还可以授权好友在其生成的视频中使用自己的形象,实现多人同框的视频创作

打开苹果App Store,一款名为“Sora”的全新社交应用已悄然上架,它正在用AI重新定义短视频创作与社交体验。

 

OpenAI于本周正式发布了下一代音视频生成模型Sora 2,并同步推出了一款同名的社交应用。这款应用被业界视为“AI版抖音”,采用TikTok风格的垂直视频流和滑动浏览交互方式。

 

但与普通短视频平台根本不同的是,Sora应用中的所有内容均由AI生成。

 

此次发布标志着OpenAI不再满足于仅仅作为技术提供方,而是直接面向消费者打造社交产品,与Meta和谷歌等科技巨头展开正面竞争。

 

与去年发布的初代Sora相比,Sora 2在物理规律模拟上取得了显著突破。OpenAI在公告中直言,“之前的视频模型过于乐观——它们会扭曲物体和变形现实以成功执行文本提示”,而Sora 2在遵循物理法则方面比之前的系统更好。

 

在官方演示中,Sora 2展示了包括奥林匹克体操动作、在划水板上的后空翻等复杂物理互动的视频片段。这些场景都是早期视频生成系统难以处理的。


2025-10-01_105804_156

 

篮球投篮未中时,篮球会从篮板上弹开,符合真实的物理轨迹,而不是像传统视频生成模型那样让篮球“瞬移”进篮筐。

 

音频生成是Sora 2的另一大突破。该模型首次能够生成与视频同步的音频,包括背景音景、语音和音效。

 

截至目前,具备该能力的模型只有谷歌的Veo 3。

 

Sora应用的核心创新是名为“Cameos”(客串)的功能。用户只需录制一段短视频以验证身份并捕捉外貌和声音,就能将自己插入任何Sora生成的场景中。

 

在演示中,OpenAI团队生成了他们自己的视频,展示倒立、做踢腿动作,并在不同场景中出现,风格酷似TikTok视频。

 

用户不仅可以自己出现在视频中,还可以授权好友在其生成的视频中使用自己的形象,实现多人同框的视频创作。即使某段包含用户肖像的视频尚未发布,仅仅是他人的草稿,用户也能在应用内看到并管理这些内容。

 

应用内的信息流采用算法推荐机制,OpenAI声称不优化滚动时间,而是优先显示用户关注或互动的人的内容。用户甚至可以使用自然语言指令来调整动态设置。

 

Sora应用目前仅在iOS平台上线,采取邀请制注册方式,初期仅面向美国和加拿大用户。


2025-10-01_105834_637

 

OpenAI计划迅速扩展到其他国家。应用初期将免费开放,OpenAI称之为“慷慨的限制”,不过这些仍然受到计算资源的约束。

 

ChatGPT Pro订阅者可以访问一个名为Sora 2 Pro的实验性高质量版本。对于高需求时段可能出现的算力不足情况,OpenAI表示将为用户提供支付额外生成的选项。

 

这种灵活的商业模式既降低了用户入门门槛,又为OpenAI未来盈利留下了空间。

 

面对AI生成内容可能带来的风险,OpenAI引入了一系列安全措施。

 

对于青少年用户,应用默认限制每日在动态中可见的生成视频数量,并对客串权限实施更严格的限制。家长可通过ChatGPT的家长控制功能管理滚动限制、算法个性化和直接消息设置。

 

所有Sora生成的视频都会带有水印和元数据标识,以便观众知道这是AI生成的。应用还禁用了屏幕录制功能,以帮助控制视频的传播。

 

Sora团队负责人Bill Peebles表示:“我们真的认为,这可能会成为视频生成领域的ChatGPT时刻。” 有分析师指出,OpenAI通过自建APP获取用户数据,这些包含人类情感偏好和社交属性的数据,将成为OpenAI宝贵的私有资产。

 

在黄仁勋看来,OpenAI很有可能成为“世界上下一个价值数万亿美元的超大规模公司”。