(旧金山,2025年9月30日)OpenAI 今日正式发布了其新一代旗舰视频和音频生成模型 Sora 2,并将其定位为视频生成领域的“GPT-3.5 时刻”。同时,OpenAI 出人意料地同步推出了一款基于 Sora 2 模型的社交 iOS 应用程序 “Sora”,旨在将视频创作和社交互动深度结合。
Sora 2 在技术上实现了显著的飞跃。据称,该模型在物理准确性、真实性和可控性方面远超前代,能够精确模拟浮力、刚度等复杂物理动态,甚至能模拟“失败”的场景,例如篮球击中篮板后的反弹,而非像以往模型那样为了实现提示而扭曲现实。此外,Sora 2 还具备先进的音视频同步生成能力,可以创建复杂的背景音景、对话和音效。
新推出的“Sora”社交应用的核心创新在于其 “Cameo”(客串)功能。用户通过一次性录制验证身份并捕捉形象后,即可将自己的逼真肖像和声音植入任何 Sora 生成的场景中,实现高度个性化的内容共创和交流。OpenAI 认为,这个基于邀请机制的应用程序将通过“Cameo”功能强化社群联系,代表了一种“沟通方式的自然演变”。
面对社交媒体常见的沉迷和信息流焦虑问题,OpenAI 亦发布了详细的《Sora 信息流哲学》。该哲学明确指出,信息流的设计目标是“最大化创作,而非消费”,通过可控的推荐算法来激励用户创作和参与,而非鼓励被动浏览。安全方面,Sora 采用了在内容生成阶段即实施强力防护的策略,并提供通过 ChatGPT 实现的家长控制功能,以确保平台对青少年友好。
Sora iOS 应用目前已在美国和加拿大率先推出,采取邀请制开放访问。用户可免费体验,但 ChatGPT Pro 用户将能使用实验性的、更高质量的 Sora 2 Pro模型。OpenAI 表示,Sora 2 的发布不仅是视频技术的重要里程碑,更是朝着通用世界模拟器迈出的关键一步。
可惜要邀请码