第三天: Sora 正式发布及幕后的故事

OpenAI正式发布文生视频模型Sora,支持图生视频、视频编辑、故事板、循环生成与场景混合等能力。奥特曼强调其三大价值:赋能创作者、突破文本交互局限、推动AGI发展。目前向ChatGPT Plus/Pro用户开放,按订阅等级提供差异化生成额度。

发布于2024年12月10日 13:23
编辑零重力瓦力
评论0
阅读12

第三天 OpenAI 正式发布了 Sora。在过去的短短 2 天里,已经有大量的创作者发布了自己用 Sora 创作的作品。有感到惊艳的,也有感到失望,觉得和可灵、Runway 差别不大的。不妨看看 Sora 开发团队对这款现象级产品的介绍,以及幕后的故事。

萨姆·奥特曼对于认为 Sora 这款产品带来了3项重要的意义

  1. 为创作者提供了强大的工具,开创 AI 与人类协作的新模式
  2. 突破纯文本交互的局限,让 AI 能够理解和生成视频内容
  3. 对实现通用人工智能(AGI)具有关键意义,有助于 AI 系统学习理解现实世界

Sora 的核心功能

  1. 文生视频:通过文字描述生成视频
  2. 图生视频:将静态图片转化为动态视频
  3. 视频编辑:包括重混(Remix)、重剪(Recut)等功能
  4. 故事板:允许用户精确控制视频序列和场景转换
  5. 创作循环视频:实现无缝循环的视频效果
  6. 场景混合:将不同视频元素智能融合(blend)

使用门槛及价格

Sora 将向 ChatGPT Plus 和 Pro 用户开放:

  1. Plus 用户每月可获得 50 次生成机会
  2. Pro 用户可获得 500 次快速生成权限和无限慢速生成
  3. 所有用户都可以浏览作品流获取灵感

相关文章

Nano Banana 2 :融合 Pro 级性能,闪电般极速
AI 产品工具
2026年4月12日
0 条评论
小创

Nano Banana 2 :融合 Pro 级性能,闪电般极速

Google DeepMind 发布 Nano Banana 2 图像生成模型,将专业级能力与极速响应合二为一。核心升级包括继承 Pro 版的世界知识与文本渲染技术,同时具备闪电般的生成速度。技术亮点涵盖精准对象渲染、信息图表与数据可视化、主体一致性支持 5 角色 14 对象、复杂指令理解及 512 像素至 4K 分辨率输出。该模型现已集成至 Gemini 、 Google 搜索等多平台,并强化 SynthID 溯源技术。这标志着生成式 AI 图像领域专业工具的加速普惠。

#Nano Banana#Google
阅读全文
Sam Altman 回击《纽约客》争议报道,此前住所被袭
AI 新闻资讯
2026年4月12日
0 条评论
小创

Sam Altman 回击《纽约客》争议报道,此前住所被袭

OpenAI CEO Altman 位于旧金山的住宅遭燃烧弹袭击,警方在其总部逮捕嫌疑人。袭击前,《纽约客》发表长文批评 Altman 是“近乎偏执的权力追逐者”。 Altman 随后发博客承认自己“回避冲突”的性格带来诸多问题,向被伤害者致歉,同时呼吁行业降低对抗性。该事件折射出 AI 行业对“控制 AGI”的偏执渴望。当技术权力被神话化,冲突似乎难以避免。

#OpenAI#AGI
阅读全文
OpenAI 打造统一 Codex 应用及新 Scratchpad 功能
AI 新闻资讯
2026年4月12日
0 条评论
小创

OpenAI 打造统一 Codex 应用及新 Scratchpad 功能

OpenAI 正在推进重大产品整合计划,将 ChatGPT 、 Atlas 浏览器及代码工具统一到基于 Codex 的桌面应用中。 Codex 客户端中发现的“心跳系统”暗示其正在构建托管智能体能力,支持自主进程后台运行和多步骤工作流执行。此举被视为对 Anthropic 旗下 Conway 项目的直接回应。 Codex 同时测试的 Scratchpad 功能支持并行对话执行。若整合成功,将重新定义“AI 操作系统”边界,行业竞争也已转向由自主智能体驱动的全能桌面应用。

#OpenAI
阅读全文
互动讨论

评论区

围绕《第三天: Sora 正式发布及幕后的故事》展开交流,未登录用户可浏览评论,登录后可参与讨论。

评论数
0
登录后参与评论
支持发表观点与回复一级评论,互动后将同步到消息中心。
登录后评论
暂无评论,欢迎成为第一个参与讨论的人。