这两款模型里有一款已经不再售卖,而且 OpenAI 把这句话写在了自己的页面上。Sora 2 的官方发布公告现在开头就放着一条声明:As of April 26, 2026, the Sora product is no longer available. 意思是自 2026 年 4 月 26 日起,Sora 产品已不再提供。
Google 的 Veo 3.1 页面没有这类声明。它仍然是 Google DeepMind 用 Video, meet audio 介绍的那款模型,文档还在,入口也还在。
先说结论:一款在卖,一款在退场
Veo 3.1 是 Google 带原生音频的视频生成模型,官方写明单条 8 秒,分辨率有 1080p 和 4K。Sora 2 曾是 OpenAI 的音视频模型,消费端自 2026 年 4 月 26 日起关闭。
如果你在为下个月就要开工的项目挑工具,答案到这一步为止就已经结束了。本文接下来只做一件事:把两家厂商自己的页面并排放下,如实报告它们各自印了什么。
两家官方页面各自确认了什么
| 公布项 | Veo 3.1 · Google | Sora 2 · OpenAI |
|---|---|---|
| 模型页 | Google DeepMind 的 Veo 页面 | OpenAI 的 Sora 2 公告 |
| 停用声明 | 无 | no longer available,2026 年 4 月起 |
| 片长 | Veo videos are 8 seconds long. | 没有写出任何时长 |
| 分辨率 | 1080p 与 4K | 没有写出 |
| 原生音频 | 与画面一并生成 | synchronized dialogue and sound effects |
| 角色一致性 | 参考图、首尾帧 | 公告页没有记录 |
| 续接镜头 | 有文档 | 没有公布 |
| 价格 | 无 | 无 |
表里这些行,有将近一半之所以存在,只是因为其中一家选择公布它们。这张表要当成可核实清单来读,不要当成记分牌。
可用性排在所有参数之前
OpenAI 的两份页面给的是日期,不是观点。网页版与 App 于 2026 年 4 月 26 日停止服务,API 在 2026 年 9 月 24 日停止——如果你维护的是集成而不是个人账号,后面这个日期才是关键。
同一份帮助文档顺手回答了另外两个实际问题。内容仍然可以导出,官方原话是:We recommend you export your Sora content as soon as possible. 已购买的积分也不会作废,因为任何已购买的 ChatGPT 或 Sora 积分仍可按你的选择用于 Codex。
Google 没有为 Veo 3.1 公布任何同类信息,因为没有同类信息可公布。
官方参数:只有一家把数字印出来

Google 的模型页写得很具体:单条视频 8 秒。分辨率也在同一页写清,1080p 面向剪辑,4K 面向高端制作。功能清单同样具体,而且每一条都是你在界面里找得到的名字——用参考图保持角色一致、续接场景、镜头控制、运动控制、首尾帧过渡、画面外扩、素材合成视频。
同一页还印了一条局限,这条比任何优点清单都值钱:自然且连贯的语音,尤其是较短的语音片段,仍处于持续开发中。
那个「十五秒」的说法从哪来
搜这个对比,你一定会遇到给 Sora 2 标出时长的文章——普通用户 15 秒、Pro 档 25 秒——而且都声称来自官方公告。OpenAI 的页面这两个数字一个都没印。页面上唯一出现的时长藏在一份示例创作简报里,5.0s 和 4K 描述的是写简报的人给自己那一个镜头定的规格。
声音:两家都自称原生音频
音频是两份页面用词最接近的一项能力。Google 说 Veo 3.1 把音效、环境声和对白跟画面一起原生生成。OpenAI 说 Sora 2 是通用音视频生成系统,能做出高度逼真的背景声景、语音与音效。
差别在之后。Google 随后贴出基准图表,显示自家模型在整体偏好、提示词遵循度和音视频同步上都领先,并且标注了参与评分的人和测试用的提示词。这是厂商用自己的基准跑出来的自家结果,不是独立测评。
价格:两份模型页都没印数字
上面两份页面里没有任何价格——没有订阅金额,没有 credits 余额,没有每秒单价。Google 把已经公布的数字放在别的页面,我们在 Veo 3.1 价格与免费额度指南 里逐项走过一遍;开发者一侧的费率在 API 与 Vertex AI 计费指南 里。
OpenAI 的公告当时说,Sora 2 初期免费提供、起始额度较宽松,并且表示当时讨论中唯一的方案是当需求超过算力时让用户付费多生成几条。那句话从头到尾没有带过任何金额。
案例:一条提示词,两条流程
挑一条两边都不好处理的提示词。它要求在一条很短的片子里,同时装进一句台词和一次运镜。
提示词
「中景:一位系着沾满面粉的围裙的面包师,正把一托盘面包从石窑里拉出来。蒸汽升进左侧射入的暖色窗光里。镜头缓慢向右漂移。她抬起头说:小心,很烫。音频:窑门吱呀、面包表皮碎裂、厨房低频底噪。」
参数:8 秒、1080p、16:9、开启音频、生成一次。
两边分别会得到什么
在 Veo 3.1 上,这条提示词落在有文档记录的行为里。8 秒装得下一个镜头加一句台词,对白和音频床都是跟画面一起生成的,不需要后期叠上去。如果动作装不下,官方写明的下一步是续接场景:从上一段的最后一秒往后接,同时保持音频一致。
在 OpenAI 这边,同一条提示词没有地方可去:App 已于 2026 年 4 月 26 日关闭,API 的调用权限在 2026 年 9 月 24 日结束。
我们没有把两款模型并排跑过。提示词指南 整理了 Google 记录的几个要素,上手指南 能把第一条片子从头走到尾。
两家都没有公布的部分
OpenAI 在本次核对的页面上,从未公布 Sora 2 的时长规格、分辨率清单、续接能力,也没有公布任何费率;本次核对期间它的开发者定价文档打不开,所以本文没有引用其中任何数字。
Google 的 Veo 3.1 模型页没有公布价格、订阅档位、credits 余额、免费额度,也没有公布 Flow Credits 到生成次数的换算关系,水印政策同样缺席。这些空白比看上去重要:没有官方换算率,谁也算不出一笔 credits 余额能换几条片子,而任何替你算出来的页面,都是自己把缺的那个数字补上了。
常见问题
现在还能用 Sora 2 吗? App 已于 2026 年 4 月 26 日关闭,API 在 2026 年 9 月 24 日停止。
Veo 3.1 可以用吗? 可以。Google 的模型页正常提供服务,也没有停用声明。
哪个片子更长? Google 公布的是 8 秒,并写明可以续接。OpenAI 没有公布任何时长。
两个都能生成音频吗? 两份页面都说能,用词几乎一样。
哪个更便宜? 两份模型页都没印价格,所以这个问题在它们身上得不到答案。
新手从哪儿开始? 从还在售卖的那一款开始。专题页 把教程、提示词指南和开发者文档收在了一处。
用一手页面搭起来的对比,比用转手数字搭起来的要短,也有用得多。先看可用性,再看厂商真正印出来的参数。