Adobe Firefly 的 Generate video 不给你一个视频模型,它给你一个 Model 下拉框,Adobe 自研的 Firefly Video 和 Google 的 Veo 3.1 就并排躺在里面。
所以这是一次设置上的选择,不是一次厂商站队。提示词输入框是同一个,选项列表不同,账单不同,其中一边连音频都不一样。
一个下拉框,两个归属
Adobe 的生成文档把默认值写成一句话:默认使用的模型是 Firefly Video,但如果你是第一次生成视频,默认会变成 Veo 3.1。
两个条目不是同一类东西。Firefly Video 是 Adobe 自研的模型,官方给它的定位是用简单文字描述生成可商用的视频片段。Veo 3.1 和 Veo 3.1 Fast 来自 Google,列在 Adobe 的伙伴模型页里,分节标题就叫 Generate videos using Veo 2, Veo 3.1, and Veo 3.1 Fast。

只有帧率不吃这个选择。Adobe 写明所有生成视频的帧率在自研与伙伴模型上都默认 24 FPS。其余设置都跟着模型走,Adobe 自己在注释里也承认:可用的视频生成设置会随你选的视频模型而不同。
Firefly Video 与 Veo 3.1 的参数逐项对照
下面两列描述的都是选完模型之后界面上出现的东西,出处都是 Adobe 官方文档。
| 设置 | Firefly Video(Adobe 自研) | Veo 3.1(伙伴模型) |
|---|---|---|
| 公布方 | Adobe | |
| 分辨率 | 540p、720p 或 1080p | 720p 或 1080p |
| 画幅 | Widescreen (16:9)、Vertical (9:16)、Square (1:1) | Widescreen (16:9)、Vertical (9:16) |
| 时长 | 5 秒 | 4、6 或 8 秒 |
| 帧率 | 24 FPS | 24 FPS |
| 音频选项 | 生成这一步没有 | 有 Audio 开关,生成同步的声音或音乐 |
| 额度 | 1080p 每秒 100、720p 50、540p 20 | 官方写 varies |
三行决定选型。自研模型的时长固定 5 秒,Veo 3.1 能选 4、6、8 秒;方形画幅只有自研模型有;音频开关只有 Veo 有。
两家官网各自公布了什么
Google 的 Veo 页面说这个模型能输出 1080p 和 4K,还写了 Veo 3 能给作品加上音效、环境声甚至对白,全部音频都是原生生成的。另一篇 Google 官方博客补上了原生竖屏 9:16 输出。
Adobe 这边的清单更窄。自研模型的分辨率是 540p、720p 或 1080p,官方推荐 1080p 效果最好。在额度文档里,4K 只出现在 Ray3.14 这类伙伴模型和 Premiere 的 Generative Extend 上,因为 Generate Video 自己的分辨率表只到 1080p。
原生音频:决定多数人选型的那一行
Adobe 关于 Veo 的句子写得很具体:Veo 3.1 与 Veo 3.1 Fast 支持在生成视频的同时生成音频,打开 Audio 选项就能为生成的视频生成同步的声音或音乐。
自研模型没有对应的一句。Adobe 给自研模型安排的音频发生在片段生成之后,是一个 Generate sound effects 动作,用文字提示或你自己的录音来加音效。所以自研模型的原生音频属于官方未公布:官方写的是一套生成后的音频流程,不是原生音频能力。
Google 也公布了自己音频的短板。它的 Veo 页面写着,生成自然且前后一致的语音、尤其是较短的语音片段,仍是正在改进的方向。
额度分别落在两个模型上是怎么算的
自研模型按秒计费。Adobe 的生成式点数常见问题列的是 1080p、24 FPS 每秒 100 点,720p 每秒 50 点,540p 每秒 20 点,一条 5 秒片就是 500、250 或 100 点。Firefly Video 费用指南把那笔除法做完了,免费额度边界决定一个月里有多少条不用花钱。
Veo 是另一条计价项。Adobe 把伙伴模型的消耗标成 varies,并说明点数取决于所选模型、产物与文件大小。没有可以相乘的费率,所以 Veo 片段没法像自研模型那样排预算。
示例:同一段提示词,两种选型
只换 Model 下拉框,下面两个设置块自然就分开了。提示词来自 Adobe,随 Firefly Video Model 发布一起公布。
cinematic realistic detailed shot of a cute robot holding up a red glowing heart. The lighting is gorgeous and sun-kissed, with dappled lighting on the robot's face and a strong sunny backlight, shallow depth of field. film grain. shot on 35mm film.
案例一:自研模型先出一版静音草稿
Model: Firefly Video
Resolution: 540p
Aspect ratio: Widescreen (16:9)
Duration: 5 seconds
Frames per second: 24 FPS
Audio: none in this step
Credits: 100
Adobe 的默认值是所有片段 24 FPS、5 秒,所以你真正在拧的旋钮只有分辨率。540p 每秒 20 点,是 1080p 的五分之一。生成这一步没有音频选项,声音是第二件事:Generate sound effects。分步教程写了每个控件在页面上的位置。
案例二:同一提示词换 Veo 3.1 并打开音频
Model: Veo 3.1
Resolution: 1080p
Aspect ratio: Widescreen (16:9)
Duration: 8 seconds
Frames per second: 24 FPS
Audio: on
Credits: varies
除了模型名,还有两处变化。时长从固定 5 秒变成 4、6、8 秒三选一,Audio 开关出现。额度也不再可预测,因为 Adobe 对伙伴模型的唯一说法就是 varies。
两边官方页面都没交代的部分
Google 官方页面没有把单条片段时长写成规格,本站这次能打开的页面里都没有,Vertex AI 的文档页根本打不开。Adobe 自研模型的分辨率清单只到 1080p,而 Google 公布 Veo 有 1080p 和 4K,那几行 4K 要么属于 Firefly 之外的 Veo,要么属于 Firefly 里别的伙伴模型。至于自研模型的原生音频,两边都没有正面说法,只有一份生成后的音效流程。
常见问题
Firefly 默认用哪个模型? 默认是 Firefly Video,只有第一次生成视频时 Adobe 把默认值换成 Veo 3.1。
哪个有原生音频? 按 Adobe 的说明,Veo 3.1 与 Veo 3.1 Fast 打开 Audio 选项就能生成同步的声音或音乐。自研模型没有对应的官方句子。
为什么两个模型的时长控件不一样? 因为模型暴露的设置不同。Adobe 说可用的视频生成设置会随所选模型而不同。
同一段提示词能在两个模型上各跑一次吗? 能,Model 下拉框就是干这个的,换掉它页面其他部分都不动。Firefly Video 提示词指南讲的是让两次对比有意义的那套五槽位结构。