Adobe Firefly 的 Generate video 不给你一个视频模型,它给你一个 Model 下拉框,Adobe 自研的 Firefly Video 和 Google 的 Veo 3.1 就并排躺在里面。

所以这是一次设置上的选择,不是一次厂商站队。提示词输入框是同一个,选项列表不同,账单不同,其中一边连音频都不一样。

一个下拉框,两个归属

Adobe 的生成文档把默认值写成一句话:默认使用的模型是 Firefly Video,但如果你是第一次生成视频,默认会变成 Veo 3.1。

两个条目不是同一类东西。Firefly Video 是 Adobe 自研的模型,官方给它的定位是用简单文字描述生成可商用的视频片段。Veo 3.1 和 Veo 3.1 Fast 来自 Google,列在 Adobe 的伙伴模型页里,分节标题就叫 Generate videos using Veo 2, Veo 3.1, and Veo 3.1 Fast。

Adobe 官方截图:Firefly Video 生成面板,可见提示词输入框与设置栏
Adobe

只有帧率不吃这个选择。Adobe 写明所有生成视频的帧率在自研与伙伴模型上都默认 24 FPS。其余设置都跟着模型走,Adobe 自己在注释里也承认:可用的视频生成设置会随你选的视频模型而不同。

Firefly Video 与 Veo 3.1 的参数逐项对照

下面两列描述的都是选完模型之后界面上出现的东西,出处都是 Adobe 官方文档。

设置Firefly Video(Adobe 自研)Veo 3.1(伙伴模型)
公布方AdobeGoogle
分辨率540p、720p 或 1080p720p 或 1080p
画幅Widescreen (16:9)、Vertical (9:16)、Square (1:1)Widescreen (16:9)、Vertical (9:16)
时长5 秒4、6 或 8 秒
帧率24 FPS24 FPS
音频选项生成这一步没有有 Audio 开关,生成同步的声音或音乐
额度1080p 每秒 100、720p 50、540p 20官方写 varies

三行决定选型。自研模型的时长固定 5 秒,Veo 3.1 能选 4、6、8 秒;方形画幅只有自研模型有;音频开关只有 Veo 有。

两家官网各自公布了什么

Google 的 Veo 页面说这个模型能输出 1080p 和 4K,还写了 Veo 3 能给作品加上音效、环境声甚至对白,全部音频都是原生生成的。另一篇 Google 官方博客补上了原生竖屏 9:16 输出。

Adobe 这边的清单更窄。自研模型的分辨率是 540p、720p 或 1080p,官方推荐 1080p 效果最好。在额度文档里,4K 只出现在 Ray3.14 这类伙伴模型和 Premiere 的 Generative Extend 上,因为 Generate Video 自己的分辨率表只到 1080p。

原生音频:决定多数人选型的那一行

Adobe 关于 Veo 的句子写得很具体:Veo 3.1 与 Veo 3.1 Fast 支持在生成视频的同时生成音频,打开 Audio 选项就能为生成的视频生成同步的声音或音乐。

自研模型没有对应的一句。Adobe 给自研模型安排的音频发生在片段生成之后,是一个 Generate sound effects 动作,用文字提示或你自己的录音来加音效。所以自研模型的原生音频属于官方未公布:官方写的是一套生成后的音频流程,不是原生音频能力。

Google 也公布了自己音频的短板。它的 Veo 页面写着,生成自然且前后一致的语音、尤其是较短的语音片段,仍是正在改进的方向。

额度分别落在两个模型上是怎么算的

自研模型按秒计费。Adobe 的生成式点数常见问题列的是 1080p、24 FPS 每秒 100 点,720p 每秒 50 点,540p 每秒 20 点,一条 5 秒片就是 500、250 或 100 点。Firefly Video 费用指南把那笔除法做完了,免费额度边界决定一个月里有多少条不用花钱。

Veo 是另一条计价项。Adobe 把伙伴模型的消耗标成 varies,并说明点数取决于所选模型、产物与文件大小。没有可以相乘的费率,所以 Veo 片段没法像自研模型那样排预算。

示例:同一段提示词,两种选型

只换 Model 下拉框,下面两个设置块自然就分开了。提示词来自 Adobe,随 Firefly Video Model 发布一起公布。

cinematic realistic detailed shot of a cute robot holding up a red glowing heart. The lighting is gorgeous and sun-kissed, with dappled lighting on the robot's face and a strong sunny backlight, shallow depth of field. film grain. shot on 35mm film.

案例一:自研模型先出一版静音草稿

Model: Firefly Video
Resolution: 540p
Aspect ratio: Widescreen (16:9)
Duration: 5 seconds
Frames per second: 24 FPS
Audio: none in this step
Credits: 100

Adobe 的默认值是所有片段 24 FPS、5 秒,所以你真正在拧的旋钮只有分辨率。540p 每秒 20 点,是 1080p 的五分之一。生成这一步没有音频选项,声音是第二件事:Generate sound effects。分步教程写了每个控件在页面上的位置。

案例二:同一提示词换 Veo 3.1 并打开音频

Model: Veo 3.1
Resolution: 1080p
Aspect ratio: Widescreen (16:9)
Duration: 8 seconds
Frames per second: 24 FPS
Audio: on
Credits: varies

除了模型名,还有两处变化。时长从固定 5 秒变成 4、6、8 秒三选一,Audio 开关出现。额度也不再可预测,因为 Adobe 对伙伴模型的唯一说法就是 varies。

两边官方页面都没交代的部分

Google 官方页面没有把单条片段时长写成规格,本站这次能打开的页面里都没有,Vertex AI 的文档页根本打不开。Adobe 自研模型的分辨率清单只到 1080p,而 Google 公布 Veo 有 1080p 和 4K,那几行 4K 要么属于 Firefly 之外的 Veo,要么属于 Firefly 里别的伙伴模型。至于自研模型的原生音频,两边都没有正面说法,只有一份生成后的音效流程。

常见问题

Firefly 默认用哪个模型? 默认是 Firefly Video,只有第一次生成视频时 Adobe 把默认值换成 Veo 3.1。

哪个有原生音频? 按 Adobe 的说明,Veo 3.1 与 Veo 3.1 Fast 打开 Audio 选项就能生成同步的声音或音乐。自研模型没有对应的官方句子。

为什么两个模型的时长控件不一样? 因为模型暴露的设置不同。Adobe 说可用的视频生成设置会随所选模型而不同。

同一段提示词能在两个模型上各跑一次吗? 能,Model 下拉框就是干这个的,换掉它页面其他部分都不动。Firefly Video 提示词指南讲的是让两次对比有意义的那套五槽位结构。