推荐搜索

GPT Image 简介 GPT Image 免费指南 GPT Image 开发文档 Midjourney 简介 Midjourney 免费指南 Midjourney 开发文档 Google Nano Banana 简介 Google Nano Banana 免费指南 Google Nano Banana 开发文档 Adobe Firefly Image 简介 Adobe Firefly Image 免费指南 Adobe Firefly Image 开发文档 FLUX 简介 FLUX 免费指南 FLUX 开发文档 Ideogram 简介 Ideogram 免费指南 Ideogram 开发文档 Recraft 简介 Recraft 免费指南 Recraft 开发文档 Stable Diffusion 简介 ByteDance Seedream 简介 Grok Imagine Image 简介 Google Veo 简介 Google Veo 免费指南 Google Veo 开发文档 Runway 简介 Kling AI 简介 ByteDance Seedance 简介 ByteDance Seedance 免费指南 ByteDance Seedance 开发文档 Luma AI 简介 Adobe Firefly Video 简介 Adobe Firefly Video 免费指南 Adobe Firefly Video 开发文档 Hailuo AI 简介 PixVerse 简介 PixVerse 免费指南 PixVerse 开发文档 Pika 简介 Pika 免费指南 Pika 开发文档 Alibaba Wan 简介 LTX Video 简介 Grok Imagine Video 简介 Google Gemini 简介 Google Gemini 免费指南 Google Gemini 开发文档 OpenAI GPT 简介 Claude Fable 简介 Claude Fable 免费指南 Claude Fable 开发文档 DeepSeek 简介 Qwen 简介 Llama 简介 Codex 简介 Codex 免费指南 Codex 开发文档 Cursor 简介 Cursor 免费指南 Cursor 开发文档 OpenClaw 简介 OpenClaw 免费指南 OpenClaw 开发文档 Perplexity 简介 ElevenLabs 简介 Suno 简介 Manus 简介 Claude 与 ChatGPT 怎么比:不借第三方数字 Claude 与 Gemini 怎么比:只有一侧能打开官方页面时 Adobe Firefly 免费吗:免费会员、积分与首年特惠 Adobe Firefly 价格:档位、生成积分与一张图的成本 Adobe Firefly Video 费用:每秒多少点、一条多少点 Adobe Firefly Video 免费吗:免费档的边界在哪 FLUX.2 提示词指南:官方文档写明的提示词结构 FLUX.2 与 Nano Banana Pro 对比:只看两家官方公布的部分 Ideogram 4.0 提示词指南:官方结构怎么用,文字怎么落对 Ideogram 价格:档位、积分与免费额度 Midjourney 提示词指南:结构、七类元素与 Edit Model 指令 Midjourney 价格:四档订阅、GPU 小时与一次任务花多少 Nano Banana Pro 价格:官方公布了什么,没公布什么 Nano Banana Pro 对比 Midjourney:哪个更适合你的工作流 Pika 积分:一条 Pika 2.5 视频花多少积分 Pika 免费吗?$0 档到底给什么 PixVerse 积分多少钱:先分清你在付哪本账 PixVerse 免费吗?两个免费档,各自要付什么 Recraft V4.1:八个变体怎么选 Recraft 价格与免费套餐:官方公布了哪些数字 Seedance 官网在哪:官方入口只有三个 Seedance 2.5 与 2.0 对照:官方公布的那几行 Veo 3.1 与 Sora 2 对比:两家官方页面各自还确认了什么 Veo 3.1 与可灵 3.0 对比:两家官方各自公布了什么 Claude 免费吗?$0 方案实际给了你什么 Claude 价格方案:Pro、Max 5x 与 Max 20x 怎么选 Adobe Firefly 怎么用:从入口到第一张图(Adobe Firefly Image 5) Adobe Firefly API 开发者接入:凭证、异步端点与 Image5 结构 Adobe Firefly Video 怎么用 Adobe Firefly 视频 API:/v3/videos/generate 端点解析 用 GPT Image 2.5 生成界面稿与 App Mockup 用 GPT Image 2.5 做表情包与透明贴纸 Nano Banana Pro 提示词指南:三份官方框架 Nano Banana Pro 免费吗?Google 官方到底确认了什么 Pika 2.5 怎么用:从官方入口到第一条视频 Pika API:官方开发者站、两层计费与调用三跳 PixVerse 怎么用:从选模型到第一条视频 PixVerse API 接入:独立平台、端点与积分 ByteDance Seedance 2.5 怎么用 Seedance API 接入:真实端点、模型 ID 与字段 Veo 3.1 提示词指南:Google 亲口点名的七个要素 Veo 3.1 价格与免费额度:官方公布了哪些数字 Claude 怎么用:从第一次对话到稳定产出 Claude API 接入:从 API key 到第一次调用 FLUX.2 怎么用:从官方入口到第一张图 FLUX.2 API 接入:官方 API 上手指南 GPT Image 2.5 与 DALL·E 3 怎么选 用 GPT Image 2.5 做信息图与流程图 Ideogram 怎么用:从注册到第一张带字的图 Ideogram API:接入、端点与图上文字渲染 Midjourney V8.2 怎么用 Midjourney API:有什么、没有什么 Nano Banana Pro 怎么用:从第一张图到可编辑的成品 Nano Banana Pro API 接入:从拿 key 到第一个请求 Recraft 怎么用:从注册到第一张可编辑矢量图 Recraft API 接入:官方端点、鉴权与风格一致性 Veo 3.1 怎么用:从第一条视频到能接着往下写 Veo 3.1 API 计费与 Vertex AI 接入 GPT Image 2.5 提示词分享 GPT Image 2.5 和 Nano Banana 2 怎么选 GPT Image 2.5 和 Seedream 5.0 Pro 对比 GPT Image 2.5 和 FLUX 2 对比 GPT Image 2.5 和 Ideogram 对比 GPT Image 2.5 免费吗 GPT Image 2.5 Sketch 草图怎么用 GPT Image 2.5 模板功能 GPT Image 2.5 评论标注 GPT Image 2.5 形象一致性 GPT Image 2.5 多图合成 GPT Image 2.5 中文文字渲染 GPT Image 2.5 是什么 GPT Image 2.5 API 总览 Codex 和 ChatGPT:编码场景下该用哪一个? Codex CLI、IDE 扩展、应用还是云端:按场景选择使用形态 你的第一个 Codex 低风险编程任务:从建基线到回滚 Cursor 是什么?它的 AI 编程工作流详解 Cursor 和 VS Code:哪款编辑器更适合你的工作流? Cursor 功能详解:Agent、Tab、上下文与更多 Gemini 是什么?模型、应用、Google AI Studio 与 API 一文讲清 Gemini Apps 与 Gemini API:根据任务选对工具 Gemini 能做什么?一份实用的能力指南 OpenClaw Foundation 是什么:治理、归属与独立性 OpenClaw Skill Workshop 使用指南:审查可复用技能 OpenClaw Skill Card:读懂 ClawHub 技能安全扫描 OpenClaw 2.0 更新指南:新功能、升级检查与使用变化 OpenClaw LTS 与 extended-stable 怎么选:版本通道指南 OpenClaw 安装教程:桌面版、脚本、npm 与源码方式对比 OpenClaw Node.js 环境配置:版本要求、安装与 PATH 排障 如何编写更好的 Codex 提示词:实用框架 提交前如何审查 Codex 代码变更 Cursor 新手入门教程:从安装到完成第一次代码修改 Cursor Rules 教程:项目规则、用户规则与 AGENTS.md Cursor Windows 安装与中文设置教程 Cursor MCP 配置教程:连接、验证与安全设置 Gemini 提示词怎么写:结构、模板与优化方法 Gemini API 教程:Key、Python SDK 与首次调用 Gemini 网页版使用教程:登录、文件与隐私设置 Gemini API Key 创建与安全配置指南 Codex 是什么?从能力边界到使用入口的完整解释 Codex 新手教程:从选择项目到验收第一个任务 Codex CLI 安装教程:登录、首次运行与安全检查 Codex AGENTS.md 指南:发现顺序、分层规则与验证方法 Codex CLI 常用命令:交互、状态、审查与自动化 Gemini怎么用:网页版、安卓与iPhone安装指南 Gemini功能详解:对话、文件、绘图与Gemini Live Gemini AI对话指南:提示词、追问与Gemini Live Gemini AI绘图指南:图片生成、提示词与编辑方法 Gemini与GPT-4对比:功能、限制和适用场景 Gemini AI助手指南:手机、应用连接与隐私设置 Gemini 提示词工程指南:方法、模板与示例 Gemini 对话 API 指南:Python 多轮聊天示例 Gemini 系统指令指南:API 用法与 Python 示例 Gemini 上下文缓存指南:成本、延迟与 API 示例
AI Tool Blog Veo 3.1 学习中心

用 Veo 3.1 生成视频。

Google Veo 3.1 是 DeepMind 当前的视频生成模型。给它一段文字、一张图或一组参考图,它输出一段短片,并在同一遍生成里连对白、音效与环境音一起产出。

本页的能力、基准结论与使用渠道均取自 Google DeepMind 自家的 Veo 模型页;图库里的静帧也是该页Google 自己发布的演示截图。价格与可用性由 Google 决定,可能随时变动。

官方示例

Google 自家演示的画面

这六张是 Google 在 Veo 模型页的 showcase 区里配在自己演示片段旁的静帧,下面每一句提示词也都是 Google 为那段片段写的。它们是厂商自己的演示,不是我们生成的作品。

Google Veo 官方演示静帧:一只猫头鹰飞过月光下的森林
一只猫头鹰掠过月光下的森林,同时一只紧张的小獾开口说话。Google 的提示词把台词直接写进去了——画面和对白出自同一段提示词,这是该页用来演示对白的一组例子之一。
Google Veo 官方演示静帧:侦探在桌前审问一只橡皮鸭
侦探审问一只看起来心虚的橡皮鸭。Google 写的那句提示词里直接给了侦探的台词,这正是这组例子的用意:说出口的部分是和画面一起生成的,不是后期配上去的。
Google Veo 官方演示静帧:两名女子走在爱尔兰海岬上
1860 年代的爱尔兰海岬上,两名女子并肩行走——「她们粗糙土布的长裙在强烈的海风里轻轻翻动」。这是 Google 的原句提示词,也是这组演示的年代剧调性。
Google Veo 官方演示静帧:举着蜡烛的蜡制小人
一个淡黄色的小蜡人举着蜡烛,站在暖光室内。提示词把「材质」和「光」都写明了,而这两件事正是这一帧必须同时做对的地方。
Google Veo 官方演示静帧:键帽由糖果做成的键盘
一把键帽用不同糖果做成的键盘。Google 的提示词要求打字时发出「甜而脆的声响」,所以这段短片考的是声音设计,而不只是物件本身。
Google Veo 官方演示静帧:虹彩平原上的水晶花
暮色之下,一片覆雪的虹彩月尘平原,上方绽开三十英尺高的水晶花——图库里最超现实、也是尺度最大的一张。

示例图片版权归 Google 所有,此处署名转载: Google DeepMind 的 Veo 模型页

概览

Google 自己怎么介绍 Veo 3.1

Google 把 Veo 3.1 定位为「我们领先的视频生成模型,为电影人和叙事者而生」,整页围绕一个主张展开:画面和声音一起来。下面的图库、控制项与基准结论都来自那一页。

01

画面与声音同一遍产出

对白、音效与环境音都是原生生成的,不是事后配上去的。Google 给它的原话是「video, meet audio」,好几条演示提示词直接把台词写进了提示词本身。

02

控制细到单个镜头

除文字提示词外,模型还接受场景、角色或物件的参考图,风格参考图,首帧与末帧,以及「拉远、推近、上移、右移」这类机位指令。

03

能改素材,不必重做

Google 记录了在已有画面上做外扩、往画面里加入物件、从画面里移除物件、用最后一秒续接片段,以及用自己的身体、面部和声音驱动角色表演。

04

两档分辨率各有用途

官方记录的输出是 1080p 与 4K。Google 把 1080p 说成适合要和其他素材剪在一起的那一档,4K 则留给纹理和细节。

能力

Google 记录下来的控制项

Google 把这款模型的控制面分成若干标题,每一项都配一段片段演示。连起来看,它们回答的是一个很实际的问题——我到底能控制什么;下面每一项都是模型页上的一个标题,不是我们的引申。

01

素材合成(Ingredients to video)

你给场景、角色或物件的参考图,镜头围着这些参考搭起来。该页在这一节的提示词,用同一组参考分别要了一支广告、一支电影预告和一支音乐录影带。

02

套用风格(Match your style)

风格参考图负责画面观感,于是那些难以言传的质感——纸艺立体模型、绘画、某种调色——可以直接递一张图过去,而不用写成文字。

03

角色保持一致

角色参考图能让同一个角色的外观在分镜之间稳住,这是「多镜头成片」和「一堆互不相干的片段」之间的分界线。

04

延长场景

片段可以从最后一秒继续往下接,观感和声音保持一致;该页演示了把多条提示词这样串成一段更长的作品。

05

机位控制

构图与运动是明确设定的,而不是写在提示词里碰运气。该页列出四个:拉远、推近、上移、右移。

06

首帧与末帧

给两张图就能定义一次转场,中间的运动由模型补齐。

07

外扩、加入与移除物件

外扩把画幅向外撑开,让同一段素材适配不同比例的屏幕;另有单独的开关往场景里加入物件或把物件去掉,模型会一并考虑比例、交互与阴影。

08

角色与运动控制

表演可以用你自己的肢体、面部和声音来驱动;物件的运动可以靠画出你想要的路径来定义。

09

1080p 与 4K 输出

Google 记录了两档输出分辨率,并说明各自适合什么:1080p 是更利落的成片文件,4K 则用在纹理和细节比体积更重要的场合。

官方规格

Google 就 Veo 3.1 公布了什么

这里只放 Google 自己页面上说过的内容。模型页没给的数字——比如单段最长时长、每秒价格——这张表不会替它补上。

开发方
Google DeepMind
当前模型
Veo 3.1
类别
视频生成
输出
带原生音频的视频
输出分辨率
1080p 与 4K
官方记录的输入
文字提示词、图片、参考图、视频
官方记录的控制项
素材合成、风格参考、角色一致、场景延长、机位控制、首末帧、外扩、物件的加入与移除、角色与运动控制
水印
SynthID
面向普通用户
Gemini、Google Flow、Google Vids
面向开发者
Google AI Studio、Gemini API
基准页更新时间
2025 年 10 月
官方承认的不足
Google 表示,自然且连贯的口播音频——尤其是较短的口语片段——仍是开发中的课题。
怎么用上

官方列出的入口

Veo 3.1 是托管模型,每条路径都建在别人的账号上。Google 在模型页列了五个入口,下面每一行链接指向的都是 Google 自己指的那一个。

Gemini

面向普通用户的助手,Veo 在这里是一个单独列出的视频入口。

打开

Google Flow

Google 的 AI 影视工具,用来把片段拼成场景和故事。

打开

Google Vids

Google 办公套件里的视频功能,面向职场产出而非影视。

打开

Google AI Studio

从提示词到 API Key 的浏览器路径,自带一个 Veo 工作室应用。

打开

Gemini API

开发者路径,文档在 ai.google.dev,附可直接套用的提示词示例。

打开
常见问题

关于 Veo 3.1 的高频问题

Veo 3.1 是什么?

Google DeepMind 当前的视频生成模型。它用一段文字、一张图或一组参考图,生成带对白、音效与环境音的短片,声音和画面在同一遍里产出。

Veo 会连音频一起生成吗?

会,而且这是它最主打的卖点。Google 的原话是「video, meet audio」,图库整节都围绕这一点,好几条演示提示词直接把台词写进了提示词,而不是留给后期配音。

Veo 3.1 的输出分辨率是多少?

官方记录为 1080p 与 4K。Google 把 1080p 说成更适合剪辑的一档,4K 则用在纹理和细节上。

Veo 3.1 能改我已有的视频吗?

能对素材上手。官方记录的控制包括外扩画幅、加入物件、移除物件、用最后一秒续接片段,以及指定一次转场的首帧与末帧。

Veo 3.1 的片段有多长?

模型页没有给出单一的最大时长。它把「延长场景」写成做长片的办法,而各项对比测试的脚注里,评测片段是 6 秒或 8 秒。

Veo 的输出带水印吗?

带。Google 表示用 Veo 生成的视频会打上 SynthID——它用于标记和识别 AI 生成内容的技术;输出还会经过安全评估与记忆化检查再发布。

在哪些地方可以用 Veo 3.1?

Google 列了五个入口:Gemini、Google Flow、Google Vids、Google AI Studio 和 Gemini API。没有自托管或开放权重的路径。

已发布文章

最新 Google Veo 3.1 文章

浏览所有已发布的 Google Veo 3.1 文章,包括入门介绍、实用指南和开发者文档。