推荐搜索

GPT Image 简介 GPT Image 免费指南 GPT Image 开发文档 Midjourney 简介 Midjourney 免费指南 Midjourney 开发文档 Google Nano Banana 简介 Google Nano Banana 免费指南 Google Nano Banana 开发文档 Adobe Firefly Image 简介 Adobe Firefly Image 免费指南 Adobe Firefly Image 开发文档 FLUX 简介 FLUX 免费指南 FLUX 开发文档 Ideogram 简介 Ideogram 免费指南 Ideogram 开发文档 Recraft 简介 Recraft 免费指南 Recraft 开发文档 Stable Diffusion 简介 ByteDance Seedream 简介 Grok Imagine Image 简介 Google Veo 简介 Google Veo 免费指南 Google Veo 开发文档 Runway 简介 Kling AI 简介 ByteDance Seedance 简介 ByteDance Seedance 免费指南 ByteDance Seedance 开发文档 Luma AI 简介 Adobe Firefly Video 简介 Adobe Firefly Video 免费指南 Adobe Firefly Video 开发文档 Hailuo AI 简介 PixVerse 简介 PixVerse 免费指南 PixVerse 开发文档 Pika 简介 Pika 免费指南 Pika 开发文档 Alibaba Wan 简介 LTX Video 简介 Grok Imagine Video 简介 Google Gemini 简介 Google Gemini 免费指南 Google Gemini 开发文档 OpenAI GPT 简介 Claude Fable 简介 Claude Fable 免费指南 Claude Fable 开发文档 DeepSeek 简介 Qwen 简介 Llama 简介 Codex 简介 Codex 免费指南 Codex 开发文档 Cursor 简介 Cursor 免费指南 Cursor 开发文档 OpenClaw 简介 OpenClaw 免费指南 OpenClaw 开发文档 Perplexity 简介 ElevenLabs 简介 Suno 简介 Manus 简介 Claude 与 ChatGPT 怎么比:不借第三方数字 Claude 与 Gemini 怎么比:只有一侧能打开官方页面时 Adobe Firefly 免费吗:免费会员、积分与首年特惠 Adobe Firefly 价格:档位、生成积分与一张图的成本 Adobe Firefly Video 费用:每秒多少点、一条多少点 Adobe Firefly Video 免费吗:免费档的边界在哪 FLUX.2 提示词指南:官方文档写明的提示词结构 FLUX.2 与 Nano Banana Pro 对比:只看两家官方公布的部分 Ideogram 4.0 提示词指南:官方结构怎么用,文字怎么落对 Ideogram 价格:档位、积分与免费额度 Midjourney 提示词指南:结构、七类元素与 Edit Model 指令 Midjourney 价格:四档订阅、GPU 小时与一次任务花多少 Nano Banana Pro 价格:官方公布了什么,没公布什么 Nano Banana Pro 对比 Midjourney:哪个更适合你的工作流 Pika 积分:一条 Pika 2.5 视频花多少积分 Pika 免费吗?$0 档到底给什么 PixVerse 积分多少钱:先分清你在付哪本账 PixVerse 免费吗?两个免费档,各自要付什么 Recraft V4.1:八个变体怎么选 Recraft 价格与免费套餐:官方公布了哪些数字 Seedance 官网在哪:官方入口只有三个 Seedance 2.5 与 2.0 对照:官方公布的那几行 Veo 3.1 与 Sora 2 对比:两家官方页面各自还确认了什么 Veo 3.1 与可灵 3.0 对比:两家官方各自公布了什么 Claude 免费吗?$0 方案实际给了你什么 Claude 价格方案:Pro、Max 5x 与 Max 20x 怎么选 Adobe Firefly 怎么用:从入口到第一张图(Adobe Firefly Image 5) Adobe Firefly API 开发者接入:凭证、异步端点与 Image5 结构 Adobe Firefly Video 怎么用 Adobe Firefly 视频 API:/v3/videos/generate 端点解析 用 GPT Image 2.5 生成界面稿与 App Mockup 用 GPT Image 2.5 做表情包与透明贴纸 Nano Banana Pro 提示词指南:三份官方框架 Nano Banana Pro 免费吗?Google 官方到底确认了什么 Pika 2.5 怎么用:从官方入口到第一条视频 Pika API:官方开发者站、两层计费与调用三跳 PixVerse 怎么用:从选模型到第一条视频 PixVerse API 接入:独立平台、端点与积分 ByteDance Seedance 2.5 怎么用 Seedance API 接入:真实端点、模型 ID 与字段 Veo 3.1 提示词指南:Google 亲口点名的七个要素 Veo 3.1 价格与免费额度:官方公布了哪些数字 Claude 怎么用:从第一次对话到稳定产出 Claude API 接入:从 API key 到第一次调用 FLUX.2 怎么用:从官方入口到第一张图 FLUX.2 API 接入:官方 API 上手指南 GPT Image 2.5 与 DALL·E 3 怎么选 用 GPT Image 2.5 做信息图与流程图 Ideogram 怎么用:从注册到第一张带字的图 Ideogram API:接入、端点与图上文字渲染 Midjourney V8.2 怎么用 Midjourney API:有什么、没有什么 Nano Banana Pro 怎么用:从第一张图到可编辑的成品 Nano Banana Pro API 接入:从拿 key 到第一个请求 Recraft 怎么用:从注册到第一张可编辑矢量图 Recraft API 接入:官方端点、鉴权与风格一致性 Veo 3.1 怎么用:从第一条视频到能接着往下写 Veo 3.1 API 计费与 Vertex AI 接入 GPT Image 2.5 提示词分享 GPT Image 2.5 和 Nano Banana 2 怎么选 GPT Image 2.5 和 Seedream 5.0 Pro 对比 GPT Image 2.5 和 FLUX 2 对比 GPT Image 2.5 和 Ideogram 对比 GPT Image 2.5 免费吗 GPT Image 2.5 Sketch 草图怎么用 GPT Image 2.5 模板功能 GPT Image 2.5 评论标注 GPT Image 2.5 形象一致性 GPT Image 2.5 多图合成 GPT Image 2.5 中文文字渲染 GPT Image 2.5 是什么 GPT Image 2.5 API 总览 Codex 和 ChatGPT:编码场景下该用哪一个? Codex CLI、IDE 扩展、应用还是云端:按场景选择使用形态 你的第一个 Codex 低风险编程任务:从建基线到回滚 Cursor 是什么?它的 AI 编程工作流详解 Cursor 和 VS Code:哪款编辑器更适合你的工作流? Cursor 功能详解:Agent、Tab、上下文与更多 Gemini 是什么?模型、应用、Google AI Studio 与 API 一文讲清 Gemini Apps 与 Gemini API:根据任务选对工具 Gemini 能做什么?一份实用的能力指南 OpenClaw Foundation 是什么:治理、归属与独立性 OpenClaw Skill Workshop 使用指南:审查可复用技能 OpenClaw Skill Card:读懂 ClawHub 技能安全扫描 OpenClaw 2.0 更新指南:新功能、升级检查与使用变化 OpenClaw LTS 与 extended-stable 怎么选:版本通道指南 OpenClaw 安装教程:桌面版、脚本、npm 与源码方式对比 OpenClaw Node.js 环境配置:版本要求、安装与 PATH 排障 如何编写更好的 Codex 提示词:实用框架 提交前如何审查 Codex 代码变更 Cursor 新手入门教程:从安装到完成第一次代码修改 Cursor Rules 教程:项目规则、用户规则与 AGENTS.md Cursor Windows 安装与中文设置教程 Cursor MCP 配置教程:连接、验证与安全设置 Gemini 提示词怎么写:结构、模板与优化方法 Gemini API 教程:Key、Python SDK 与首次调用 Gemini 网页版使用教程:登录、文件与隐私设置 Gemini API Key 创建与安全配置指南 Codex 是什么?从能力边界到使用入口的完整解释 Codex 新手教程:从选择项目到验收第一个任务 Codex CLI 安装教程:登录、首次运行与安全检查 Codex AGENTS.md 指南:发现顺序、分层规则与验证方法 Codex CLI 常用命令:交互、状态、审查与自动化 Gemini怎么用:网页版、安卓与iPhone安装指南 Gemini功能详解:对话、文件、绘图与Gemini Live Gemini AI对话指南:提示词、追问与Gemini Live Gemini AI绘图指南:图片生成、提示词与编辑方法 Gemini与GPT-4对比:功能、限制和适用场景 Gemini AI助手指南:手机、应用连接与隐私设置 Gemini 提示词工程指南:方法、模板与示例 Gemini 对话 API 指南:Python 多轮聊天示例 Gemini 系统指令指南:API 用法与 Python 示例 Gemini 上下文缓存指南:成本、延迟与 API 示例
AI Tool Blog Wan3.0 学习中心

用 Wan3.0 一次生成 30 秒完整叙事。

Wan3.0 是阿里当前的视频模型。单次生成最长可达 30 秒——上一代还停在 15 秒——而且它的参考输入包含文档与网页,不只是文字和图片。

本页的能力与规格来自阿里的 Wan 产品页、百炼文档与 Wan3.0 正式上线公告。价格由厂商设定,随时可能调整。

官方示例

Wan3.0 能生成什么

这些画面取自阿里为 Wan3.0 公布的演示视频封面。它们覆盖了这次发布主打的几个方向:光照模拟、动作编排,以及有真实纵深感的室内空间。

Wan 3.0 官方示例:两名身披铠甲的人物举着发蓝光的兵器对峙
动作编排:两名身披铠甲的人物举着发蓝光的兵器对峙,正是发布说明里点名的那类打斗调度。
Wan 3.0 官方示例:晴空下孤零零的沙漠加油站
日光模拟:晴空下一座孤零零的沙漠加油站,阴影与空气感都得跟太阳对得上。
Wan 3.0 官方示例:披斗篷的人物带着几匹黑马涉水前行
尺度与运动:一名披斗篷的人物带着几匹黑马涉水前行,马匹在运动中始终保持清晰可辨。
Wan 3.0 官方示例:明亮厨房中站在冰箱前的白发人物
室内纵深:明亮的厨房里,一名白发人物站在冰箱前——产品场景要显得可信,靠的就是这种日常空间。
Wan 3.0 官方示例:在大雨中拉大提琴的乐手
演奏与天气:一名乐手在大雨中拉大提琴,琴体、双手与落下的雨水都得稳住。

示例图版权归阿里所有,此处署名并链回原页: Wan 官方站

它是什么

阿里自己怎么描述 Wan3.0

阿里把 Wan3.0 卖在一个数字上——单次 30 秒——以及一类全新的输入上。官方公告对这两点的表述相当具体,也包括尚未做完的部分。

01

30 秒就是差异点

Wan2.7 的窗口是 2 至 15 秒,Wan3.0 单次最长 30 秒。这换来的是叙事节奏与连续运镜的空间,而不只是一个镜头;让这块更长的画布可用的还有两件事:模型会根据提示词推荐时长,片段还能续写。

02

万物皆可成片

除文本、图片、音频和视频之外,Wan3.0 还能读文档与网页——DOC、XLS、PPT、PDF、TXT、KEY、Pages、Numbers 与 Markdown,每次一个文件或链接,上限 100MB、50 页。产品 PPT 可以变成发布片,表格数据可以变成动态图表。

03

把一致性当产品要求

阿里把这次升级放在「身份、音色与口型在整段序列里保持一致」上:角色、道具、空间、光照与风格都要稳,无论是一段高速动作戏,还是一场多语言表演。

04

厂商自己写的保留意见

阿里的正式上线公告直说:音频质感与画面内文字渲染的准确度仍在完善中。这比营销页上的说法要窄得多,也是决定能不能交付前该看的一句。

API 定价

按分辨率计费的每秒价格

阿里对 Wan3.0 按生成视频的秒数计费,费率只跟分辨率有关。以下是 2026 年 8 月 24 日正式上线以来国际渠道的标准原价。

分辨率 计费方式 原价
480P 按生成秒数 $0.05
720P 按生成秒数 $0.10
1080P 按生成秒数 $0.20

按此费率,480P 的 30 秒草稿约 1.50 美元,1080P 的 30 秒成片约 6.00 美元,均未计活动折扣。阿里国内平台的同一三档价格为每秒 0.30 / 0.60 / 1.20 元。

能力

Wan3.0 主打的能力

以下是阿里在产品页上列出的能力,用厂商自己的说法。

01

参考生视频

把参考的角色带进新场景,支持多人及人与物的交互,外观与声音保持一致。

02

图生视频

官方原话:可生成最长 30 秒的视频,并自动分镜,让原生音画更稳定。

03

文生视频

官方原话:电影级精度,运动复杂且提示词执行高度可靠。

04

视频编辑

多维度的指令式编辑,可以改写画面、剧情与环境,而不必把整个创意重新生成一遍。Wan2.7 引入、Wan3.0 承接下来。

05

电影级控制

光照、调色与构图按电影级标准调整,官方点名了复杂动作编排与物理模拟。

06

沉浸式视听

双耳声场并支持地方口音,音频跟着画面的节奏走,声画一起呼吸。

规格

官方公布的规格

下表每一行都出自阿里的百炼文档或正式上线公告。

开发商
阿里(Alibaba)
当前模型
Wan3.0
模型 ID
wan3.0-video
单次生成
最长 30 秒
输出分辨率
480P、720P、1080P
时长辅助
智能时长推荐与视频续写
参考输入
最多 10 张图、5 段视频、5 段音频
文档输入
DOC、XLS、PPT、PDF、TXT、KEY、Pages、Numbers、Markdown
文档限制
每次一个文件或链接,上限 100MB、50 页
音频
随画面一同生成,含口型同步
视频编辑
内置,由 Wan2.7 承接下来
权重
未公开
怎么用

官方公布的接入渠道

Wan3.0 于 2026 年 8 月 24 日在阿里云国际渠道正式上线,按秒计费。阿里也为该系列的早期模型公布了可下载的权重。

Wan 官方站

阿里的产品页,本页引用的能力清单就出自这里。

打开

百炼上的 Wan3.0

该模型在阿里云平台上的文档:输入模态、三档分辨率与 30 秒上限。

打开

正式上线公告

阿里自己写的发布说明,含价格表与关于音频和画面内文字的保留意见。

打开

开源发布

阿里为该系列的早期模型公布了可下载权重,最高到 Apache 2.0 的 Wan 2.2。Wan3.0 本身没有公开权重,所以这个仓库是该系列的开源那一半,不是这个模型。

打开

第三方平台

Wan3.0 也通过第三方 API 平台提供。模型是同一个,价格、速率限制与条款则适用对方自己的。

常见问题

关于 Wan3.0

Wan3.0 单次最长能生成多久?

一次最长 30 秒,最高 1080P。阿里称模型会分析提示词并推荐时长,生成的片段还能续写下去。

Wan3.0 会自己做声音吗?

会。原生音频与画面一起生成,含口型同步。阿里的正式上线公告也说明音频质感仍在完善,所以声音适合当作要复核的部分,而不是直接交付。

可以喂给 Wan3.0 一份文档吗?

可以,这正是它真正新的输入类别。除网页外还接受 DOC、XLS、PPT、PDF、TXT、KEY、Pages、Numbers 与 Markdown,每次一个文件或链接,上限 100MB、50 页。

一次最多能组合多少参考素材?

官方列表写的是单次最多 10 张图、5 段视频与 5 段音频,此外还可以再加一个文档或网页输入。

Wan3.0 的权重开源吗?

不开源。阿里没有为 Wan3.0 公布权重,它通过阿里云百炼与第三方平台提供。这个系列可下载的版本止于以 Apache 2.0 发布的 Wan 2.2。

Wan3.0 的 API 怎么收费?

国际渠道的标准原价是 480P 每秒 0.05 美元、720P 每秒 0.10 美元、1080P 每秒 0.20 美元,因此 30 秒 1080P 约 6.00 美元(未计折扣)。国内平台同一三档为每秒 0.30 / 0.60 / 1.20 元。

Wan3.0 能改我已有的视频吗?

能。视频编辑由 Wan2.7 引入,Wan3.0 承接下来:画面、剧情与对白都能改,不必把整个创意重新生成一遍。