FLUX 是 Black Forest Labs 的图像模型产品线,它今天的官方页面所记录的代际是 FLUX.2 —— FLUX.2 [pro]、FLUX.2 [flex] 与 FLUX.2 [klein] 都属于这一族。它是一个模型族,而不是单一权重,所以「FLUX 怎么用」实际上是两个问题:选哪个档位,以及在哪里跑。
下面按官方口径讲五件事:档位怎么分、能在哪几个入口用、第一张图怎么一步步做出来、一份带参考图与 HEX 色值的实战提示词,以及官方没有公布的数字。
FLUX.2 是什么
模型页的标题就是 FLUX.2 [pro] | [flex],它自己的描述句概括了整个代际:面向生产环境的图像生成与编辑,4MP 照片级输出,多图参考控制。
官方文档列出五个档位,选 FLUX.2 就等于选其中一个,因为它们在画质、速度、可控性与交付方式上互相取舍。
| 档位 | Black Forest Labs 官方对它的说明 |
|---|---|
| FLUX.2 [max] | 顶级生成与编辑,支持结合网络检索的生成 |
| FLUX.2 [pro] | 「在最高速度下保持一流画质,两者兼得」——面向生产的档位 |
| FLUX.2 [flex] | 最高精度,推理步数与引导强度可调 |
| FLUX.2 [klein] | 最快的一族,官方写的是亚秒级推理 |
| FLUX.2 [dev] | 开放权重,官方写的是仅本地部署、不提供托管 API |
发布博客把背后的架构写成一句话:一个 Mistral-3 24B 视觉语言模型搭配 rectified flow transformer,编辑图像最高到 4 百万像素。
代际关系值得交代一句:官方在 2026 年 7 月发布了 FLUX 3,定位是覆盖图像、视频与音频的多模态模型;FLUX.2 仍是官方文档里图像生成与编辑的那一代。
现在能在哪些入口用 FLUX.2
官方文档给了四条路,彼此不能互换。
| 入口 | 官方页面的说法 |
|---|---|
| 在线试用 | playground.bfl.ai 的浏览器试用,官方写的是免注册、免信用卡 |
| 官方 API | 用 dashboard 里创建的 API key 调用端点 |
| MCP 服务 | mcp.bfl.ai 的官方服务,用 OAuth 登录,不用管 key |
| 自托管 | 开放权重的 [dev] 档,跑在自己的硬件上 |
账号从 dashboard 开始:在 dashboard.bfl.ai 注册、验证邮箱、充值 credits、再创建 key。官方那句提醒值得重复——key 只在创建时显示一次,绝不能放进客户端代码。
想在代码里调用,FLUX.2 API 接入指南接着讲请求本身;这一族的其余文档收在 FLUX.2 主题页里。这里刻意不写价格:不少网站按自己的积分套餐转售 FLUX.2,那些价格属于那家网站,不属于 Black Forest Labs。
第一张图:分步做出来

第一次跑通是把流程走一遍,不是出最好的那张图。
- 先定档位。出生产图用 [pro],版式文字决定成败时用 [flex],还在探索阶段用 [klein]。
- 按官方顺序造句:主体、动作、风格、上下文。FLUX.2 更看重排在前面的内容。
- 认真定尺寸。两条边必须是 16 的倍数,上限 4MP,官方建议多数场景不超过 2MP。
- 把颜色绑到物体上。单独一个 HEX 色值几乎不起作用,官方说色值要明确关联到具体物体才最有效。
- 每轮只改一处,其余原样保留,这一轮才能告诉你哪个词改变了画面。
负向提示词不用写:官方指南直接写明 FLUX.2 不支持负向提示词,所以每一句「不要 X」都要改写成对画面的正面描述。这个习惯来自更早的开放权重模型,大多数人是看 Stable Diffusion 指南学会的。
实战示例:一张产品图和一个多图参考场景
两个案例用的是同一套四段式句子,唯一的变量是档位。
第一个案例要求文字必须站住:一瓶胶囊,标签必须和参考图完全一致。
主体:一瓶装满胶囊的玻璃罐立在哑光混凝土台面上,正面居中,标签朝向镜头,上面是衬线体的奶油色「BFL」字样
动作:罐子静止不动,画面里没有任何移动
风格:影棚产品摄影,左上方一盏大柔光主灯,右侧一盏柔和轮廓光,冷灰色无缝背景,罐子下方有柔和的接触阴影
上下文:附上标签的参考图;标签上的字形、奶油色,以及每颗胶囊上的小松树图案都要与该参考图完全一致
颜色:标签奶油色为 #F2E8D5,松绿为 #1F4D3A;每个色值只用在它所属的物体上
尺寸:2048x2048,4MP,除标签外画面里不出现任何文字
之后要检查的只有三处:标签上的字形、每颗胶囊上的图案,以及灰色背景有没有被参考图带偏成暖色。先垮的通常是小字,这正对应官方模型卡里承认的局限——模型能输出文字,但渲染出来的字可能不准或变形。把标签那一句挪到最前面再跑一轮,比加长描述更有效,因为官方指南点明顺序才是关键。
第二个案例就是上面那张图里的场景。三张参考图,三个画面,一套光:
主体:一只雪豹、一只小熊猫和一只企鹅,各自坐在一台堆叠起来的电视机上
动作:三只动物都保持不动,看向镜头
风格:纪实摄影,一盏来自左前方的主光照亮三个画面,冷灰色背景,全画面颗粒一致
上下文:图一是雪豹,图二是小熊猫,图三是企鹅;每只动物的斑纹与毛色都要与各自的参考图一致,并且光是共用的,不按画面分别打光
颜色:背景灰为 #B9BDC1
尺寸:2048x1152
这里的翻车点不在动物,而在光:每张参考图都带着自己的光照,提示词必须说明光是共用的。这正是多图参考存在的理由,也是档位差异显现的地方——官方总览文档写 API 最多 8 张参考图、playground 最多 10 张,而 [klein] 写的是最多 4 张。如果你主要做版式排版,我们记录的另一条线在 GPT Image 指南里。
一份能反复用的提示词结构
上面两个案例共用同一副骨架,正是它让好结果能被复现,而不是靠运气。
每次都值得写的几块
官方框架是四段,下面这几块是它的落地写法。同一份指南还给了长度参考:10–30 词、30–80 词,或 80 词以上。
主体:画面里是谁或什么,写在最前面
动作:发生了什么变化,或者说明没有变化
风格:介质、光源与方向、表面与颗粒
上下文:每张参考图是干什么用的,哪些必须保持一致
颜色:每个 HEX 色值都绑到它所属的物体上
尺寸:具体尺寸,保持 16 的倍数且不超过 4MP
负向句子在这份清单里没有位置,因为模型不读它们。把「没有」改写成「有什么」:点明填满画面的背景。
FLUX.2 的短处在哪
Black Forest Labs 自己公布了局限,这一点值得引用:渲染出来的文字可能不准或变形;模型可能生成与提示词不符的结果;提示词遵循程度受提示词写法影响很大。[klein] 还多一条:不带 prompt upsampling。
限制、费用,以及官方没公布的部分
硬限制是公布的:所有操作最高输出 4MP,最短边 64 像素,两条边都要是 16 的倍数,多数场景建议不超过 2MP。参考图计费而不是白送——不论输出分辨率,每张都按 1MP 计费。[pro] 的 API 把输入加输出限制在 9MP 以内,所以 1MP 输出能放 8 张参考图,2MP 输出能放 7 张。
费用按 credit 计,官方也公布了:1 credit 等于 0.01 美元,API 与 playground 同价,[pro] 文生图从每 MP 0.03 美元起;批量请求按张数乘以基础价。
没公布的部分同样重要。官方没有公布免费 API 额度——[klein] 页面上那个免费入口是 playground 试用,和免费额度是两回事。官方页面上没有公布任何评分、榜单,也没有与竞品的正面对比。托管档位也没有公布统一的参数量。
常见问题
要试 FLUX.2 必须付钱吗? 官方把 playground 试用写成免费、免注册、免信用卡。免费 API 额度没有公布。
从哪个档位开始? 出生产图选 [pro],排版决定成败选 [flex],最看重速度选 [klein],需要自己部署选 [dev]。
能用负向提示词吗? 不能——官方指南写明 FLUX.2 不支持负向提示词,改成描述画面里应该有什么。
最多能给几张参考图? API 最多 8 张,playground 最多 10 张;[klein] 官方写的是最多 4 张。
权重开放吗? 官方写为开放权重的是 [dev] 档,描述是仅本地部署、不提供托管 API。其余档位的权重授权在官方页面上逐档说明。
FLUX 3 都出了,这篇是不是过时了? 不是。FLUX 3 是更新的多模态代际,也覆盖视频与音频;FLUX.2 仍是模型页上图像生成与编辑的那一代。
把这套流程学一次——每轮只改一处,先定形态再定风格,参考图数量对着预算来——FLUX.2 就不像老虎机了。