Flux 3 Image 新增了什么
Flux 3 Image 由 Black Forest Labs 在 2026 年 10 月 1 日发布,生成和编辑走同一个接口。它新增了四种控制方式,本指南后面逐项讲解。Black Forest Labs 在Flux 3 Image 官方文档里对每一项都有说明。
做海报版面、产品图和多图合成时,最先用到的是边界框和多参考图。
| 控制方式 | 作用 | 什么时候用 |
|---|---|---|
| 边界框 | 把每个元素放在 0 到 1000 的网格上 | 位置本身就是需求的一部分 |
| 编辑指令 | 只改你点名的部分,其余保留 | 某个细节不对 |
| 最多 10 张参考图 | 按位置编号合并多张图 | 画面里必须出现真实的产品、人物或房间 |
| 最高 4K 输出 | 从 768 px 草稿到 4K,共五种尺寸 | 要印刷,或者之后还要裁剪 |
怎么写 Flux 3 Image 提示词
按这个顺序描述:媒介、主体、环境、光线、取景。写画面里该有什么,不写不该有什么。“一条空荡荡的街”,比“一条没有车的街”管用。

一张杂志风格的摄影,画面是一间空无一人的公共阅览室:两侧墙边是高大的橡木书架,长桌上摆着绿色灯罩的台灯,冬日低角度的阳光穿过高处的拱形窗,落成一道道长长的光束。平视的广角画面,35mm 镜头,安静而温暖。
Flux 3 Image 的边界框版面提示词
版面提示词分两部分。第一部分是一段画面描述,在每个元素后面用短 id 做标记。第二部分是每个 id 一行,写明它的框和描述。框按“上、左、下、右”的顺序排列,每个方向都取 0 到 1000 的数字,所以同一组数字放到任何宽高比上都适用。先定宽高比,每一块文字单独占一行。
| 部分 | 写什么 | 例子 |
|---|---|---|
| 画面描述 | 描述整个场景,每个元素后面跟一个 id | 游泳者 <swimmer_1> 在标题 <title_1> 下方 |
| id | 简短、小写、带编号 | swimmer_1, title_1 |
| bbox | 按上、左、下、右排列,范围 0 到 1000 | [620, 380, 900, 620] |
| desc | 外观、颜色、姿势和确切的文字 | 文字内容为“NIGHT TIDE”,奶白色大写字母 |
id、bbox、desc 这三个键名保持英文,描述的内容用中文写。

用 Flux 3 Image 改图:一条指令,三个部分
Flux 3 Image 没有蒙版,也没有单独的编辑模式。把图片发过去,把改动写成一条指令:先点名目标,再说怎么改,最后列出要保留的部分。数值要精确时就直接写:颜色写十六进制色值,文字写在引号里。
Flux 3 Image 合并最多 10 张参考图
用位置编号指代每张图,并给每张图分配一个任务。Flux 3 Image 按顺序读取它们。不设宽高比的话,输出会沿用图 1 的形状。
| 角色 | 提供什么 | 怎么说 |
|---|---|---|
| 场景 | 所有东西要放进去的房间或地点 | 图 1 里的客厅 |
| 产品 | 形状和质感必须保持的物体 | 图 2 里的扶手椅 |
| 材质 | 颜色、面料或纹理 | 椅面用图 3 里的面料 |
| 主体 | 需要保持可辨认的人或动物 | 图 4 里的女士 |
Flux 3 Image 逐框编辑:保留、移动、新增、删除
改动必须落在某个确切的元素上时,原图也用逐行的方式描述。每一行写明元素现在在哪、最后要到哪,模型据此知道哪些保留、哪些移动、哪些新增。
| 行类型 | 怎么写 | 效果 |
|---|---|---|
| 保留 | 改动前后用同一个框 | 原地不动 |
| 移动 | 先写旧框,再写新框 | 移动或缩放这个元素 |
| 新增 | 没有来源,只有目标框和描述 | 在框内添加、替换或改色 |
| 删除 | 写出它的框,不写目标 | 把它去掉,并补全空出的位置 |
Flux 3 Image 的分辨率、宽高比与联网检索
先用小图出草稿,再用大图出定稿。换一个分辨率就是重新生成一次,所以草稿和定稿的构图可能会有出入。
| 设置 | 选项 | 怎么做 |
|---|---|---|
| 分辨率 | 768 px 方图、1K、1.5K、2K、4K | 768 px 试稿,2K 或 4K 定稿 |
| 宽高比 | 15 种,从 21:9 到 9:21,另有自动 | 画框之前先选好 |
| 自动比例 | 跟随图 1,没有图就用方图 | 改图时保持开启 |
| 联网检索(grounding) | 网页搜索和图片搜索,默认开启 | 要更快出草稿就关掉 |
| 开放权重 | 目前是商用许可,以后开放 | 关注 Black Forest Labs 的发布 |
常见问题
按媒介、主体、环境、光线、取景的顺序描述,并且全部用肯定句:写“一条空荡荡的街”,不写“没有车”。提示词和宽高比要对得上,宽画幅需要有东西填满它的宽度。
每个框是四个数字,依次是上、左、下、右,取值在 0 到 1000 的网格上,换任何宽高比都不变。先在画面描述里给每个元素标一个 id,比如 swimmer_1,再为每个 id 写一行,写明它的框和描述。
按位置占整幅画面的千分比来算。比如标题要放在顶部约四分之一的高度、水平居中偏宽,就写成 [0, 100, 250, 900]:上边 0,左边 100,下边 250,右边 900。网格不随宽高比变化,所以竖版的小红书封面和横版的海报可以共用同一套换算。
不用。先写一条文字指令。几个相似物体都符合描述、改动需要精确的位置或大小,或者想移动、删除某个具体元素时,再加框的行。
按位置:图 1、图 2,一直到图 10。给每一张分配一个角色,比如场景、产品或材质,并说明它们怎么组合。
可以。把文字写在引号里,再点明大小写、颜色、字体风格和对齐方式。版面提示词里,每一块文字单独占一行、单独一个框。中文字的效果本指南没有单独验证,建议先用小图试,每块文字控制在一行短句内。
调提示词时用 768 px 方图出草稿,定稿再用 2K 或 4K 渲染。默认的 1K 适合大多数网页图片。
Flux 3 Image 即将登陆 Morphic。本指南里的编辑和多参考图提示词,现在就能配合 Morphic 上已有的图片模型使用,页面上的每个示例也都是这样做出来的。




