Black Forest Labs 发布 Flux 3 Image:单端点做多步局部编辑,AI 图像生成怎么选?
Black Forest Labs 于 2026 年 10 月 1 日发布 Flux 3 Image 图像生成模型,支持文本生成图像、图像编辑、局部精确编辑和场景合成。核心创新是单端点设计:prompt 本身决定是生成还是编辑,无需切换 mode。支持 bounding box 布局(在 prompt 中用 JSON 列表定位元素)、最多 10 张参考图、15 种宽高比、最高 4K 输出。API 按图计价,768sq 分辨率 $0.041/张,4K 分辨率 $0.607/张。
核心结论
Black Forest Labs 于 2026 年 10 月 1 日发布 Flux 3 Image,这是 Flux 3 多模态模型家族的图像支柱。核心创新是"单端点"设计:同一个 API 端点同时处理图像生成和图像编辑,由 prompt 内容自动决定工作流,无需设置 mode 参数。支持 bounding box 布局合成、像素级精确局部编辑(改一处不动其他)、最多 10 张参考图组合、15 种宽高比、最高 4K(约 1600 万像素)输出。API 按张计价,768sq 分辨率 $0.041/张,4K 分辨率 $0.607/张。
单端点设计:为什么这是重要创新?
传统图像 API 将生成和编辑分成不同端点或模式参数。Flux 3 Image 的创新在于:prompt 本身决定操作类型。
- 想生成新图?写一段描述性 prompt
- 想编辑现有图?在 prompt 中指定要改的元素
- 想用 bounding box 布局?在 prompt 末尾加 JSON 列表
不需要 mode 字段,不需要切换端点。这意味着开发者可以用同一个 API 调用处理用户上传图片的编辑和新图生成两种场景,大幅简化应用逻辑。
核心功能详解
1. Bounding Box 布局合成
在 prompt 末尾添加 JSON 格式的 bounding box 列表,可以精确定位每个元素在画面中的位置:
- 把标题放在左上角
- 在人群中定位一张脸
- 创建网格面板布局
Bounding box 直接写在 prompt 文本中,没有单独的参数字段。这种设计让布局信息成为 prompt 语义的一部分,模型能更好地理解元素间的关系。
2. 像素级精确局部编辑
标记要修改的元素,保持画面其余部分完全不变:
- 重着色(Recolor):改颜色
- 替换(Replace):换内容
- 移动(Move):调位置
- 缩放(Resize):改大小
- 移除(Remove):删元素
关键:一次请求可以同时编辑多个元素。这不是简单的 inpainting — 模型理解元素间的语义关系,编辑一个元素时会自动调整光照、阴影、反射等关联部分。
3. 多参考图合成
最多支持 10 张参考图:
- 在 prompt 中用位置名称引用每张图(如"用图 1 的风格、图 3 的构图")
- 可以将参考图重风格化
- 可以将多张参考图的元素组合成新画面
4. 分辨率与宽高比
| 分辨率参数 | 约等于 | 适用场景 |
|---|---|---|
768sq | ~59 万像素 | 快速预览 |
1k | ~100 万像素 | 标准质量 |
2k | ~400 万像素 | 高质量 |
4k | ~1600 万像素 | 专业级 |
支持 15 种宽高比,覆盖从正方形到宽屏到竖屏的主流比例。
API 定价
| 分辨率 | 单价 | 说明 |
|---|---|---|
768sq | $0.041 | 最经济,适合批量预览 |
1k | $0.048 | 标准质量 |
2k | $0.100 | 高质量 |
4k | $0.607 | 顶级分辨率 |
按张计价,分辨率是唯一价格变量。无 token 计费、无额外参数费用。
与竞品对比
Flux 3 Image 发布时,Ideogram 也刚发布 4.5 版本,同样主打编辑能力并计划开源权重。两者的差异:
| 维度 | Flux 3 Image | Ideogram 4.5 |
|---|---|---|
| 核心卖点 | 单端点统一生成+编辑 | 精确编辑不破坏原图 |
| Bounding box | 原生支持 | 未提及 |
| 参考图数量 | 最多 10 张 | 未明确 |
| 最大分辨率 | 4K (~16MP) | 未明确 |
| 开源权重 | 未来几周内发布 | 未来发布 |
| API 定价 | $0.041-$0.607/张 | 未明确 |
Black Forest Labs 的 Flux 系列一直是开源图像模型领域的标杆,Flux 3 Image 的开源权重版本预计在未来几周内发布。
开发者集成指南
API 调用
所有操作通过同一个端点完成:
POST /api-reference/utility/generate-an-image-with-flux-3
请求体中只需 prompt 和 resolution 参数。生成还是编辑、是否用 bounding box,全部由 prompt 内容决定。
典型工作流
场景 1:生成新图
prompt: "A serene mountain landscape at golden hour, snow-capped peaks"
resolution: "2k"场景 2:局部编辑
prompt: "Replace the red car with a blue bicycle [image: user_uploaded.jpg]"
resolution: "2k"场景 3:Bounding box 布局
prompt: "A magazine cover layout [
{box: [0.1, 0.05, 0.9, 0.15], text: "headline"},
{box: [0.05, 0.2, 0.45, 0.5], image: "portrait"},
{box: [0.5, 0.2, 0.95, 0.95], image: "landscape"}
]"
resolution: "4k"适用场景分析
适合 Flux 3 Image 的场景
- 电商商品图编辑:换颜色、换背景、移除不需要的元素,保持商品主体不变
- 营销素材批量生成:同一布局模板,批量替换文字和图片元素
- 社交媒体内容创作:快速生成不同宽高比的图片
- UI/UX 原型:用 bounding box 快速布局界面元素
- 多参考图合成:将多张产品图的风格、构图元素融合成新图
不太适合的场景
- 需要精细控制每一步推理过程的复杂编辑(考虑多步 API 调用链)
- 需要极低延迟的实时交互(图像生成本质上是秒级操作)
- 需要完全离线运行(目前 API only,开源权重版未来发布)
行业背景
Flux 3 Image 是 Black Forest Labs 更大多模态战略的一部分。Flux 3 模型家族计划统一图像、视频和音频生成,基于"Self-Flow"联合学习架构。Flux 3 Image 是这个愿景的图像支柱,视频和音频模块预计后续发布。
图像生成 API 市场在 2026 年竞争激烈,但 Flux 3 Image 的"单端点+bounding box+多参考图"组合在开发者体验上有独特优势——特别是对于需要同时处理生成和编辑的应用,单端点设计可以显著简化代码架构。
开发者行动建议
- 试用免费 Demo:Black Forest Labs 提供了 在线编辑 Demo,可以直接体验多步编辑
- 评估 API 集成:如果你的应用同时需要生成和编辑,单端点设计可以替换现有的多端点逻辑
- 关注开源权重:如果需要离线部署或微调,等待开源权重版本发布
- 对比定价:$0.041/张(768sq)在图像 API 中属于经济档,适合需要大量生成的场景
- 测试 bounding box:如果你的应用涉及布局合成(如海报、杂志封面),bounding box 功能值得优先测试
信息来源:Black Forest Labs 发布说明、Flux 3 Image API 文档、Bounding Box 教程、在线编辑 Demo、The Decoder 报道
赚钱视角
这个趋势怎么赚钱?
WayToClawEarn 的差异在可验证的赚钱案例,而不只是资讯。从这些复盘开始:
浏览全部案例 →