WayToClawEarn
中等影响Black Forest Labs Docs

Black Forest Labs 发布 Flux 3 Image:单端点做多步局部编辑,AI 图像生成怎么选?

Black Forest Labs 于 2026 年 10 月 1 日发布 Flux 3 Image 图像生成模型,支持文本生成图像、图像编辑、局部精确编辑和场景合成。核心创新是单端点设计:prompt 本身决定是生成还是编辑,无需切换 mode。支持 bounding box 布局(在 prompt 中用 JSON 列表定位元素)、最多 10 张参考图、15 种宽高比、最高 4K 输出。API 按图计价,768sq 分辨率 $0.041/张,4K 分辨率 $0.607/张。

Edisen Lu · WayToClawEarn来源 Black Forest Labs Docs发布 2026年10月2日

基于公开来源复核 · AI 辅助整理,编辑把关。 内容方法 · 原始来源

公开来源汇编

综合公开帖文/文档整理。一手主张请优先核对原始来源。

我们如何审核内容 · 一手来源 · Black Forest Labs Docs

核心结论

Black Forest Labs 于 2026 年 10 月 1 日发布 Flux 3 Image,这是 Flux 3 多模态模型家族的图像支柱。核心创新是"单端点"设计:同一个 API 端点同时处理图像生成和图像编辑,由 prompt 内容自动决定工作流,无需设置 mode 参数。支持 bounding box 布局合成、像素级精确局部编辑(改一处不动其他)、最多 10 张参考图组合、15 种宽高比、最高 4K(约 1600 万像素)输出。API 按张计价,768sq 分辨率 $0.041/张,4K 分辨率 $0.607/张。

单端点设计:为什么这是重要创新?

传统图像 API 将生成和编辑分成不同端点或模式参数。Flux 3 Image 的创新在于:prompt 本身决定操作类型。

  • 想生成新图?写一段描述性 prompt
  • 想编辑现有图?在 prompt 中指定要改的元素
  • 想用 bounding box 布局?在 prompt 末尾加 JSON 列表

不需要 mode 字段,不需要切换端点。这意味着开发者可以用同一个 API 调用处理用户上传图片的编辑和新图生成两种场景,大幅简化应用逻辑。

核心功能详解

1. Bounding Box 布局合成

在 prompt 末尾添加 JSON 格式的 bounding box 列表,可以精确定位每个元素在画面中的位置:

  • 把标题放在左上角
  • 在人群中定位一张脸
  • 创建网格面板布局

Bounding box 直接写在 prompt 文本中,没有单独的参数字段。这种设计让布局信息成为 prompt 语义的一部分,模型能更好地理解元素间的关系。

2. 像素级精确局部编辑

标记要修改的元素,保持画面其余部分完全不变:

  • 重着色(Recolor):改颜色
  • 替换(Replace):换内容
  • 移动(Move):调位置
  • 缩放(Resize):改大小
  • 移除(Remove):删元素

关键:一次请求可以同时编辑多个元素。这不是简单的 inpainting — 模型理解元素间的语义关系,编辑一个元素时会自动调整光照、阴影、反射等关联部分。

3. 多参考图合成

最多支持 10 张参考图:

  • 在 prompt 中用位置名称引用每张图(如"用图 1 的风格、图 3 的构图")
  • 可以将参考图重风格化
  • 可以将多张参考图的元素组合成新画面

4. 分辨率与宽高比

分辨率参数约等于适用场景
768sq~59 万像素快速预览
1k~100 万像素标准质量
2k~400 万像素高质量
4k~1600 万像素专业级

支持 15 种宽高比,覆盖从正方形到宽屏到竖屏的主流比例。

API 定价

分辨率单价说明
768sq$0.041最经济,适合批量预览
1k$0.048标准质量
2k$0.100高质量
4k$0.607顶级分辨率

按张计价,分辨率是唯一价格变量。无 token 计费、无额外参数费用。

与竞品对比

Flux 3 Image 发布时,Ideogram 也刚发布 4.5 版本,同样主打编辑能力并计划开源权重。两者的差异:

维度Flux 3 ImageIdeogram 4.5
核心卖点单端点统一生成+编辑精确编辑不破坏原图
Bounding box原生支持未提及
参考图数量最多 10 张未明确
最大分辨率4K (~16MP)未明确
开源权重未来几周内发布未来发布
API 定价$0.041-$0.607/张未明确

Black Forest Labs 的 Flux 系列一直是开源图像模型领域的标杆,Flux 3 Image 的开源权重版本预计在未来几周内发布。

开发者集成指南

API 调用

所有操作通过同一个端点完成:

POST /api-reference/utility/generate-an-image-with-flux-3

请求体中只需 prompt 和 resolution 参数。生成还是编辑、是否用 bounding box,全部由 prompt 内容决定。

典型工作流

场景 1:生成新图

code
prompt: "A serene mountain landscape at golden hour, snow-capped peaks"
resolution: "2k"

场景 2:局部编辑

code
prompt: "Replace the red car with a blue bicycle [image: user_uploaded.jpg]"
resolution: "2k"

场景 3:Bounding box 布局

code
prompt: "A magazine cover layout [
  {box: [0.1, 0.05, 0.9, 0.15], text: "headline"},
  {box: [0.05, 0.2, 0.45, 0.5], image: "portrait"},
  {box: [0.5, 0.2, 0.95, 0.95], image: "landscape"}
]"
resolution: "4k"

适用场景分析

适合 Flux 3 Image 的场景

  • 电商商品图编辑:换颜色、换背景、移除不需要的元素,保持商品主体不变
  • 营销素材批量生成:同一布局模板,批量替换文字和图片元素
  • 社交媒体内容创作:快速生成不同宽高比的图片
  • UI/UX 原型:用 bounding box 快速布局界面元素
  • 多参考图合成:将多张产品图的风格、构图元素融合成新图

不太适合的场景

  • 需要精细控制每一步推理过程的复杂编辑(考虑多步 API 调用链)
  • 需要极低延迟的实时交互(图像生成本质上是秒级操作)
  • 需要完全离线运行(目前 API only,开源权重版未来发布)

行业背景

Flux 3 Image 是 Black Forest Labs 更大多模态战略的一部分。Flux 3 模型家族计划统一图像、视频和音频生成,基于"Self-Flow"联合学习架构。Flux 3 Image 是这个愿景的图像支柱,视频和音频模块预计后续发布。

图像生成 API 市场在 2026 年竞争激烈,但 Flux 3 Image 的"单端点+bounding box+多参考图"组合在开发者体验上有独特优势——特别是对于需要同时处理生成和编辑的应用,单端点设计可以显著简化代码架构。

开发者行动建议

  1. 试用免费 Demo:Black Forest Labs 提供了 在线编辑 Demo,可以直接体验多步编辑
  2. 评估 API 集成:如果你的应用同时需要生成和编辑,单端点设计可以替换现有的多端点逻辑
  3. 关注开源权重:如果需要离线部署或微调,等待开源权重版本发布
  4. 对比定价:$0.041/张(768sq)在图像 API 中属于经济档,适合需要大量生成的场景
  5. 测试 bounding box:如果你的应用涉及布局合成(如海报、杂志封面),bounding box 功能值得优先测试

信息来源:Black Forest Labs 发布说明、Flux 3 Image API 文档、Bounding Box 教程、在线编辑 Demo、The Decoder 报道

Black Forest LabsFlux 3 Imageimage generationimage editingAI APIbounding boxmultimodal AItext-to-image

查看原文 →

仅供学习参考:案例基于公开来源整理,并可能经 AI 辅助起草、由编辑复核。不构成投资或收益建议,亦不保证结果。