德国 AI 公司 Black Forest Labs 于 10 月 2 日发布公告,推出图像生成模型 FLUX 3 Image。该模型支持最高 4K 分辨率图像生成,输出画面在放大后仍能保持丰富细节,并以高可控性与精细编辑能力为核心卖点。
FLUX 3 Image 基于 FLUX 3 统一架构开发。该架构最早于 7 月 23 日以早期访问形式公布,覆盖图像、视频、音频生成及动作预测;图像模态则于 10 月 1 日作为计量 API 端点正式开放。
精准到像素的布局控制
FLUX 3 Image 最受关注的是其”空间编排”能力。用户可以在归一化的 0 至 1000 坐标网格上,为画面中的每个元素指定 ID、描述文本以及精确边界框,格式为 [y_min, x_min, y_max, x_max],从而在画面中精准排布对象的位置与大小。
这种基于边界框的布局方式,把”画面里东西放在哪”从提示词描述变成了可框选的操作,对海报设计、分镜绘制等需要精确构图的场景更友好。该模型单次生成最多可融入 10 张参考图像,并可为每张参考图中的对象指定出现位置,实现多源风格的合成与一致。
像素级多轮编辑
在编辑环节,FLUX 3 Image 支持对指定区域进行修改,同时保持其他像素完全不变。官方称其能在像素级别维持原图内容,实现精确的多轮编辑——改一处而不牵动整张图,改变了传统 AI 修图”牵一发而动全身”的尴尬。
这一能力意味着设计师可以反复迭代关键帧与局部细节,而不必每次重绘整幅画面,显著降低高质量图像的生成与修改成本。
付费 API 与开源计划
FLUX 3 Image 目前作为 Black Forest Labs 的付费服务提供,按输出分辨率计费。公司表示,开放模型版本将于数周内公开,让更多开发者与企业在本地或自有环境中部署该能力。
对于需要大规模出图的团队,商业权重已面向企业开放。随着开源版本的临近,FLUX 3 Image 有望在广告、游戏原画、电商视觉等生产流程中,成为可落地的工业级图像生成工具。







