FLUX 3 Image 上线:4K 生图、像素级精修,AI 制图再进化

FLUX 3 Image 上线:4K 生图、像素级精修,AI 制图再进化

德国人工智能公司黑森林实验室(Black Forest Labs)于 10 月 2 日发布图像生成模型 FLUX 3 Image。该模型基于 FLUX 3 基座开发,主打高可控性与精细编辑能力,最高可输出 4K 分辨率图像,并将画面元素的位置控制精度提升到像素级别。

核心能力:把画面当成可编程的坐标系

FLUX 3 Image 最大的变化,是让创作者能够精确决定”画面里每个元素放在哪”。用户可以在一个归一化的 0 到 1000 坐标网格上,为每一个元素指定编号、描述文本以及精确的边界框,格式为 [y_min, x_min, y_max, x_max],从而在画面中精准排布对象。

单次生成最多可融入 10 张参考图像,并可为每张参考图中的对象单独指定出现区域。编辑环节则主打”只改你要改的地方”:模型可对指定区域进行修改,同时保持画面其余像素完全不变,官方称其能在像素级别维持原图内容,实现多轮精确编辑。

按分辨率计费,4K 单张约 0.6 美元

FLUX 3 Image 目前以按量计费的 API 形式提供服务,价格随输出分辨率递增:768 平方像素为 0.041 美元,1K 为 0.048 美元,1.5K 为 0.07 美元,2K 为 0.10 美元,最高 4K 为 0.607 美元。一次 4K 图像的生成可能需要数分钟,且返回的图片仅可在一小时内下载。在 2026 年 10 月 8 日 15:00(UTC)之前,所有分辨率均享受 50% 的发布折扣。

开源权重数周内放出,已登陆第三方平台

黑森林实验室表示,面向大规模图像生成的企业商业权重已经开放,而公开的开源权重版本预计在数周内发布,有消息称具体日期为 10 月 6 日。与此同时,FLUX 3 Image 已经登陆 Krea 等实时生成平台,用户现在即可在线试用多轮编辑与边界框排版功能。

从视频优先到图像落地

FLUX 3 系列最早于 2026 年 7 月 23 日以”早期访问”形式公布,其架构是一个覆盖图像、视频、音频生成及动作预测的自流模型。在训练算力分配上,超过 95% 用于视频训练,分配给音频的标记占比不足 0.5%,图像能力因此继承自一个以视频优先的训练过程。经过约十周后,图像模态于 10 月 1 日作为计量 API 端点正式开放。在同类方向上,Ideogram 也已发布主打编辑能力的 4.5 模型,并同样计划推出开放权重版本。

对设计师、广告与游戏原画等依赖高精度出图的岗位而言,FLUX 3 Image 把 AI 生图从”提示词玄学”推进到”可框选、可定位”的工业级精度,其与 Photoshop 等传统工具的工作流整合值得持续观察。