FLUX 3 Image实测解读:4K生图一张0.6美元,边界框控图让AI绘画告别抽卡

10月1日,德国AI公司Black Forest Labs发布图像生成与编辑模型FLUX 3 Image。这个团队是Stable Diffusion原始作者班底,FLUX系列一直是开源生图阵营的主力基座。这次发布有两个信号值得关注:原生输出最高到4K级别,构图控制从提示词升级成了坐标边界框。开放权重版本数周内公开,现阶段通过付费API和Playground网页使用。

4K生图,价格按档位算

官方把4K定义为约1600万像素级别,实际尺寸随画面比例变化。产品页的蕎麦面店示例为5456×3072像素,放大后细节依然扎实。此前主流模型原生输出多停在1024到2048像素,更高分辨率要靠超分补。

价格按单张计费:768px为0.041美元,1K为0.048美元,2K为0.100美元,4K为0.607美元。算一笔账:20张1K图合计0.96美元,20张4K图要12.14美元。草稿阶段用低分辨率验证构图,定稿再上4K,成本能压到原来的零头。注意API生成结果链接只保留1小时,别把临时链接当图床。

边界框:版式从抽卡变成配置文件

这次最有工程价值的改动在构图层。画布两个方向各划成0到1000的归一化坐标,用户为每个元素指定ID、描述和边界框,格式为[y_min, x_min, y_max, x_max]。模型只负责在框内画好内容。

做一张带标题、产品、背景的电商海报,过去提示词写再细,元素位置仍靠模型自由发挥,生成十张挑一张是常态。现在每个元素的位置被钉死,版式从概率问题变成了约束问题。同一套布局配置在方图、横图、竖图之间只需等比映射,一套配置吃下全部尺寸。

批量出图的团队可以把布局写成配置文件,入库、diff、评审,换文案时版式不动。布局是否正确还能用程序校验,不再依赖肉眼抽查。简单修改也支持纯文字指令,模型会自行定位元素,需要精确控制时再加框选数据。

10张参考图加像素级编辑

多参考图能力升级到单次10张,每张至少256×256像素,最高16MP。可以为每张参考图指定角色:哪张出背景,哪张出主体,哪张只管色调。电商场景里白底图、模特图、氛围图分别提供,一次合成可直接投放的成品图。

编辑方面,FLUX 3 Image支持区域修改,框外像素保持不变,适合多轮迭代。第一轮出底图,第二轮换主体,第三轮调标题,每一轮的输出都是下一轮的输入。官方也提示了边界情况:阴影、反射和邻近光线仍可能变化,过小的框可能放不下新元素,交付前要逐张检查。

和竞品比,赢在可控性

放在2026年10月的生图版图里看,谷歌Nano Banana 2.1刚把图像成本砍半,4K出图7.5美分,主打低价;阿里Qwen-Image-2.1开源了生图、改图、抠图全家桶,主打本地部署。FLUX 3 Image的差异化在控制粒度:坐标网格加边界框加像素级编辑,这套组合在精确排版场景里暂时没有对手。

值得等的一步是开放权重。FLUX前代先商业版后开放版的节奏已经验证过,数周后权重落地,自建部署的成本会再降一档。要批量出图的内容团队,现在就可以用API小规模验证坐标命中率;研究群体等权重放出即可。

一句话总结:4K解决能用,边界框和像素冻结解决敢用。AI绘画的竞争焦点正从画质转向可控性,这轮发布把标准又抬高了一截。


评论

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

苏ICP备2025163703号-2   警徽苏公网安备32010502011527号