FLUX.2 详解:最好的开源权重 AI 图像模型
FLUX.2 是 Black Forest Labs 的开源权重图像模型家族,它的卖点很直接:单个 32B 检查点同时负责生成与编辑,在你能下载并自己运行的模型里,拥有最强的提示词遵循度和文字渲染能力。它支持多参考图融合、可在最高 4 百万像素下编辑,并且借助 [klein] 变体能在消费级 GPU 上做到亚秒级生成。下面讲清楚这个家族到底包含什么、怎么写提示词,以及它相对 Midjourney、Seedream 和闭源托管模型的定位。
FLUX.2 是什么?
FLUX.2 是 Black Forest Labs(初代 FLUX 模型的团队)推出的第二代图像家族。其开源权重检查点 FLUX.2 [dev] 是一个 320 亿参数的流匹配 Transformer,2025 年 11 月发布,把文生图与图像编辑合进一个模型——你可以从零创作、修改现有画面,或通过同一个检查点融合多张参考图。2026 年 1 月,该家族又新增了 FLUX.2 [klein],一个为消费级硬件快速运行而设计的 4B/9B 紧凑路线。
FLUX.2 之所以频繁出现在「最好的开源权重图像模型」榜单里,是因为它真正可自托管,同时性能逼近闭源前沿。它在文生图、单参考编辑和多参考编辑上都明显领先其他开源权重方案。在 ReelWand 上,FLUX 级别的生成正是图像 Agent 的底层能力——你用自然语言描述一种观感,Agent 在服务端组装模型调用。
FLUX.2 家族:该跑哪个变体
| 变体 | 用途 | 说明 |
|---|---|---|
| [dev] | 开源权重自托管、完整画质 | 32B,非商业许可,需约 24GB+ 显存 |
| [klein] | 本地速度、更轻硬件 | 4B(Apache-2.0)/ 9B,亚秒级,4B 约需 13GB 显存 |
| [pro] | 托管 API、生产级画质 | 约 $0.03/张,复杂文字约 92% 准确率 |
| [flex] | 排版 + 可调控制项 | 约 $0.05/张,保留细小细节 |
| [max] | 托管、顶级 + 联网检索 | 约 $0.07/张,可在生成中拉取实时信息 |
最容易被绕晕的一点:只有一个检查点,不是两个。 生成和编辑是同一个模型的两种模式,而非两个单独的下载。想自托管的话,[dev] 是完整画质路线,[klein] 是快速、更省显存的路线;[pro]/[flex]/[max] 则是按张付费的托管 API 端点。注意许可——[dev] 在「服务该模型」层面是非商业的,而 [klein] 4B 采用 Apache-2.0,完全开放商用。
文中价格和显存数字来自 Black Forest Labs 的 API 报价与社区搭建指南(截至 2026 年年中),仅作大致参考——在为管线做预算前,请以官方定价页为准。
FLUX.2 到底强在哪
- 清晰的文字排版。 复杂文字版式、信息图、表情包和 UI 稿都能渲染出可读的小字——[pro] 在高难度文字上达到约 92% 准确率。想要最干净的字形,就在 4MP 下渲染。
- 对结构化提示词的遵循。 多段式、组合式指令(「左边 X、右边 Y」)能被忠实执行,省掉了松散模型上反复重生成的循环。
- 多参考一致性。 融合多张参考图,并在它们之间保持角色与风格稳定——这是做符合品牌的系列图的基础。
- 高分辨率编辑。 可在最高 4 百万像素下编辑现有图像,同时保留细节与连贯性,而不会把未改动区域涂糊。
- 可自托管。 这正是重点:在你自己的 GPU 上跑。[klein] 4B 约需 13GB 显存,[dev] 需要 24GB 以上,两者也都能跑在云 GPU 实例上。
FLUX.2 与同类模型对比
| 模型 | 强项 | 注意点 |
|---|---|---|
| FLUX.2 [dev] | 开源权重自托管、排版、提示遵循 | 服务模型为非商业许可 |
| Seedream 5 | 写实细节、托管省心 | 闭源权重 |
| Midjourney v7 | 风格化美感、社区预设 | 不可自托管、直书文字较弱 |
| Nano Banana | 快速对话式编辑 | 仅托管 |
| Ideogram 3 | 海报级排版 | 编辑功能面较窄 |
经验法则:当你需要读得清的文字、能落地的结构化提示词,以及自己运行的选项时,选 FLUX.2;当标志性的绘画质感比精确控制更重要时,选 Midjourney;当你想要顶级写实又不想碰 GPU 时,选 Seedream。
FLUX.2 在 ReelWand 工作流里的位置
裸模型给你的是引擎,Agent 给你的是手艺。ReelWand 的 插画画布 内置了一套固定的风格 DNA——媒介、色板、线条粗细、成品质感——在服务端拼进每一次请求,因此 FLUX 的成图无需你反复输入这些术语也能保持一致观感。大脑永远不离开服务端:团队的招牌观感无法被复制粘贴带走。会话记忆意味着你的下一句提示会在两小时窗口内于上一帧的基础上迭代,让你去执导作品,而不是从零重生成——这恰好让 FLUX.2 的多参考一致性在整组图里派上用场。
在一个被「导演化」的 Agent 里体验 FLUX 级别的图像生成。
用插画画布来创作常见问题
FLUX.2 是免费开源的吗?
FLUX.2 [dev] 是开源权重的——你可以下载并运行——但其许可在「服务该模型本身」上是非商业的,不过输出可以商用。FLUX.2 [klein] 4B 采用 Apache-2.0,完全开放。托管的 [pro]、[flex]、[max] 是付费 API 端点。
我能在自己的硬件上跑 FLUX.2 吗?
可以,这正是开源权重发布的意义。FLUX.2 [klein] 4B 约需 13GB 显存,可在消费级 GPU 上做到亚秒级生成;完整的 32B [dev] 检查点则需要约 24GB 以上。两者也都能跑在租用的云 GPU 实例上。
FLUX.2 的文字和排版好吗?
它是文字最清晰的模型之一。FLUX.2 [pro] 在复杂文字版式上达到约 92% 准确率,整个家族都能处理信息图、表情包和 UI 稿。想要最干净的字形,就在 4 百万像素下渲染。
FLUX.2 和 Midjourney 哪个更好?
FLUX.2 在提示词遵循、可读文字和自托管上更强;Midjourney v7 在标志性的风格化美感及预设驱动的社区工作流上更强。要结构化控制和文字选 FLUX.2,要绘画质感选 Midjourney。
FLUX.2 能做图像编辑还是只能生成?
两者都行,且来自同一个检查点。生成和编辑是同一模型的两种模式,因此你可以从零创作、在最高 4 百万像素下编辑现有图像,或融合多张参考图,而无需切换模型。
把它变成作品
62 个专精视觉 Agent,每一个都内置了本文所讲的手艺。挑一个,开始创作。