Flux:Black Forest Labs 把出图与改图合一,4B 开源权重 Apache 2.0

Flux 是 Black Forest Labs(BFL)的图像生成模型家族,从 2024 年的 FLUX.1 一路迭代到 FLUX.2 系列,中间还分出过 FLUX.1 Kontext 这条编辑线。眼下能在自己机器上跑起来的开源成员是 FLUX.2 [klein],官方于 2026 年 1 月发布。它的定位很明确:把出图速度压到可以交互的程度,同时把权重放出来让人自己部署。

一个模型同时管出图和改图

FLUX.2 [klein] 的做法是把生成和编辑合并进同一个紧凑架构。文生图、图生图的单参考编辑、多参考生成,这三件事由同一份权重完成,不必在模型之间来回切换。对使用者来说,差别是实实在在的:写一句提示词出图、丢一张参考图进去改局部、或者把两三张图的元素拼成一个新画面,走的是同一条管线,也不用为了改图再单独下载一个编辑模型。

FLUX.2 [klein] 的文生图样张拼版:多组不同风格与题材的生成结果

klein 在德语里是「小」的意思,指向的是模型体积和延迟,而不是能力缩水。官方给出的说法是端到端推理可以低到亚秒级,9B 版本基于 9B flow 模型加 8B Qwen3 文本编码器构建,蒸馏之后只跑 4 步推理。这类把步数压到个位数的做法,正是它比常规扩散模型快出一个量级的原因。

两个规模,两套许可

家族里有 9B 和 4B 两个规模,选择的关键其实在许可而不只是画质。4B 完全以 Apache 2.0 开放,商用、修改、再分发都不受限制,是面向本地开发和边缘部署的那一个;9B 是旗舰小模型,质量更强,但开源权重走的是 FLUX 非商业许可证,要拿去商用得另外谈授权。除了蒸馏版,官方还给出未蒸馏的 Base 版本,保留了完整训练信号,适合做微调、LoRA 训练和自定义管线,输出多样性比蒸馏版更高。

FLUX.2 [klein] 的图像编辑样张拼版:给出参考图后按提示词改写画面

显存门槛与量化版本

4B 版本官方标注约 13GB 显存,RTX 3090、RTX 4070 及以上就能跑起来,这个门槛让相当一部分现成的游戏显卡直接可用;9B 的显存需求明显更高。BFL 与 NVIDIA 合作放出了全套 FP8 与 NVFP4 量化版本,官方在 RTX 5080 与 5090 上跑 1024×1024 文生图的数据是:FP8 提速最高 1.6 倍、显存占用降低最高 40%,NVFP4 提速最高 2.7 倍、显存占用降低最高 55%。量化版沿用与原件相同的许可,能力不变、体积更小。

FLUX.2 [klein] 官方性能图:Elo 与延迟、显存占用的关系曲线

怎么上手

开源权重在 Hugging Face 上直接下载,官方另有一个参考实现仓库提供采样代码,想从代码层面改的人可以从这里起步。日常使用最省事的两条路是 ComfyUI 与 Hugging Face Diffusers:Diffusers 里用 Flux2KleinPipeline 载入,配合显存卸载可以把峰值压下来,官方模型卡给的示例就是这么写的;不想折腾显卡的话也可以直接调官方接口,端点名分别是 flux-2-klein-4b 与 flux-2-klein-9b,按输出图像的百万像素计费。

需要留意的地方

官方模型卡写明了几条局限:模型不用于提供事实信息;它虽然能写出文字,但渲染出来的字存在失真的情况;作为统计模型,权重本身会反映训练数据中存在的偏见。另外 4B 毕竟是压缩后的规模,在文字渲染和写实细节上弱于 9B 以及更大的 FLUX.2 变体,对画质有要求的话要往上选。还有一点时间线上要知道:BFL 在 2026 年 7 月发布了多模态的 FLUX 3,覆盖图像、视频、音频与动作预测,但其中的图像能力目前处于早期访问,开源权重版本被官方列为后续发布项——现阶段想下载权重自己跑,FLUX.2 [klein] 仍是 Flux 家族里最新的一档。

一句话概括:想要一个能装进消费级显卡、许可干净可以商用、出图与改图不用换模型的开源图像模型,4B 版本是目前最省心的选择;画质优先且不牵扯商用,再看 9B。

Flux下载地址
支持的操作系统: Windows macOS Linux