Flux 2 Klein — RunComfy专业套件
Black Forest Labs推出的Flux 2 Klein(Flux 2的精简低延迟变体)托管在RunComfy模型API上——无需API密钥,支持异步REST调用。
bash
npx skills add agentspace-so/runcomfy-skills --skill flux-2-klein -g
何时选择该模型(对比同类模型)
Flux 2 Klein的独特优势是以延迟优先的创意迭代:亚秒级反馈支持实时艺术指导会话和快速产品可视化,这是批量式模型无法实现的。当迭代速度比最高分辨率更重要时选择它。
| 需求场景 | 推荐模型 |
|---|
| 实时/现场艺术指导会话 | Flux 2 Klein 4B |
| 快速迭代且最终输出具备丰富细节 | Flux 2 Klein 9B |
| 多参考品牌风格,视觉效果一致 | Flux 2 Klein |
| 2K–4K主视觉图,最高分辨率 | Seedream 5 |
| 最强提示词贴合度 + 极致细节 | Flux 2 Pro |
| 嵌入文字、Logo、多语言标识 | GPT Image 2 |
| 超写实肖像 | Nano Banana Pro |
如果用户明确提到“Flux 2 Klein” / “BFL Klein” / “flux klein”,无论何种场景都路由到该模型。如果用户笼统提到“Flux 2”,在默认选择前需询问用户想要Klein(高速)还是Pro(最高画质)。
前置条件
- RunComfy CLI — 执行安装
- RunComfy账户 — 执行会打开浏览器设备码登录流程
- CI/容器环境 — 设置环境变量替代操作
端点与输入 schema
两个变体的端点结构和提示词语法一致。
blackforestlabs/flux-2-klein/9b/text-to-image
以画质优先的变体,用于精细化处理/最终输出。
| 字段 | 类型 | 必填 | 默认值 | 说明 |
|---|
| string | 是 | — | 最多约512个token,过长会导致输出质量下降 |
| int | 否 | 25 | 取值范围4–50。步数精简架构——4–8步足够用于概念构思;约25步用于精细化处理;超过25步提升有限 |
| int | 否 | 1024 | 典型取值512–1536。宽高比上限为16:9,总像素约2K |
| int | 否 | 1024 | 需与的宽高比意图匹配 |
blackforestlabs/flux-2-klein/4b/text-to-image
以延迟优先的变体,4步推理可实现亚秒级输出,用于实时迭代/概念构思。
字段集合与9B变体一致,默认
为4——该变体专为这个步数设计。
参考图像(两个变体均支持)
同一端点最多支持
4张同时传入的参考图像,用于风格迁移/构图引导。JSON请求体中的具体字段名称可在
模型API页面查看——直接通过CLI传入即可。使用参考图像可实现编辑类工作流,无需单独调用
端点。
调用方式
快速概念构思(4B,亚秒级):
bash
runcomfy run blackforestlabs/flux-2-klein/4b/text-to-image \
--input '{"prompt": "<用户提示词>"}' \
--output-dir <绝对路径>
精细化处理/最终输出(9B,约25步):
bash
runcomfy run blackforestlabs/flux-2-klein/9b/text-to-image \
--input '{
"prompt": "<用户提示词>",
"steps": 25,
"width": 1024,
"height": 1024
}' \
--output-dir <绝对路径>
宽幅海报:
bash
runcomfy run blackforestlabs/flux-2-klein/9b/text-to-image \
--input '{"prompt": "<用户提示词>", "width": 1536, "height": 864}' \
--output-dir <绝对路径>
CLI提交请求后,每2秒轮询一次直到任务完成,然后将结果中所有
/
链接的内容下载到
目录。标准输出为结果JSON,标准错误输出为进度信息。
管道友好型用法:
bash
runcomfy --output json run blackforestlabs/flux-2-klein/4b/text-to-image \
--input '{"prompt":"..."}' --no-wait | jq -r .request_id
提示词技巧——有效方法
以下是经实践验证可提升输出质量的模型专属提示词模式。
主语优先的声明式语法。Flux 2 Klein的训练数据结构为*“主体 + 动作 + 场景 + 风格 + 光线 + 镜头 + 画质”*。将主体放在最前面,后面跟随指令。示例:
"一只色彩鲜艳的蜂鸟在飞行中吸食亮粉色木槿花的花蜜,清晨阳光下的虹彩羽毛,热带花园的柔和散景,微距摄影,极致锐利细节,电影级光线"
。
具体描述优于华丽辞藻。“4K产品照片,柔光箱照明,反光桌面,35mm镜头,f/2.8”能产生可预测的效果。“一张非常漂亮的产品图”则无法提供有效引导。
按阶段选择步数:
- 概念构思:使用4B变体,4–8步——亚秒级反馈支持实时探索
- 优化调整:仍使用4B变体,8–15步,锁定主体与构图
- 精细化处理:使用9B变体,约25步——提升纹理、微细节、精细排版
多参考图像风格对齐。传入参考图像时,保持视觉风格一致。在同一调用中混合水彩、写实、3D渲染风格会让模型产生混淆。所有参考图像需选择统一的视觉风格。
条件式编辑:先说明保留内容,再说明修改内容。例如:“保持参考图像的构图和光线不变,将背景从海滩改为山地工作室”。这种模式能稳定构图。
文字渲染(Klein搭载8B Qwen3嵌入模型,效果尚可但不如GPT Image 2):添加
,如果文字显示模糊,将步数提升至约25步。如果需要大量嵌入文字或多语言渲染,建议转而使用GPT Image 2。
反模式:
- 不要使用矛盾形容词,比如“极简主义 + 华丽繁复”会相互抵消
- 提示词不要超过约512个token,模型会输出质量下降,且无法优雅截断
- 不要要求4K分辨率——模型的分辨率上限约为2K
- 不要要求超宽比例(>16:9)——模型会自动裁剪
优势场景
| 使用场景 | 选择Flux 2 Klein的原因 |
|---|
| 实时艺术指导会话 | 4B变体的亚秒级反馈支持实时迭代 |
| 交互式产品可视化 | 快速生成UI预览和产品效果图,无需等待批量处理 |
| 多参考品牌风格统一 | 参考图像间的风格一致性强,可生成统一的资产包 |
| 快速构思→精细化处理工作流 | 4B变体用于探索,9B变体用于最终输出——全程使用相同的提示词语法 |
| 消费级GPU友好型推理 | 4B变体可在普通硬件上运行;适用于自托管对比场景,但RunComfy托管版本已足够好用 |
示例提示词(经验证可生成优质输出)
模型页面示例(BFL官方示例):
一只色彩鲜艳的蜂鸟在飞行中吸食亮粉色木槿花的花蜜,虹彩祖母绿和蓝宝石色羽毛在清晨阳光下闪耀,热带花园的柔和散景背景,微距摄影,极致锐利细节,电影级光线
产品照片模式:
哑光陶瓷马克杯放在再生木桌面上,左侧柔和的北向窗光,浅景深,50mm定焦镜头,f/2.0,中性背景,适合电商使用,4K产品摄影
品牌风格统一示例(多参考图像):
保持参考图像的构图和光线不变,但瓶身标签改为蓝色配白色无衬线字体“AURA”;完全保留瓶身轮廓、桌面和阴影
局限性
- 分辨率上限约2K——如需更高原生分辨率,建议使用Seedream 5
- 宽高比上限16:9——极端宽/高比例会被裁剪
- 提示词上限约512个token——过长会导致质量下降,且无法优雅截断
- 参考图像上限4张——超过4张会增加延迟并削弱引导效果
- 文字渲染——8B Qwen3嵌入模型有一定效果,但GPT Image 2在嵌入文字精度上仍更优
退出码
| 代码 | 含义 |
|---|
| 0 | 成功 |
| 64 | CLI参数错误 |
| 65 | 输入JSON错误/schema不匹配(例如会返回422) |
| 69 | 上游服务5xx错误 |
| 75 | 可重试:超时/429限流 |
| 77 | 未登录或令牌被拒绝 |
工作原理
- 该技能调用
runcomfy run blackforestlabs/flux-2-klein/<variant>/text-to-image
,传入符合schema的JSON请求体
- CLI携带用户的Bearer令牌向
https://model-api.runcomfy.net/v1/models/blackforestlabs/flux-2-klein/<variant>/text-to-image
发送POST请求
- 模型API返回;CLI每2秒轮询
GET .../requests/<id>/status
接口
- 任务完成后,CLI调用
GET .../requests/<id>/result
获取结果,并将所有主机后缀为或的链接内容下载到目录。其他链接仅列出但不下载
- 轮询时按会发送
POST .../requests/<id>/cancel
请求,避免为已停止的GPU使用付费
该技能不具备的能力
不是自托管Flux运行器,不提供独立能力——依赖可用的RunComfy账户,不支持多租户。
安全与隐私
- 令牌存储:会将API令牌写入
~/.config/runcomfy/token.json
,权限为0600(仅所有者可读可写)。在CI/容器环境中可设置环境变量,完全绕过文件存储
- 输入边界:用户提示词通过以JSON字符串形式传递给CLI。CLI不会对提示词进行shell展开;直接通过HTTPS将JSON请求体传输给模型API。提示词内容不存在shell注入风险
- 第三方内容:传入的图像/蒙版/视频链接由RunComfy模型服务器获取,而非本地CLI。请将外部链接视为不可信;基于图像的提示词注入是所有图像编辑/视频编辑模型的已知风险
- 出站端点:仅与(请求提交)和 / (生成输出的下载白名单)通信。无遥测,无回调
- 生成文件大小限制:CLI会终止任何单个超过2 GiB的下载,防止恶意或异常模型输出占满磁盘空间