Loading...
Loading...
共找到 34 个 Skills
在RunComfy上使用Google Nano Banana 2(Gemini家族闪存级文本生成图像模型)生成图像——该技能集成了模型官方文档中的提示模式,相比直接使用该模型的普通提示,能输出更优质的结果。文档介绍了Nano Banana 2的优势(快速迭代、图像内文字渲染、可预测构图、可选联网上下文)、分辨率层级定价、安全容忍度调节,以及何时转而使用Nano Banana Pro / GPT Image 2 / Flux 2 / Seedream。通过本地RunComfy CLI调用`runcomfy run google/nano-banana-2/text-to-image`。当触发关键词为"nano banana"、"nano-banana-2"、"nano banana 2"、"google image gen"、"gemini image",或明确要求使用该模型生成图像时启动。
在RunComfy上使用Google Nano Banana 2(图像到图像编辑端点)编辑图片。本文档介绍了Nano Banana Edit的优势(保留主体身份、替换背景、使用空间语言定位编辑、支持最多20个输入的多图批量编辑)、输入schema,以及何时转而使用GPT Image 2 edit / Flux Kontext / Nano Banana 2 t2i。通过本地RunComfy CLI调用`runcomfy run google/nano-banana-2/edit`。当出现“nano banana edit”、“edit with nano banana”、“image edit nano banana”或任何明确要求使用该模型进行编辑的指令时触发。
在RunComfy上编辑图片——该技能是一个智能路由工具,可将用户的意图匹配到RunComfy模型库中合适的编辑模型。它会选择Nano Banana Edit(最多支持20张批量处理,默认保留主体特征)、OpenAI GPT Image 2 Edit(支持多语言图像内文字改写、多参考图合成、布局精准调整)、Flux Kontext Pro(单参考图高保真局部编辑)或Z-Image Turbo Inpaint(基于蒙版的精准区域编辑)。该技能整合了每个模型的文档提示模板,无需反复尝试错误模型即可获得更精准的编辑效果。通过本地RunComfy CLI调用`runcomfy run <vendor>/<model>/edit`命令。当用户输入“image edit”“edit image”“image-to-image”“i2i”“swap background”“remove object”“rewrite headline”或任何明确要求编辑单张或批量图片的指令时触发该技能。
在RunComfy上使用Flux 1 Kontext Pro(Black Forest Labs推出的精准局部图像编辑模型)编辑图片——该技能内置了模型文档中记录的提示词模式,相比直接使用基础提示词调用同一模型,能获得更优质的输出。本文档介绍了Flux Kontext的优势(单参考精准局部编辑、强大的提示词控制、持续高保真输出)、输入格式(单张图片+提示词),以及何时转而使用Nano Banana Edit / GPT Image 2 edit / Flux 2 Klein。通过本地RunComfy CLI调用`runcomfy run blackforestlabs/flux-1-kontext/pro/edit`命令。当触发词为“flux kontext”、“flux-kontext”、“flux 1 kontext”、“kontext”、“BFL kontext”,或用户明确要求使用该模型进行编辑时,启动此技能。
在RunComfy上使用OpenAI GPT Image 2(ChatGPT Images 2.0的`/edit`端点)编辑图片——该工具集成了模型官方文档中的提示模式,相比直接使用原生提示词调用同一模型,能生成更优质的输出。本文档介绍了GPT Image Edit的优势(保留特征语言、多语言图像内文本编辑、最多支持10张参考图、布局/排版精度)、数据结构,以及何时转而使用Nano Banana Edit / Flux Kontext / GPT Image 2文本转图像模型。通过本地RunComfy CLI调用`runcomfy run openai/gpt-image-2/edit`。当触发词为"gpt image edit"、"gpt-image-edit"、"chatgpt image edit"、"edit with gpt image 2"或任何明确要求使用该模型进行编辑的指令时启动。
在RunComfy上使用Flux 2 Klein(Black Forest Labs推出的Flux 2精简高速变体)生成图像——该技能集成了模型官方文档中的提示词模式,相比直接使用朴素提示词调用同一模型,能获得更优质的输出。本文档介绍了Flux 2 Klein的优势(亚秒级延迟、多参考品牌风格、主语优先的声明式提示词)、步数策略(4–8步用于快速迭代,约25步用于精细化处理)、9B与4B变体的权衡,以及何时转而使用Flux 2 Pro / Seedream 5 / GPT Image 2。通过本地RunComfy CLI调用`runcomfy run blackforestlabs/flux-2-klein/9b/text-to-image`(或`/4b/`)。当触发词为“flux 2 klein”、“flux-2-klein”、“flux klein”、“BFL flux 2”,或用户明确要求使用该模型生成图像时启动。
通过`runcomfy` CLI在RunComfy平台上将人脸/角色替换到视频或图片中。该功能可调用多种社区模型接口:Wan 2-2 Animate(音频驱动的角色动画+身份替换)、GPT Image 2 Edit(通过参考构图对静态图片进行单次精准人脸替换)、Nano Banana Edit(批量保留身份的替换)、Flux Kontext(单参考高保真局部人脸编辑)以及Kling 2-6 Motion Control Pro(将动作从一个表演转移到目标角色上)。系统会根据用户的实际需求选择合适的模型——比如是单张静态图还是视频、全角色替换还是仅人脸替换、对话场景还是无声动作场景。当用户提出诸如"face swap"、"swap face"、"deepfake"、"face replacement"、"character swap"、"head swap"、"把X的脸放到Y身上"、"让这个视频的主角变成X"、"替换视频中的演员"、"替换照片里的角色"、"deepfake视频"、"ReActor替代方案"等明确要求替换身份的指令时,该功能会触发。
通过`runcomfy` CLI在RunComfy上实现掩码驱动的图像修复。当存在掩码时,将请求路由至通义千问MAI Z-Image Turbo Inpainting(支持掩码、强度和控制尺度的专用修复端点);当没有可用掩码且需通过描述指定区域时,则路由至保留身份的编辑模型(Nano Banana 2 Edit、GPT Image 2 Edit、FLUX Kontext Pro)。适用于对象移除、水印去除、区域替换、瑕疵修复,以及任何由二进制掩码定义目标区域的受控局部编辑场景。触发关键词包括“inpaint”“inpainting”“image inpaint”“remove from image”“fill region”“mask-driven edit”“remove watermark”“remove object”“patch the photo”“fill the hole”,或任何明确要求编辑静态图像特定掩码区域的请求。
通过`runcomfy` CLI在RunComfy上实现图像Outpainting——将静态图像扩展至原始画布之外,补全相机未捕捉到的内容,在保留原始内容的同时更改宽高比(正方形→16:9、竖屏→横屏)。支持调用Nano Banana 2 Edit(默认选项,基于空间语言驱动)、GPT Image 2 Edit(多参考图,匹配参考风格)、FLUX Kontext Pro(单次处理,最大程度保留原图)以及品牌专属编辑端点(Seedream / Dreamina / Qwen / FLUX 2)。会根据扩图需求是文本描述驱动、参考图驱动还是品牌风格锁定,选择合适的调用路径。当出现以下关键词时触发该功能:"outpaint"、"outpainting"、"extend image canvas"、"expand the image"、"fill in around the photo"、"uncrop"、"change aspect ratio"、"extend frame"、"wide-screen from square",或任何明确要求为现有静态图像添加画布的指令。
通过`runcomfy` CLI在RunComfy上为静态图像重新打光——更改灯光设置、色温、方向或氛围。当需要专业的重新打光时,会路由到Qwen Edit 2509专用的`relight` LoRA端点;若仅需通过文字描述灯光效果即可满足需求,则会 fallback 到保留主体特征的编辑端点(Nano Banana 2 Edit、GPT Image 2 Edit、FLUX Kontext Pro)。可用于产品重新打光(影室柔光箱→窗边自然光)、人像氛围转换(阴天→黄金时刻)或色彩分级调整。当出现“relight”“relighting”“change the lighting”“make it golden hour”“studio lighting”“rim light”“blue hour”“soft window light”“change light direction”“color temperature”等关键词,或任何明确要求更改静态图像灯光的指令时,将触发该功能。
通过Higgsfield AI借助30余种模型生成图片和视频,这些模型包括Nano Banana 2、Soul V2、Veo 3.1、Kling 3.0、Seedance 2.0、Flux 2、GPT Image 2等,此外还有Marketing Studio可用于制作带有定制化虚拟形象和导入产品的品牌广告视频/图片。 适用场景:"生成图片"、"制作画作"、"创作艺术作品"、"制作视频"、"将照片动画化"、"image-to-video"、"img2vid"、"用AI编辑图片"、"为照片添加风格"、"重新创作图片"、"制作片段"、"渲染场景"、"制作广告"、"制作UGC视频"、"生成营销视频"、"制作产品演示"、"制作开箱视频"、"电视广告"、"虚拟试穿"、"产品展示"、"品牌视频"、"产品演示人视频"、"从URL导入产品"、"为广告创建虚拟形象"。 支持text-to-image、image-to-image、image-to-video、基于参考的生成,以及Marketing Studio(虚拟形象+产品+广告模式)。 可自动检测传入的ID是上传文件还是过往任务ID。 当用户希望输出内容中包含自己的面部时,可与higgsfield-soul-id配合使用。 不适用场景:训练Soul Character(请使用higgsfield-soul-id)、带有模式特定提示增强的专业产品拍摄(请使用higgsfield-product-photoshoot)、纯文本/聊天/TTS任务。
通过`runcomfy` CLI在RunComfy上生成和编辑图像——这是一款覆盖全量图像模型目录的智能路由工具,支持的模型包括:FLUX 2(Klein 9B/4B、Pro、Dev、Flash、Turbo、Max)、Google Nano Banana 2/Pro、OpenAI GPT Image 2、字节跳动Seedream 5/4-5/4-0及Dreamina 4-0、阿里云Qwen Image和Z-Image Turbo、Wan 2-7。它同时支持文本转图像(t2i)和图像转图像/编辑(i2i)端点——该技能会根据用户的实际需求(排版精度、写实肖像、亚秒级迭代、多参考品牌风格、开源权重工作流)选择合适的模型,并提供每个模型的文档化提示模板以及最简`runcomfy run`调用指令。当用户提出“生成图像”“制作图片”“文本转图像”“AI图像”“制作一张……的图像”“图像转图像”“i2i”或任何明确要求创建或重新设计图像的请求时,该技能会触发。