Loading...
Loading...
共找到 13 个 Skills
在RunComfy上使用Google Nano Banana 2(Gemini家族闪存级文本生成图像模型)生成图像——该技能集成了模型官方文档中的提示模式,相比直接使用该模型的普通提示,能输出更优质的结果。文档介绍了Nano Banana 2的优势(快速迭代、图像内文字渲染、可预测构图、可选联网上下文)、分辨率层级定价、安全容忍度调节,以及何时转而使用Nano Banana Pro / GPT Image 2 / Flux 2 / Seedream。通过本地RunComfy CLI调用`runcomfy run google/nano-banana-2/text-to-image`。当触发关键词为"nano banana"、"nano-banana-2"、"nano banana 2"、"google image gen"、"gemini image",或明确要求使用该模型生成图像时启动。
在RunComfy上使用Google Nano Banana 2(图像到图像编辑端点)编辑图片。本文档介绍了Nano Banana Edit的优势(保留主体身份、替换背景、使用空间语言定位编辑、支持最多20个输入的多图批量编辑)、输入schema,以及何时转而使用GPT Image 2 edit / Flux Kontext / Nano Banana 2 t2i。通过本地RunComfy CLI调用`runcomfy run google/nano-banana-2/edit`。当出现“nano banana edit”、“edit with nano banana”、“image edit nano banana”或任何明确要求使用该模型进行编辑的指令时触发。
通过`runcomfy` CLI在RunComfy上实现图像Outpainting——将静态图像扩展至原始画布之外,补全相机未捕捉到的内容,在保留原始内容的同时更改宽高比(正方形→16:9、竖屏→横屏)。支持调用Nano Banana 2 Edit(默认选项,基于空间语言驱动)、GPT Image 2 Edit(多参考图,匹配参考风格)、FLUX Kontext Pro(单次处理,最大程度保留原图)以及品牌专属编辑端点(Seedream / Dreamina / Qwen / FLUX 2)。会根据扩图需求是文本描述驱动、参考图驱动还是品牌风格锁定,选择合适的调用路径。当出现以下关键词时触发该功能:"outpaint"、"outpainting"、"extend image canvas"、"expand the image"、"fill in around the photo"、"uncrop"、"change aspect ratio"、"extend frame"、"wide-screen from square",或任何明确要求为现有静态图像添加画布的指令。
通过统一的Pilio开发者API使用Pilio Nano Banana 2创建或编辑图片。适用于用户需要Nano Banana 2文本生成图片、参考图编辑、产品海报或基于本地输入进行图片合成的场景。
借助Nano Banana 2(Gemini 3.1 Flash Image)实现专业级图像创建与编辑。适用于从零开始创作视觉内容、使用delta editing编辑现有图像,或为各类视觉需求生成专业品质图像的场景。支持写实摄影、艺术风格创作、具备高级文字渲染功能的Logo、贴纸、产品样机、精准delta编辑,以及跨生成的角色一致性。具备--image-size尺寸控制(512/1K/2K/4K)和结构化生产级提示词功能。
通过Arcads外部API,使用Nano Banana 2生成高点击率(CTR)的YouTube缩略图。支持参考图片上传、人物相似度对齐、经CTR测试验证的提示词公式,以及并行批量生成。当用户要求创建YouTube缩略图、视频缩略图、A/B测试缩略图变体,或者提及使用本人面部、品牌资产或产品照片进行缩略图设计时,可使用本功能。
使用Google的Nano Banana 2(Gemini 3.1 Flash Image Preview)API生成和编辑图片。当用户要求创建或修改图片时,尤其是需要快速迭代、精确的宽高比控制或512px至4K的分辨率控制时,应使用此技能。
通过`runcomfy` CLI在RunComfy上生成和编辑图像——这是一款覆盖全量图像模型目录的智能路由工具,支持的模型包括:FLUX 2(Klein 9B/4B、Pro、Dev、Flash、Turbo、Max)、Google Nano Banana 2/Pro、OpenAI GPT Image 2、字节跳动Seedream 5/4-5/4-0及Dreamina 4-0、阿里云Qwen Image和Z-Image Turbo、Wan 2-7。它同时支持文本转图像(t2i)和图像转图像/编辑(i2i)端点——该技能会根据用户的实际需求(排版精度、写实肖像、亚秒级迭代、多参考品牌风格、开源权重工作流)选择合适的模型,并提供每个模型的文档化提示模板以及最简`runcomfy run`调用指令。当用户提出“生成图像”“制作图片”“文本转图像”“AI图像”“制作一张……的图像”“图像转图像”“i2i”或任何明确要求创建或重新设计图像的请求时,该技能会触发。
通过inference.sh CLI使用Google Gemini 3.1 Flash Image Preview(Nano Banana 2)生成图片。功能包括:文本转图片、图片编辑、多图输入(最多14张)、Google搜索 grounding。触发词:nano banana 2、nanobanana 2、gemini 3.1 flash image、gemini 3 1 flash image preview、google image generation
基于Gemini原生的Nano Banana图像生成与编辑工具,支持Nano Banana、Nano Banana 2和Nano Banana Pro版本。适用于文本生成图像、图像编辑、多本地参考图生成、批量生成、预演请求检查,或使用自定义Gemini兼容基础URL(如自托管网关)的场景。
使用Gemini Nano Banana 2 API为文章和文档生成插图。可生成简洁、极简风格的图表和概念示意图。
使用Google的Gemini图像生成模型(Nano Banana系列)生成和编辑图片。支持风格预设、平台特定尺寸(YouTube/幻灯片/博客)、变体图片、通过inlineData进行图片编辑、用于风格迁移的参考图片,以及带元数据的结构化输出。默认模型为Nano Banana 2(gemini-3.1-flash-image-preview)。API密钥可通过SOPS自动解密。