Loading...
Loading...
共找到 96 个 Skills
当用户要求使用GPT Image 2 / gpt-image-2进行图像生成、创建、绘制、渲染或编辑时,例如文本转图像、参考图像编辑、图像修复、海报、排版、中文文本、UI原型图、图表或图库提示词场景,均可使用本技能。分析用户的提示词,在附带的参考图库/技巧文件中搜索匹配的设计模式,必要时确认方向,然后调用打包好的`gpt-image` CLI或附带的`scripts/generate.py`脚本。除非明确要求修改本仓库,否则请勿编写新的图像生成代码。
为任何接受流畅英文输入的现代text-to-image或图像编辑模型打造高质量自然语言图像提示词。当用户需要帮助撰写、重写、改进或翻译英文自然语言图像提示词时触发——包括“帮我写一个图像提示词”“优化这个图像提示词”“为图像模型描述这个场景”或“将这些标签转换为自然语言提示词”等请求。请勿响应纯关于调用图像API、选择采样器/调度器、挑选LoRA或设置ControlNet的请求——这些属于运行时技能的范畴。
xAI Grok图像与视频生成指南,涵盖认证、接口端点、提示词结构、图像编辑、参考图像生成视频以及异步轮询等内容。
基于Google Gemini的Nano Banana与Nano Banana Pro图像生成API构建全栈Web应用。适用于创建Next.js图像生成应用、文本转图像工具或迭代式图像编辑器。
在RunComfy上编辑图片——该技能是一个智能路由工具,可将用户的意图匹配到RunComfy模型库中合适的编辑模型。它会选择Nano Banana Edit(最多支持20张批量处理,默认保留主体特征)、OpenAI GPT Image 2 Edit(支持多语言图像内文字改写、多参考图合成、布局精准调整)、Flux Kontext Pro(单参考图高保真局部编辑)或Z-Image Turbo Inpaint(基于蒙版的精准区域编辑)。该技能整合了每个模型的文档提示模板,无需反复尝试错误模型即可获得更精准的编辑效果。通过本地RunComfy CLI调用`runcomfy run <vendor>/<model>/edit`命令。当用户输入“image edit”“edit image”“image-to-image”“i2i”“swap background”“remove object”“rewrite headline”或任何明确要求编辑单张或批量图片的指令时触发该技能。
在RunComfy上使用OpenAI GPT Image 2(ChatGPT Images 2.0的`/edit`端点)编辑图片——该工具集成了模型官方文档中的提示模式,相比直接使用原生提示词调用同一模型,能生成更优质的输出。本文档介绍了GPT Image Edit的优势(保留特征语言、多语言图像内文本编辑、最多支持10张参考图、布局/排版精度)、数据结构,以及何时转而使用Nano Banana Edit / Flux Kontext / GPT Image 2文本转图像模型。通过本地RunComfy CLI调用`runcomfy run openai/gpt-image-2/edit`。当触发词为"gpt image edit"、"gpt-image-edit"、"chatgpt image edit"、"edit with gpt image 2"或任何明确要求使用该模型进行编辑的指令时启动。
通过`runcomfy` CLI在RunComfy上实现掩码驱动的图像修复。当存在掩码时,将请求路由至通义千问MAI Z-Image Turbo Inpainting(支持掩码、强度和控制尺度的专用修复端点);当没有可用掩码且需通过描述指定区域时,则路由至保留身份的编辑模型(Nano Banana 2 Edit、GPT Image 2 Edit、FLUX Kontext Pro)。适用于对象移除、水印去除、区域替换、瑕疵修复,以及任何由二进制掩码定义目标区域的受控局部编辑场景。触发关键词包括“inpaint”“inpainting”“image inpaint”“remove from image”“fill region”“mask-driven edit”“remove watermark”“remove object”“patch the photo”“fill the hole”,或任何明确要求编辑静态图像特定掩码区域的请求。
通过`runcomfy` CLI在RunComfy上实现图像Outpainting——将静态图像扩展至原始画布之外,补全相机未捕捉到的内容,在保留原始内容的同时更改宽高比(正方形→16:9、竖屏→横屏)。支持调用Nano Banana 2 Edit(默认选项,基于空间语言驱动)、GPT Image 2 Edit(多参考图,匹配参考风格)、FLUX Kontext Pro(单次处理,最大程度保留原图)以及品牌专属编辑端点(Seedream / Dreamina / Qwen / FLUX 2)。会根据扩图需求是文本描述驱动、参考图驱动还是品牌风格锁定,选择合适的调用路径。当出现以下关键词时触发该功能:"outpaint"、"outpainting"、"extend image canvas"、"expand the image"、"fill in around the photo"、"uncrop"、"change aspect ratio"、"extend frame"、"wide-screen from square",或任何明确要求为现有静态图像添加画布的指令。
通过`runcomfy` CLI在RunComfy上为静态图像重新打光——更改灯光设置、色温、方向或氛围。当需要专业的重新打光时,会路由到Qwen Edit 2509专用的`relight` LoRA端点;若仅需通过文字描述灯光效果即可满足需求,则会 fallback 到保留主体特征的编辑端点(Nano Banana 2 Edit、GPT Image 2 Edit、FLUX Kontext Pro)。可用于产品重新打光(影室柔光箱→窗边自然光)、人像氛围转换(阴天→黄金时刻)或色彩分级调整。当出现“relight”“relighting”“change the lighting”“make it golden hour”“studio lighting”“rim light”“blue hour”“soft window light”“change light direction”“color temperature”等关键词,或任何明确要求更改静态图像灯光的指令时,将触发该功能。
在RunComfy上使用OpenAI GPT Image 2(ChatGPT Images 2.0)生成和编辑图片。本文档介绍了GPT Image 2的优势(嵌入文本、标识、多语言排版、指令精准度)、三种固定尺寸、支持内容保留的编辑指令,以及何时转而使用同类模型(Flux 2 / Nano Banana Pro / Seedream)。通过本地RunComfy CLI调用`runcomfy run openai/gpt-image-2/text-to-image`或`/edit`命令。触发关键词包括“gpt image 2”、“gpt-image-2”、“ChatGPT Images 2”、“image 2”,或任何明确要求使用该模型生成或编辑图片的请求。
全面兼容OpenAI的GPT Image 2工具,覆盖images/generations、images/edits以及使用image_generation工具的responses功能。当单次图像助手无法满足需求时使用——支持文本转图像、蒙版编辑、多图像批量生成、流式传输、partial_images以及文本+图像混合的Responses流程。读取.env文件并遵循进程环境变量;可与任何兼容OpenAI的网关配合使用。
生成用户原创内容(UGC)风格的生活方式照片,展示人物穿戴或使用你的产品——打造真实、有共鸣、适配社交媒体的图像。