Loading...
Loading...
共找到 53 个 Skills
通过`runcomfy` CLI在RunComfy上为静态图像重新打光——更改灯光设置、色温、方向或氛围。当需要专业的重新打光时,会路由到Qwen Edit 2509专用的`relight` LoRA端点;若仅需通过文字描述灯光效果即可满足需求,则会 fallback 到保留主体特征的编辑端点(Nano Banana 2 Edit、GPT Image 2 Edit、FLUX Kontext Pro)。可用于产品重新打光(影室柔光箱→窗边自然光)、人像氛围转换(阴天→黄金时刻)或色彩分级调整。当出现“relight”“relighting”“change the lighting”“make it golden hour”“studio lighting”“rim light”“blue hour”“soft window light”“change light direction”“color temperature”等关键词,或任何明确要求更改静态图像灯光的指令时,将触发该功能。
通过Higgsfield AI借助30余种模型生成图片和视频,这些模型包括Nano Banana 2、Soul V2、Veo 3.1、Kling 3.0、Seedance 2.0、Flux 2、GPT Image 2等,此外还有Marketing Studio可用于制作带有定制化虚拟形象和导入产品的品牌广告视频/图片。 适用场景:"生成图片"、"制作画作"、"创作艺术作品"、"制作视频"、"将照片动画化"、"image-to-video"、"img2vid"、"用AI编辑图片"、"为照片添加风格"、"重新创作图片"、"制作片段"、"渲染场景"、"制作广告"、"制作UGC视频"、"生成营销视频"、"制作产品演示"、"制作开箱视频"、"电视广告"、"虚拟试穿"、"产品展示"、"品牌视频"、"产品演示人视频"、"从URL导入产品"、"为广告创建虚拟形象"。 支持text-to-image、image-to-image、image-to-video、基于参考的生成,以及Marketing Studio(虚拟形象+产品+广告模式)。 可自动检测传入的ID是上传文件还是过往任务ID。 当用户希望输出内容中包含自己的面部时,可与higgsfield-soul-id配合使用。 不适用场景:训练Soul Character(请使用higgsfield-soul-id)、带有模式特定提示增强的专业产品拍摄(请使用higgsfield-product-photoshoot)、纯文本/聊天/TTS任务。
通过`runcomfy` CLI在RunComfy上生成和编辑图像——这是一款覆盖全量图像模型目录的智能路由工具,支持的模型包括:FLUX 2(Klein 9B/4B、Pro、Dev、Flash、Turbo、Max)、Google Nano Banana 2/Pro、OpenAI GPT Image 2、字节跳动Seedream 5/4-5/4-0及Dreamina 4-0、阿里云Qwen Image和Z-Image Turbo、Wan 2-7。它同时支持文本转图像(t2i)和图像转图像/编辑(i2i)端点——该技能会根据用户的实际需求(排版精度、写实肖像、亚秒级迭代、多参考品牌风格、开源权重工作流)选择合适的模型,并提供每个模型的文档化提示模板以及最简`runcomfy run`调用指令。当用户提出“生成图像”“制作图片”“文本转图像”“AI图像”“制作一张……的图像”“图像转图像”“i2i”或任何明确要求创建或重新设计图像的请求时,该技能会触发。
在RunComfy上使用OpenAI GPT Image 2(ChatGPT Images 2.0)生成和编辑图片。本文档介绍了GPT Image 2的优势(嵌入文本、标识、多语言排版、指令精准度)、三种固定尺寸、支持内容保留的编辑指令,以及何时转而使用同类模型(Flux 2 / Nano Banana Pro / Seedream)。通过本地RunComfy CLI调用`runcomfy run openai/gpt-image-2/text-to-image`或`/edit`命令。触发关键词包括“gpt image 2”、“gpt-image-2”、“ChatGPT Images 2”、“image 2”,或任何明确要求使用该模型生成或编辑图片的请求。
全面兼容OpenAI的GPT Image 2工具,覆盖images/generations、images/edits以及使用image_generation工具的responses功能。当单次图像助手无法满足需求时使用——支持文本转图像、蒙版编辑、多图像批量生成、流式传输、partial_images以及文本+图像混合的Responses流程。读取.env文件并遵循进程环境变量;可与任何兼容OpenAI的网关配合使用。
通过inference.sh CLI使用OpenAI GPT-Image-2生成和编辑图片。模型:GPT-Image-2。功能:文本生成图片、图片编辑、图像修复、基于蒙版的编辑、多图片参考、批量生成。适用场景:产品原型、营销视觉素材、图片编辑、概念艺术、图像修复、照片处理。触发词:gpt image, gpt-image-2, openai image, chatgpt image, dall-e, dalle, openai image generation, gpt image edit, gpt inpainting, openai dall-e, gpt 4o image
从awesome-gpt-image-2风格库中选择GPT-Image2 / gpt-image-2视觉样式及行业提示词模板。当Agent需要借助仓库提供的模板、分类、风格标签、场景标签、注意事项及示例来创建、重写、分类或优化图像生成提示词时,可使用本技能。
通过统一的Pilio开发者API,使用Pilio GPT Image 2创建或编辑图片。适用于用户需要文本生成图片、基于提示词的图片编辑、风格重塑、商品照片转换,或通过一张或多张本地参考图片进行合成的场景。
AI图片生成技能,使用ChatGPT最新生图 gpt-image-2-all,当用户需要生成图片、视觉信息图、创建图像、编辑/修改/调整已有图片时使用此技能。基于API易平台(https://api.apiyi.com/)的ChatGPT最新生图gpt-image-2-all模型(gpt-image-2-all)的图片生成服务,无需访问外网。该模型以 $0.03/张 按次计费,支持文生图、单图编辑、多图融合、自然语言改图,文字还原度高、中文提示词友好。尺寸通过prompt描述控制(无显式size参数)与NanoBanana2不同的关键点:无size参数,需在prompt开头描述尺寸;统一$0.03/张无分辨率阶梯;使用对话式端点/v1/chat/completions为主推。
无需使用OPENAI_API_KEY,通过Codex/ChatGPT订阅认证即可借助gpt-image-2生成或编辑图片。适用于用户希望使用本地Codex认证的文本转图片、参考图片编辑或视觉素材制作场景,尤其在没有原生图像工具可用时。请勿用于官方OpenAI API密钥计费或兼容OpenAI的网关场景。
在Claude Code中使用您已有的ChatGPT Plus或Pro订阅通过GPT Image 2(ChatGPT Images 2.0)生成图片——无需单独的OpenAI权限,也无需按图片计费。通过本地Codex CLI支持文本生成图片、图片编辑(图生图)、风格迁移以及多参考图合成。当用户输入"gpt image 2"、"gpt-image-2"、"ChatGPT Images 2.0"、"image 2",或任何明确要求通过其ChatGPT订阅生成或编辑图片的指令时触发该功能。
通过AceDataCloud API使用OpenAI gpt-image-2生成和编辑图片。当您需要根据提示词生成高保真图片,或编辑/合成现有图片(例如将真实logo、二维码、截图融入场景中,保持角色一致性,重新设计风格)时使用。该工具在清晰文字呈现和精准编辑方面表现出色。