Loading...
Loading...
共找到 23 个 Skills
通过`runcomfy` CLI在RunComfy上实现掩码驱动的图像修复。当存在掩码时,将请求路由至通义千问MAI Z-Image Turbo Inpainting(支持掩码、强度和控制尺度的专用修复端点);当没有可用掩码且需通过描述指定区域时,则路由至保留身份的编辑模型(Nano Banana 2 Edit、GPT Image 2 Edit、FLUX Kontext Pro)。适用于对象移除、水印去除、区域替换、瑕疵修复,以及任何由二进制掩码定义目标区域的受控局部编辑场景。触发关键词包括“inpaint”“inpainting”“image inpaint”“remove from image”“fill region”“mask-driven edit”“remove watermark”“remove object”“patch the photo”“fill the hole”,或任何明确要求编辑静态图像特定掩码区域的请求。
通过inference.sh CLI使用OpenAI GPT-Image-2生成和编辑图片。模型:GPT-Image-2。功能:文本生成图片、图片编辑、图像修复、基于蒙版的编辑、多图片参考、批量生成。适用场景:产品原型、营销视觉素材、图片编辑、概念艺术、图像修复、照片处理。触发词:gpt image, gpt-image-2, openai image, chatgpt image, dall-e, dalle, openai image generation, gpt image edit, gpt inpainting, openai dall-e, gpt 4o image
通过HuggingFace Diffusers使用Stable Diffusion模型实现最先进的文本到图像生成。适用于根据文本提示生成图像、执行图像到图像转换、图像修复或构建自定义扩散工作流的场景。
使用阿里云Model Studio Qwen Image Edit Max(qwen-image-edit-max)编辑图片。适用于修改现有图片(图像修复、元素替换、风格迁移、局部编辑)、保持主体一致性,或记录图片编辑请求与响应的映射关系场景。
适用于使用阿里云Model Studio Qwen图像编辑模型(qwen-image-edit、qwen-image-edit-plus、qwen-image-edit-max、qwen-image-2.0系列及快照版本)编辑图像的场景。可用于修改现有图像(图像修复、内容替换、风格迁移、局部编辑)、保持主体一致性,或者记录图像编辑请求与响应的映射关系。
基于fal.ai托管模型的AI驱动图像编辑,支持风格迁移、背景移除、物体移除以及图像修复功能。
通过命令行在RunComfy上运行任意模型。`runcomfy` CLI是一个独立二进制文件,一次认证即可访问数百个模型端点——涵盖图像生成、图像编辑、视频生成、图生视频、唇形同步、人脸替换、视频编辑、图像修复、图像扩展、画面延伸、ControlNet、重新打光、图像超分辨率、LoRA训练等功能。提交请求、轮询状态、下载输出结果。本技能将指导Agent如何安装、认证、发现模型架构、调用模型、流式处理/轮询/无需等待、以JSON输出模式编写脚本以及处理错误。当触发词为“runcomfy cli”、“install runcomfy”、“runcomfy login”、“runcomfy run”、“runcomfy whoami”、“runcomfy api”,或任何明确要求从脚本或终端调用RunComfy模型的请求时,本技能将启动。相关的兄弟技能(ai-image-generation、ai-video-generation、image-edit、video-edit、face-swap、lipsync、image-to-video、image-inpainting、image-outpainting、video-extend、controlnet-pose、relight)均通过此CLI进行调度。
通过inference.sh CLI使用FLUX、Gemini、Grok、Seedream、Reve等50+模型生成AI图像。支持的模型包括:FLUX Dev LoRA、FLUX.2 Klein LoRA、Gemini 3 Pro Image、Grok Imagine、Seedream 4.5、Reve、ImagineArt。功能涵盖:文本转图像、图像转图像、图像修复、LoRA、图像编辑、图像超分辨率、文本渲染。适用场景:AI艺术创作、产品样机、概念艺术、社交媒体图形、营销视觉素材、插画。相关关键词:flux、图像生成、ai image、text to image、stable diffusion、generate image、ai art、midjourney替代方案、dall-e替代方案、text2img、t2i、图像生成器、ai picture、用AI创建图像、生成式AI、ai插画、grok image、gemini image
借助ModelsLab的API,通过文本提示生成高质量AI图像,或对现有图像进行转换,该API包含FLUX、Realtime和Community等10000+模型,支持text2img、img2img、图像修复(inpainting)和ControlNet功能。
Novita AI:涵盖大语言模型(LLM)、图像生成与编辑、视频生成、音频(TTS/ASR)以及GPU云服务。当用户需要调用Novita AI API时即可使用本技能——包括与LLM(DeepSeek、Llama、Qwen)对话、生成图像(FLUX、Stable Diffusion、Seedream、混元图像)、编辑图像(移除背景、图像放大、图像修复、图生图、扩图、重绘、人脸融合、替换背景、移除文字)、生成视频(Kling、Wan、混元、Minimax Hailuo、Vidu、PixVerse、Seedance)、进行文本转语音或语音转文本(MiniMax TTS、GLM TTS、Fish Audio、ASR、语音克隆)、运行兼容OpenAI的批量任务、管理GPU云实例与无服务器端点,或查询账户余额与账单。当用户提及novita.ai、Novita AI、Novita API密钥,或想要使用任何Novita平台服务时也会触发本技能——即使用户只说“生成一张图片”或“运行LLM”且Novita作为可用提供商时也会触发。
使用EachLabs AI模型编辑、转换、放大和增强图像。支持图像编辑、风格迁移、背景移除、图像放大、图像修复、人脸互换、虚拟试穿、3D生成以及图像分析。适用于用户需要编辑或转换现有图像的场景。
为Bria的FIBO图像生成模型编写结构化的VGL(Visual Generation Language,视觉生成语言)JSON提示词。当你需要为文本生成图像、图像编辑、图像修复、图像扩展、背景生成或图像标注创建JSON格式的详细图像描述时,可使用此技能。触发场景包括编写结构化提示词、创建VGL JSON、为AI生成描述图像,或使用Bria/FIBO的structured_prompt格式的需求。此外,在将自然语言的图像请求转换为FIBO模型所需的确定性JSON schema时,也可使用此技能。