Loading...
Loading...
共找到 21 个 Skills
在RunComfy上使用OpenAI GPT Image 2(ChatGPT Images 2.0的`/edit`端点)编辑图片——该工具集成了模型官方文档中的提示模式,相比直接使用原生提示词调用同一模型,能生成更优质的输出。本文档介绍了GPT Image Edit的优势(保留特征语言、多语言图像内文本编辑、最多支持10张参考图、布局/排版精度)、数据结构,以及何时转而使用Nano Banana Edit / Flux Kontext / GPT Image 2文本转图像模型。通过本地RunComfy CLI调用`runcomfy run openai/gpt-image-2/edit`。当触发词为"gpt image edit"、"gpt-image-edit"、"chatgpt image edit"、"edit with gpt image 2"或任何明确要求使用该模型进行编辑的指令时启动。
通过调用项目的CLI移除本地图像文件中可见的Gemini图像水印。当用户希望Agent清理一张或多张本地Gemini生成的图像并保存去水印后的输出文件时使用。
背景移除:支持透明PNG、抠图、产品照片、人像、宠物、合影等场景。 采用专用的Bria RMBG 2.0模型——无需提示词,处理速度快(约3秒),成本低(0.01美元)。 适用于背景移除、创建透明PNG、制作抠图、提取前景主体或为图像合成做准备等场景。
使用OpenCV、PyTorch和现代深度学习技术进行计算机视觉开发的专业指导,涵盖图像与视频处理。
AI 图像生成和处理工作流。通过提示词生成图像,支持文生图、图生图、批量生成、图床管理、长图合并、PPT 打包。核心特性是逐张确认生成,避免浪费 API 额度。
适用于用户有可视化相关需求,且任务可通过Fotor OpenAPI的图像/视频生成、编辑、格式转换、画质增强、批量输出或账户额度查询功能完成的场景,涵盖产品图、营销创意素材、海报、横幅、社交媒体封面、背景替换、超分辨率、画质修复等各类图像或视频资产相关工作流。
使用ImageMagick处理和操作图像。支持调整大小、格式转换、批量处理以及提取图像元数据。适用于处理图像、创建缩略图、调整壁纸大小或执行批量图像操作的场景。
开源计算机视觉库(OpenCV),用于实时图像处理、视频分析、目标检测、人脸识别以及相机标定。适用于处理图像、视频、相机、边缘检测、轮廓、特征检测、图像变换、目标跟踪、光流或任何计算机视觉任务的场景。
移除图片中的背景,保留带透明效果的前景主体。适用于需要隔离主体、创建抠图或为图像合成做准备的场景。
把一张或多张图片整理成 PSD 图层文件的创作与转换 skill。当用户需要 image2psd、图片转 PSD、 多张图片拼成 PSD、海报/设计稿拆成多个图层、白底转透明、颜色聚类拆层、把 Codex/AI 生图结果拆成元素图再合成 PSD、 或希望输出 layered PSD、可在 Photoshop/Photopea 中编辑的分层栅格文件时,应该使用此 skill。 在 Codex 中使用时,默认结合 imagegen skill:先用 Codex 视觉/生图能力理解、补齐或重建元素,再用本 skill 的脚本落地 PSD。
使用OpenCV修复技术移除Gemini标识、水印或AI生成图像的标记。当用户要求移除Gemini标识、AI水印或图像中的任何标识/水印时,可使用此技能。
对证件照片进行超分辨率处理,用于提升低分辨率照片的人脸匹配质量