Loading...
Loading...
共找到 39 个 Skills
通过inference.sh CLI使用Google Gemini原生图像模型生成图片。支持模型:Gemini 3 Pro Image、Gemini 2.5 Flash Image。功能:文本生成图像、图像编辑、多图像输入。触发词:nano banana、gemini image、gemini 3 pro image、gemini 2.5 flash image、google image generation、native image generation、gemini native image
在RunComfy上使用OpenAI GPT Image 2(ChatGPT Images 2.0)生成和编辑图片。本文档介绍了GPT Image 2的优势(嵌入文本、标识、多语言排版、指令精准度)、三种固定尺寸、支持内容保留的编辑指令,以及何时转而使用同类模型(Flux 2 / Nano Banana Pro / Seedream)。通过本地RunComfy CLI调用`runcomfy run openai/gpt-image-2/text-to-image`或`/edit`命令。触发关键词包括“gpt image 2”、“gpt-image-2”、“ChatGPT Images 2”、“image 2”,或任何明确要求使用该模型生成或编辑图片的请求。
全面兼容OpenAI的GPT Image 2工具,覆盖images/generations、images/edits以及使用image_generation工具的responses功能。当单次图像助手无法满足需求时使用——支持文本转图像、蒙版编辑、多图像批量生成、流式传输、partial_images以及文本+图像混合的Responses流程。读取.env文件并遵循进程环境变量;可与任何兼容OpenAI的网关配合使用。
基于Gemini原生的Nano Banana图像生成与编辑工具,支持Nano Banana、Nano Banana 2和Nano Banana Pro版本。适用于文本生成图像、图像编辑、多本地参考图生成、批量生成、预演请求检查,或使用自定义Gemini兼容基础URL(如自托管网关)的场景。
通过 inference.sh CLI 使用 Pruna P-Image 模型生成图像。支持的模型包括:P-Image、P-Image-LoRA、P-Image-Edit、P-Image-Edit-LoRA。功能特性:文生图、图像编辑、LoRA 风格生成、多图像合成、快速推理。Pruna 在不损失画质的前提下对模型进行了速度优化。触发关键词:pruna, p-image, pruna image, fast image generation, optimized flux, pruna ai, p image, fast ai image, economic image generation, cheap image generation
基于Google Gemini模型(Nano Banana)的AI图像生成与编辑工具。当用户要求生成图像、创建图像、编辑图像,或提及"nano banana"、"nanobanana"、"gemini image"时使用。支持文生图、图像编辑、多图像参考,以及1K/2K/4K分辨率输出。
本Skill可用于任何与图像相关的AI生成或编辑任务。触发词包括: 生成类:"generate image"、"create image"、"make picture"、"draw"、"visualize"、"image of"、"create art"、"generate art" 编辑类:"edit image"、"modify image"、"change image"、"update image"、"fix image"、"enhance image" 添加/移除类:"add to image"、"put in image"、"remove from image"、"delete from image"、"add element" 风格类:"style transfer"、"make it look like"、"convert style"、"apply style"、"in the style of" 产品类:"product photo"、"product placement"、"place product"、"mockup"、"put product on" 合成类:"combine images"、"merge images"、"blend images"、"create composite" 支持通过Google Gemini(Nano Banana Pro)或OpenAI DALL-E实现文本转图像生成、带参考图的图像编辑、产品放置、风格迁移以及多图像合成。
当使用Gemini API(Nano Banana Pro)生成和编辑图像时,应使用此Skill。它适用于通过文本提示创建图像、编辑现有图像、应用风格迁移、生成带文本的标志、制作贴纸、产品样机或任何图像生成/处理任务。支持文本转图像、图像编辑、多轮优化以及基于多张参考图的图像合成。
Novita AI:涵盖大语言模型(LLM)、图像生成与编辑、视频生成、音频(TTS/ASR)以及GPU云服务。当用户需要调用Novita AI API时即可使用本技能——包括与LLM(DeepSeek、Llama、Qwen)对话、生成图像(FLUX、Stable Diffusion、Seedream、混元图像)、编辑图像(移除背景、图像放大、图像修复、图生图、扩图、重绘、人脸融合、替换背景、移除文字)、生成视频(Kling、Wan、混元、Minimax Hailuo、Vidu、PixVerse、Seedance)、进行文本转语音或语音转文本(MiniMax TTS、GLM TTS、Fish Audio、ASR、语音克隆)、运行兼容OpenAI的批量任务、管理GPU云实例与无服务器端点,或查询账户余额与账单。当用户提及novita.ai、Novita AI、Novita API密钥,或想要使用任何Novita平台服务时也会触发本技能——即使用户只说“生成一张图片”或“运行LLM”且Novita作为可用提供商时也会触发。
根据文本提示生成或编辑图片。当用户要求创建、绘制、设计或编辑图像、插画、照片、图标、海报或任何视觉内容时使用。
面向 GPT Image 2 的图像生成 / 编辑技能。可在 3 种环境下使用:(A) Garden 本地模式,通过 OpenAI 兼容接口直接出图并落盘;(B) Host-Native 模式,把本 Skill 当作提示词工程指引,把渲染好的 prompt 交给宿主 Agent 自带的图像工具出图;(C) Advisor 模式,宿主无任何图像工具时退化为高质量 prompt 顾问。涵盖 18 大类、80+ 个结构化模板,覆盖海报 / UI / 产品 / 信息图 / 学术图 / 技术架构图 / 漫画 / 头像 / 流程板 / 电影分镜 / IP 周边 / 编辑工作流等场景。
[QianWen] 使用Wan和Qwen Image模型生成和编辑图像。支持文本转图像、图像编辑(风格迁移、主体一致性、文本渲染)以及文本-图像交错输出。触发场景:用户想要创建插画、产品图、艺术设计、海报,进行文本转图像生成,编辑/转换现有图像,应用风格迁移,基于参考照片生成图像,生成文本-图像交错内容,提及Wan/Qwen Image模型/AI艺术创作,或明确通过名称调用此技能(例如use qianwen-image-generation)。请勿触发场景:用户想要理解/分析现有图像或进行OCR(使用qianwen-vision),视频生成(使用qianwen-video-generation),纯文本任务。