Loading...
Loading...
共找到 18 个 Skills
基于OpenAI、Google、DashScope以及Canghe API的AI图像生成工具。支持文本生成图像、参考图生成、自定义宽高比。默认采用串行生成模式;可根据需求启用并行生成。适用于用户提出生成、创建或绘制图像的场景。
使用Gemini 2.5 Flash Image和Gemini 3 Pro Image(Nano Banana)生成和编辑高质量图像。支持文本生成图像、风格迁移、虚拟试穿和角色一致性功能。
将Modellix用于AI图像和视频生成的统一API集成到应用程序中。当用户需要从文本生成图像、从文本或图像创建视频、编辑图像、进行虚拟试穿,或调用任何Modellix模型API时,均可使用此Skill。当用户提及Modellix、媒体生成领域的Model-as-a-Service(MaaS),或需要通过统一API对接Qwen、Wan、Seedream、Seedance、Kling、Hailuo或MiniMax等提供商时,也触发此Skill。
使用视觉LLM作为评估工具对图像进行评分和对比。针对11种使用场景(文本生成图像、照片真实感、文档OCR、图表、UI、肖像、产品、科学图像、发票、替代文本、艺术风格)提供YAML定义的标准预设。支持OpenAI、Anthropic、Gemini、Mistral和OpenRouter作为评估模型提供商。通过SOPS + age自动解密密钥。
基于共享的Punk风格库,为文章、小红书笔记、微信公众号推文、X平台帖子、主题草稿生成封面图和可复用的图像提示词,同时支持封面、社交平台封面图、海报提示词、基于风格模板的图像提示词或长文本生成图像的需求。使用该技能分析源内容,确认平台/宽高比和视觉风格,保存最终提示词,在有可用图像生成工具时生成图像。
在RunComfy上使用OpenAI GPT Image 2(ChatGPT Images 2.0)生成和编辑图片。本文档介绍了GPT Image 2的优势(嵌入文本、标识、多语言排版、指令精准度)、三种固定尺寸、支持内容保留的编辑指令,以及何时转而使用同类模型(Flux 2 / Nano Banana Pro / Seedream)。通过本地RunComfy CLI调用`runcomfy run openai/gpt-image-2/text-to-image`或`/edit`命令。触发关键词包括“gpt image 2”、“gpt-image-2”、“ChatGPT Images 2”、“image 2”,或任何明确要求使用该模型生成或编辑图片的请求。