Loading...
Loading...
共找到 24 个 Skills
通过逆向工程的 Gemini Web API 生成图片和文本。支持文本生成、提示词生图、参考图片视觉输入和多轮对话。当其他技能需要图片生成后端,或用户要求"用Gemini生成图片"、"Gemini文本生成"时使用。
适用于以下场景:提及「nanobanana」、「生成图片」、「创建图片」、「编辑图片」、「AI绘图」、「Gemini图片」、「图片生成」时
使用阿里云百炼模型生成图片、视频、语音,并进行音频转写。
`flux` CLI(@vforsh/flux)使用指南,可通过Black Forest Labs(BFL)FLUX API生成和编辑图片。内容包括BFL API密钥配置、模型选择、图片生成、参考图编辑、图像修复/扩展、结果等待、余额查询、--plain/--json输出使用,以及常见API错误(402/403/429)处理。
使用ModelScope Z-Image系列模型(Z-Image-Turbo、Z-Image、Z-Image-Edit)生成图片。适用于用户要求生成图片、创作艺术作品或需要图片生成功能的场景。支持带轮询的异步生成以及可选的LoRA配置。重要提示 - 模型选择规则:如果用户在请求中明确提到"Z-Image-Turbo",则使用"Tongyi-MAI/Z-Image-Turbo";如果用户明确提到"Z-Image"(不带Turbo),则使用"Tongyi-MAI/Z-Image";否则默认使用"Tongyi-MAI/Z-Image-Turbo"。
使用OpenAI的GPT Image 2 API生成和编辑图片。这是一款交互式技能,可引导用户完成图片创建流程,提供风格预设、成本可控的草稿/最终版工作流、思考模式、轮播图制作以及照片编辑功能。当用户请求通过OpenAI/GPT Image 2生成图片、想要创建社交媒体轮播图、将照片编辑为艺术风格,或需要带有可读文本的图片(如信息图、图表、海报)时,可使用此技能。
通过curl调用HTMLCSStoImage API。使用此技能从HTML/CSS生成图片或捕获网页截图。
通过EachLabs使用OpenAI的GPT Image v2生成并编辑图片。支持文本转图片(gpt-image-v2-text-to-image)和基于指令的编辑(gpt-image-v2-edit)。当用户明确要求使用GPT Image 2/OpenAI图片生成,或需要高保真照片级真实感、精准文本渲染或忠实于参考图的编辑时,可使用此工具。
借助Google Gemini生成图片。支持文本生成图片以及基于参考图片的风格迁移。
古文逐字注解、组合排版、章节意旨图与全章解读生成器。把原文、字词注、句义注、无字顶部配图和章节解读排成一张可读的长 PNG。USE WHEN 用户调用 ljg-classic OR 要求给文言文、古诗文、经史子集做逐字注解、彩色夹注、章节解读、古文讲义图、章节配图。NOT FOR 只翻译一句古文、只写现代文章或通用内容卡片。
使用OpenAI GPT Image API(gpt-image-2、gpt-image-1等)生成或编辑图片。仅当用户明确指定OpenAI或GPT作为提供商时使用,例如:“gpt image”、“openai image”、“generate image with openai”、“用 openai 画图”、“用 GPT 生成图片”。对于未指定提供商的通用图片请求,请使用nanobanana-skill。请勿用于绘制图表(架构图/流程图)——此类图表请使用Mermaid或代码绘制。
发布阶段 - 将文章发布至WordPress、Ghost平台,生成图片并发送Webhook。