Loading...
Loading...
共找到 20 个 Skills
基于Google Gemini模型(Nano Banana)的AI图像生成与编辑工具。当用户要求生成图像、创建图像、编辑图像,或提及"nano banana"、"nanobanana"、"gemini image"时使用。支持文生图、图像编辑、多图像参考,以及1K/2K/4K分辨率输出。
调用Google Gemini模型以实现结构化输出、多模态任务及谷歌专属功能。当用户需要使用Gemini、结构化JSON输出、Google API集成或高性价比并行处理时,可采用本方案。
通过scripts/目录下的脚本使用Google Gemini模型生成文本内容。可用于文本生成、带图片的多模态提示词、复杂推理的思维模式、JSON格式输出,以及借助Google Search grounding获取实时信息。触发关键词包括“generate with gemini”、“use gemini for text”、“AI text generation”、“multimodal prompt”、“gemini thinking mode”、“grounded response”。
在RunComfy上使用Google Nano Banana 2(Gemini家族闪存级文本生成图像模型)生成图像——该技能集成了模型官方文档中的提示模式,相比直接使用该模型的普通提示,能输出更优质的结果。文档介绍了Nano Banana 2的优势(快速迭代、图像内文字渲染、可预测构图、可选联网上下文)、分辨率层级定价、安全容忍度调节,以及何时转而使用Nano Banana Pro / GPT Image 2 / Flux 2 / Seedream。通过本地RunComfy CLI调用`runcomfy run google/nano-banana-2/text-to-image`。当触发关键词为"nano banana"、"nano-banana-2"、"nano banana 2"、"google image gen"、"gemini image",或明确要求使用该模型生成图像时启动。
通过MCP(Gemini模型或兼容服务),使用结构化提示词、比例设置和验证机制,生成适用于营销、UI设计或演示场景的高质量图片。
连接至Google Cloud Agent Platform GenAI模型并执行推理,包括第一方Gemini模型和第三方OpenMaaS模型(如Llama、DeepSeek、Qwen等)。当您需要生成调用Gemini或OpenMaaS模型的代码、通过GenAI SDK、OpenAI SDK或旧版Agent Platform SDK进行身份验证、配置基础URL及全局/区域端点,或排查429资源耗尽(DSQ)、400用户验证错误、404未找到错误时,可使用本技能。请勿将其用于模型部署至端点或运行模型评估。
使用Google的Agent Development Kit (ADK),通过Python、Java、Go或TypeScript构建单Agent和多Agent系统。适用于使用ADK创建AI Agent、设计多Agent架构、实现Agent工具、配置Agent回调、管理Agent状态、编排顺序/并行/循环Agent工作流的场景,或当用户提及ADK、google-adk、google agent development kit、基于Gemini的Agentic AI,或使用Google工具进行Agent编排时。也适用于搭建ADK项目、编写Agent测试、部署Agent,或集成MCP工具与ADK的场景。
使用AI生成和编辑图片。当用户要求“生成图片”“创建图片”“制作图画”“编辑此图片”“修改此图片”,或者在构建需要视觉资产(如首屏图、图标或插图)的UI时使用。
通过AceDataCloud API使用基于Gemini的NanoBanana生成和编辑AI图像。适用于根据文本提示创建图像或使用文本指令编辑现有图像的场景。支持nano-banana、nano-banana-2、nano-banana-pro及其:official变体。
让Claude能够使用Google AI Studio来测试提示词、探索模型以及构建AI应用原型
当用户需要生成图片、UI资源、图标、背景图、占位符或任何视觉内容时使用。适用于诸如‘生成一张图片’、‘创建一幅画’、‘制作一个图标’、‘我需要一个用于……的视觉素材’这类请求场景。
使用AI模型(FLUX、Gemini)生成或编辑图片。适用于通用图片生成,包括照片、插画、艺术品、视觉资产、概念艺术,以及任何非技术图表或原理图的图片。如需生成流程图、电路图、通路图和技术图表,请改用scientific-schematics技能。