Loading...
Loading...
共找到 10 个 Skills
使用官方Google GenAI SDK(google-genai)为Gemini API和Vertex AI编写Python代码的专业指导。适用于文本生成、多模态输入、推理、工具调用以及媒体生成场景。
使用Google GenAI SDK管理和查询Agent Platform RAG Engine语料库,并检索相关上下文。适用于列出RAG语料库或文件、检查语料库、检索上下文或基于RAG语料库生成内容的场景。请勿用于标准数据库查询(请使用SQL/Spanner技能)、Google Workspace RAG或其他RAG产品(如gRAG)。
LLM经济编排专家,专注于Google GenAI(Gemini 3)、上下文缓存和高保真Token工程。
为应用接入Sentry——检测平台,按需安装并初始化SDK,连接各类信号:错误监控、追踪/性能监控、日志、指标、性能分析、会话重放、用户反馈、定时任务检查,以及AI/LLM监控(包括OpenAI、Anthropic、Vercel AI、LangChain、Google GenAI、Pydantic AI和Laravel AI的Agent运行、令牌成本和对话监控)。可用于为项目添加Sentry,或捕获除错误之外的更多信号。
使用Python中的Genkit开发AI驱动的应用程序。适用于用户询问Python中的Genkit、AI Agent、流程或工具,或是遇到Genkit报错、导入问题或API相关问题的场景。
使用Google的Veo 2和Veo 3模型创建和编辑视频。支持文本转视频、图像转视频、参考图转视频、视频修复(Inpainting)和视频延长功能。可用参数包括:prompt、image、mask、mode、duration、aspect-ratio。运行前请务必与用户确认参数,或明确说明默认值。
通过scripts/目录下的脚本,使用Google Gemini File API上传和管理文件。可用于上传图片、音频、视频、PDF及其他文件,供Gemini模型使用。支持文件上传、状态检查和文件管理。触发关键词为“upload file”、“file API”、“upload image”、“upload PDF”、“upload video”、“file management”。
利用Google GenAI及Cloud Speech SDK实现语音生成(TTS)、语音转文字(STT)和语音克隆功能,支持Gemini-TTS、Chirp 3以及Instant Custom Voice。
使用Google的Gemini-TTS和Chirp 3模型生成并转录语音。支持文本转语音(单/多发言人)、即时自定义语音,以及语音转文本(转录/说话人分离)。
使用Gemini 2.5 Flash Image和Gemini 3 Pro Image(Nano Banana)生成和编辑高质量图像。支持文本生成图像、风格迁移、虚拟试穿和角色一致性功能。