Loading...
Loading...
共找到 65 个 Skills
这是使用正确的当前SDK(@google/genai v1.27+,而非已废弃的@google/generative-ai)的Google Gemini API完整指南。涵盖文本生成、多模态输入(文本+图片+视频+音频+PDF)、函数调用、思考模式、流式传输、系统指令,以及2025年的准确模型信息(Gemini 2.5 Pro/Flash/Flash-Lite,支持100万输入令牌,而非200万)。 适用场景:集成Gemini API、实现多模态AI应用、使用思考模式进行复杂推理、并行执行函数调用、流式响应、部署到Cloudflare Workers、构建聊天应用,或遇到SDK废弃警告、上下文窗口错误、模型未找到错误、函数调用失败、多模态格式错误时。
在使用Google Gemini进行开发时,查阅Gemini API文档、SDK模式以及当前最佳实践。将主题映射到本地缓存文档和在线源,提供正确的@google/genai使用模式,并突出已弃用API与当前API的使用差异。可通过‘gemini docs’、‘gemini guide’、‘how to use gemini’、‘gemini SDK’、‘@google/genai’触发,或者在编写导入@google/genai或google-genai的代码时触发。
基于@google/genai SDK的Google Gemini API指南。适用于多模态AI、思维模式、函数调用场景,或解决SDK弃用警告、上下文错误、多模态格式错误等问题。
Gemini API开发指南。用于在规划阶段预先定义架构,并在编码/调试阶段验证代码模式。
支持Pro/Flash/Ultra模型、拥有1M token上下文窗口的Google Gemini API
借助官方Gemini API分析本地或已下载的社交视频文件,尤其适用于TikTok/Reels基准拆解、脚本分解以及生成结构化JSON输出。当您需要超越元数据的视频级分析时使用本技能,包括上传视频文件、调用Gemini 3.1 Pro Preview,并将分析结果与源元数据关联。
通过OpenRouter,使用inference.sh CLI访问Claude、Gemini、Kimi、GLM及100+大语言模型(LLMs)。 支持模型:Claude Opus 4.5、Claude Sonnet 4.5、Claude Haiku 4.5、Gemini 3 Pro、Kimi K2、GLM-4.6、Intellect 3。 统一API接入所有模型,具备自动降级和成本优化功能。 适用场景:AI助手、代码生成、推理、Agent、聊天、内容生成。 相关关键词:claude api、openrouter、llm api、claude sonnet、claude opus、gemini api、kimi、大语言模型、gpt替代方案、anthropic api、ai模型api、llm访问、chat api、claude替代方案、openai替代方案
专为Evaluate-Loop打造的集成评估器,用于评估接入了外部服务的track——包括Supabase认证/数据库、Stripe支付、Gemini API、各类第三方API。它会检查API契约、认证流程、数据持久化、错误恢复、环境配置以及端到端流程的完整性。当track类型为'integration'、'auth'、'payments'或'api'时,会由loop-execution-evaluator调度该评估器。触发关键词:'evaluate integration'、'test auth flow'、'check API'、'verify payments'。
基于CLI的图像生成工具,通过Python调用Google Gemini APIs,根据文本提示生成图像。适用于用户需要「生成图像」「用AI创建图像」「Gemini图像」「文本转图像」「创建精灵图」或「生成角色艺术图」的场景。支持模型选择、批量生成、水印去除和背景透明化。请勿用于Web应用图像功能(请使用nano-banana-builder)、视频/音频生成或非Gemini模型的场景。
使用Google的Gemini API分析视频——描述内容、回答问题、转录带有视觉描述的音频、引用时间戳、剪辑视频以及处理YouTube链接。支持9种视频格式、多种模型(Gemini 2.5/2.0),上下文窗口最高可达200万token(对应6小时视频)。
使用Google的Nano Banana Pro(Gemini 3 Pro Image)生成图像。适用于通过Gemini API生成AI图像、创建专业视觉内容或构建图像生成功能的场景。触发关键词包括Nano Banana Pro、Gemini 3 Pro Image、gemini-3-pro-image-preview、Google图像生成。
当你编写调用Gemini API的代码时,可使用本技能,适用于文本生成、多轮对话、多模态理解、图像生成、流式响应、背景研究任务、函数调用、结构化输出,或是从旧的generateContent API迁移的场景。本技能涵盖Interactions API,这是在Python和TypeScript中使用Gemini模型与Agent的推荐方式。