Loading...
Loading...
共找到 65 个 Skills
根据用户选择的编程语言生成Gemini LiveAPI客户端服务类。适用于用户需要构建、搭建或集成连接Gemini Enterprise LiveAPI WebSocket端点的客户端场景,该客户端需处理会话建立/恢复、Bearer令牌刷新,以及`ClientMessage`/`ServerMessage` proto的发送与接收。请勿将其用于普通(非实时、非双向)Gemini API场景,比如单次`generateContent`调用、嵌入生成、图像/视频生成或微调——这些场景请使用`gemini-api`技能。
本指南指导如何使用gcloud和kubectl将现有AI工作负载(Cloud Run、Gemini API、Gemini Enterprise Agent Platform)迁移到自托管GKE推理环境。适用于用户已有AI推理工作负载(部署在Cloud Run、Gemini API、Gemini Enterprise Agent Platform或自定义VM上)并希望将其迁移到GKE自托管推理环境的场景,或用户在迁移过程中提出后续问题(硬件选型、模型暂存、清单生成、验证、流量切换)的场景。**请勿**用于无现有工作负载可迁移的全新GKE推理部署(请改用gke-inference)。**请勿**用于用户打算通过Gemini Cloud Assist MCP服务器自动化迁移的场景。
借助Gemini API(包含Nano Banana图像生成、Veo视频、Gemini TTS语音及音频理解能力),提供「生成+理解」全流程的多模态媒体工作流与代码模板。
通过多个提供商网关,根据文本提示生成AI视频。适用于以下场景:(1) 根据文本描述生成视频;(2) 为内容制作创建AI生成的视频片段;(3) 基于参考图像的图像转视频生成;(4) 在多个视频生成提供商(VEO、Kling、Sora、Runway、Seedance、MiniMax、Gemini Omni)中进行选择。支持的网关包括:HeyGen API、fal.ai API、Kling官方直连API以及Gemini API(Gemini Omni Flash)。
用于将Firebase AI Logic(Gemini API)集成到Web应用中的官方技能。涵盖设置、多模态推理、结构化输出和安全性相关内容。
集成Firebase AI Logic(Firebase中的Gemini)以实现智能应用功能。适用于为Firebase应用添加AI能力、实现生成式AI功能或设置Firebase AI SDK的场景。涵盖Firebase AI SDK设置、提示工程和AI驱动功能的处理。
借助Gemini驱动的帧分析和社交媒体内容生成功能,将视频片段转换为AI生成的手绘分镜脚本
使用AI图像生成功能创建横幅。讨论格式/风格,生成变体版本,根据用户反馈进行迭代调整,并裁剪至目标比例。适用于用户需要创建横幅、页眉、英雄图或封面图的场景。
适用于将音频/视频转录为带时间戳、说话人标签和章节的文本。支持YouTube链接和本地文件,可生成结构化Markdown格式输出。
一款用于图像生成的Skill。使用Google Nano Banana Pro(Gemini 3 Pro Image)API生成高质量图像。支持生成标志、信息图表、插画、写实风格图像等。
使用Google的Nano Banana Pro(Gemini 3 Pro Image)API生成和编辑图片。当用户要求生成、创建、编辑、修改、更改、调整或更新图片时使用。当用户引用现有图片文件并要求以任何方式修改时也可使用(例如:“修改这张图片”、“更换背景”、“将X替换为Y”)。支持文本生成图片和图片编辑图片两种模式,分辨率可配置(默认1K,也可选择2K或4K高分辨率)。请勿先读取图片文件——直接使用此skill并带上--input-image参数即可。
使用 New-API 的 Gemini 原生 `generateContent` 生成或编辑图片。适用于需要文本生图、参考图编辑、输出本地 PNG,并希望复用 `.sofunny-image.env` 或当前 shell 环境变量的场景。