Loading...
Loading...
共找到 20 个 Skills
适用于使用Gemini模型生成图片时,包括选择Nano Banana 1/2/Pro版本、优化图片生成成本、编写图片提示词,或需要结合真实参考图片进行视觉定位的场景
Agent Platform模型调优。当您需要使用Agent Platform基础设施对开源模型或Gemini模型进行微调时使用此技能。请勿将其用于Agent Platform之外的模型训练、模型部署到端点(请使用`agent-platform-deploy`)或管理服务端点(请使用`agent-platform-endpoint-management`)。
使用Gemini 2.5 Flash Image和Gemini 3 Pro Image(Nano Banana)生成和编辑高质量图像。支持文本生成图像、风格迁移、虚拟试穿和角色一致性功能。
使用AI生成和编辑图片。适用于用户提出以下需求的场景:创建/绘制/生成图片、编辑/修改照片、更换背景、为图片添加元素、创建头像、制作标志等。涵盖诸如“画一只猫”“将背景改为蓝色”“生成一个标志”这类请求。请勿用于自拍场景——若用户提出“发送自拍”“给我发一张自拍”“拍一张自拍”这类需求,请使用selfie技能。
通过scripts/目录下的脚本,使用Google Gemini和Imagen模型生成图片。可用于AI图片生成、文本转图片、根据提示词创建视觉内容、生成多张图片、自定义宽高比以及生成最高4K的高分辨率输出。触发词包括“generate image”“create image”“imagen”“text to image”“AI art”“nano banana”。
当用户请求呼叫好友,或从Claude、Gemini、Codex获取基于CLI的第二意见时使用。
使用Gemini(默认)或fal.ai FLUX.2 klein 4B(--cheap参数用于快速/低成本生成)生成图片。使用Grok Imagine(默认)或fal.ai LTX-2(--cheap参数)生成视频。适用场景:创建图片、生成视觉内容、AI图片生成、海报制作、视频生成。
面向任意模型的视频理解能力——小文件采用原生直传模式,大文件则采用帧提取+音频转录作为备选方案。 当用户要求分析、描述或理解视频文件时使用(例如:“这个视频里有什么”、“总结这段剪辑内容”、“转录这段录音”)。