Loading...
Loading...
共找到 118 个 Skills
借助EachLabs AI模型,通过文本提示词、图片或参考输入生成新视频。支持文本转视频、图片转视频、转场效果、运动控制、数字人播报和虚拟形象生成功能。适用于用户需要创建新视频内容的场景。若要编辑现有视频,请查看eachlabs-video-edit。
借助EachLabs AI模型,根据文本提示生成新图像。支持多模型系列的文本转图像功能,包括Flux、GPT Image、Gemini、Imagen、Seedream等。适用于用户需要根据文本创建新图像的场景。如需编辑现有图像,请查看eachlabs-image-edit。
[QianWen] 使用Qwen模型生成文本、进行对话、编写代码、推理以及调用函数。触发条件:用户要求与Qwen聊天、使用Qwen生成文本、编写代码、使用Qwen函数调用,或通过名称显式调用此技能(例如:use qianwen-text)。不触发条件:不涉及Qwen的通用编程问题、使用非Qwen AI模型(如OpenAI、Gemini等)、图像/视频理解(请使用qianwen-vision)、图像/视频/音频生成。
面向AI Agent的OpenRouter API专家助手。当你需要调用OpenRouter统一API来访问400+ AI模型时使用。涵盖对话补全、流式响应、工具调用、结构化输出、网页搜索、嵌入、多模态输入、模型选择、路由以及错误处理等内容。
向Langfuse的default-model-prices.json中添加新的LLM模型定价条目。适用于添加模型价格、更新模型定价、创建模型条目、添加Claude/OpenAI/Anthropic/Google/Gemini/AWS Bedrock/Azure/Vertex AI模型定价、使用matchPattern正则表达式、pricingTiers或模型成本配置等场景。内容涵盖模型价格JSON结构、多供应商匹配的正则表达式、带条件的分层定价、缓存定价以及验证规则。
[QwenCloud] 使用Qwen模型生成文本、开展对话、编写代码、执行推理以及调用函数。触发条件:用户请求与Qwen聊天、生成文本、使用Qwen编写代码、使用Qwen函数调用功能,或显式通过名称调用本技能(例如使用qwencloud-text)。禁止触发场景:不涉及Qwen的通用编码问题、非Qwen AI模型的使用(OpenAI、Gemini等)、图像/视频理解(请使用qwencloud-vision)、图像/视频/音频生成。
通过命令行在RunComfy上运行任意模型。`runcomfy` CLI是一个独立二进制文件,一次认证即可访问数百个模型端点——涵盖图像生成、图像编辑、视频生成、图生视频、唇形同步、人脸替换、视频编辑、图像修复、图像扩展、画面延伸、ControlNet、重新打光、图像超分辨率、LoRA训练等功能。提交请求、轮询状态、下载输出结果。本技能将指导Agent如何安装、认证、发现模型架构、调用模型、流式处理/轮询/无需等待、以JSON输出模式编写脚本以及处理错误。当触发词为“runcomfy cli”、“install runcomfy”、“runcomfy login”、“runcomfy run”、“runcomfy whoami”、“runcomfy api”,或任何明确要求从脚本或终端调用RunComfy模型的请求时,本技能将启动。相关的兄弟技能(ai-image-generation、ai-video-generation、image-edit、video-edit、face-swap、lipsync、image-to-video、image-inpainting、image-outpainting、video-extend、controlnet-pose、relight)均通过此CLI进行调度。
使用此Skill操作Microsoft Foundry(Azure AI Foundry):从模型库部署AI模型、借助知识索引构建RAG应用、创建并评估AI Agent、管理RBAC权限与角色分配、管理配额和容量、创建Foundry资源。 适用场景:Microsoft Foundry、AI Foundry、模型部署、模型库、RAG、知识索引、创建Agent、评估Agent、Agent监控、创建Foundry项目、新建Foundry项目、配置Foundry、Foundry入门、部署Foundry基础设施、创建Foundry资源、创建AI Services、多服务资源、AIServices类型、注册资源提供程序、启用认知服务、配置AI Services账户、为Foundry创建资源组、RBAC、角色分配、托管标识、服务主体、权限、配额、容量、TPM、部署失败、QuotaExceeded。 不适用场景:Azure Functions(请使用azure-functions)、App Service(请使用azure-create-app)、通用Azure资源创建(请使用azure-create-app)。
通过`runcomfy` CLI在RunComfy上生成和编辑图像——这是一款覆盖全量图像模型目录的智能路由工具,支持的模型包括:FLUX 2(Klein 9B/4B、Pro、Dev、Flash、Turbo、Max)、Google Nano Banana 2/Pro、OpenAI GPT Image 2、字节跳动Seedream 5/4-5/4-0及Dreamina 4-0、阿里云Qwen Image和Z-Image Turbo、Wan 2-7。它同时支持文本转图像(t2i)和图像转图像/编辑(i2i)端点——该技能会根据用户的实际需求(排版精度、写实肖像、亚秒级迭代、多参考品牌风格、开源权重工作流)选择合适的模型,并提供每个模型的文档化提示模板以及最简`runcomfy run`调用指令。当用户提出“生成图像”“制作图片”“文本转图像”“AI图像”“制作一张……的图像”“图像转图像”“i2i”或任何明确要求创建或重新设计图像的请求时,该技能会触发。
当用户要求运行Gemini CLI进行代码审查、方案审查或大上下文(>200k tokens)处理时使用。非常适合需要大上下文窗口的全面分析场景。默认使用Gemini 3 Pro,以提供最先进的推理和编码能力。
撰写高效AI视频生成提示词的最佳实践与技巧。涵盖:Veo、Seedance、Wan、Grok、Kling、Runway、Pika、Sora的提示词策略。学习:镜头类型、运镜方式、灯光、节奏、风格关键词、反向提示词。用途:提升视频质量、获得一致效果、生成专业级视频提示词。相关关键词:视频提示词、如何撰写视频提示词、Veo提示词、视频生成技巧、优化AI视频、视频提示词工程、视频提示词指南、视频提示词模板、AI视频技巧、视频提示词最佳实践、视频提示词示例、电影摄影提示词
从网址、播客和本地文件中总结或提取文本/转录内容(是“转录此YouTube/视频”需求的优质替代方案)。