Loading...
Loading...
共找到 109 个 Skills
当用户想要分析Claude token使用情况、了解Claude API支出、检查缓存命中率、查看Claude Code工作流模式(技能、代理、钩子)或获取成本优化建议时,使用此技能。
用于视频旁白的ElevenLabs TTS集成方案。适用于生成旁白音频、选择语音或构建脚本转音频流水线场景
Hermes AI Agent部署、配置与优化专家指南,支持多平台、MCP集成及生产环境最佳实践
回答用户关于OpenRouter使用数据的自然语言问题——包括支出、请求量、模型细分、延迟、Token使用情况以及成本优化。当用户询问其API使用情况、账单、成本、热门模型、流量模式,或想要优化OpenRouter支出时使用。
Token高效型模型路由修改器
通过调度、自动扩缩容、节点健康监控、MIG分区和成本控制,运维支持GPU的Kubernetes集群以用于AI推理和训练。
应用栈顾问——按业务阶段、成本优化、性能影响分析推荐必备应用
通过MCP使用Harness CCM分析云成本、寻找优化机会并追踪异常情况。当用户提及“云成本”“成本分析”“成本优化”“削减开支”“成本报告”或询问云账单相关问题时使用。
通过agent-booster的WASM引擎应用简单代码转换——亚毫秒级、确定性、零成本(无需调用LLM)。是cost-booster-route的配套工具。
在明确调用时、需要降低Agent工作流成本时,或者当具体交付成果不需要说明、仅需最终内容、仅需代码、仅需结论或仅需最简输出时使用。
让Agent通过本地Lemonade Server在用户设备上生成图像、转录音频和合成语音,而非使用付费云API。首要用途是持久化更改路由规则——此后聊天仍在云端进行,但图像生成将始终在本地完成;配置工作区以在本地生成图像,即使用户在同一次请求中未提及图像或文件。也可用于用户希望在本地、离线、设备端完成或需保密的单次请求:转录此录音、生成此图片、朗读此文本。适用于Claude、Cursor、Codex或任何Agent工具。当用户希望削减图像、音频或语音API调用的成本或令牌消耗,或替换DALL-E、托管版Whisper、ElevenLabs等付费多模态API时使用;或当用户提及Lemonade Server、OmniRouter、SD-Turbo、kokoro、Ryzen AI或NPU/iGPU/dGPU推理时使用。不会修改应用源代码;若用户要为其发布的应用添加本地AI,请勿使用此功能。
将`/efficient-fable`的编排机制应用于任何高成本前沿模型:将研究、编码和测试工作委托给更廉价的子代理,同时将规划、整合和最终审核工作保留给昂贵的模型。