Loading...
Loading...
共找到 11 个 Skills
根据官方规范和最佳实践评估Agent Skill的设计质量。适用于审核、审计或改进SKILL.md文件及Skill包的场景,提供多维度评分和可落地的改进建议。
当需要将工作流、操作指南或功能打包为Agent Skill,或者需要对现有Skill进行脚手架搭建、验证、代码检查或评估时使用。适用于构建、创建、生成、搭建脚手架、检查或评估Skill的需求:Skill是一个包含SKILL.md、脚本、测试、任务图、CI和评估用例的文件夹。即使请求中使用playbook、runbook或可复用工作流而非Skill一词,同样适用。
定义所有 Skill 必须遵循的设计法则(Skill Laws),包括 AI 优先、人类中心、即调即用等核心法则。何时使用:当用户创建新 Skill、优化现有 Skill、询问 Skill 设计规范、或需要评估 Skill 质量时。
分析并比较来自任意来源(skills.sh、GitHub、Claude marketplace或本地文件)的现有Skill,与目标Skill或需求进行对标。获取Skill内容,从10个维度进行评估,生成结构化对比表格,识别差距,并建议采用、适配或从零构建。触发场景:analyze this skill、compare skills、is this skill good enough、what does this skill do、skill evaluation、should I use this skill、skill gap analysis、粘贴skills.sh链接、GitHub Skill链接,或上传SKILL.md文件以供评审。
使用CC 2.1.81的--bare模式运行隔离的评估与评分调用。构建claude -p --bare调用,用于在无插件/钩子干扰的情况下进行skill评估、触发器测试和LLM评分。适用于运行评估流水线、评分skill输出、测试提示词质量或隔离测试触发器准确性的场景。
设计并编写高质量的Agent Skills(包含SKILL.md及可选的参考文件/脚本)。适用于创建新Skill、重写现有Skill、优化Skill结构/元数据,或生成Skill的模板与评估内容的场景。
审核现有全局及项目级Skill的Agent友好性、一致性与最佳实践。当被要求“审核我的Skill”“检查Skill设置”“分析Skill质量”“查看Skill健康状况”“优化我的Skill”,或需要评估整体Skill生态系统时使用。提供提升Skill有效性的可落地建议。
了解Nexus Skill的工作原理。当用户提及以下内容时触发:学习技能、技能如何工作、什么是技能、技能教程、技能结构、理解技能、解释技能、何时创建技能、技能与项目的区别。时长10-12分钟。
创建新的Skill、修改并改进现有Skill,以及衡量Skill性能。适用于用户想要从零开始创建Skill、更新或优化现有Skill、运行评估(evals)来测试Skill、通过方差分析对标Skill性能,或者迭代提升Skill质量的场景。触发词:"create a skill"、"make a new skill"、"build a skill for"、"write a skill that"、"skill for doing X"、"I want a skill to"、"new skill"、"design a skill"、"scaffold a skill"、"improve this skill"、"optimize this skill"、"this skill isn't working well"、"evaluate this skill"、"score this skill"、"how good is this skill"、"run evals on"、"benchmark this skill"、"test this skill's quality"、"skill quality"、"skill performance"。当用户描述想要自动化的可重复工作流,或者说出"I keep doing X manually"、"can you remember how to do X"、"turn this into a skill"时,也会触发该功能。
针对任意编码Agent CLI,对Agent Skill进行全面的端到端评估——验证其脚本是否输出文档中记录的数值(确定性检查),测试其描述是否能在正确的提示词下触发,以及衡量遵循SKILL.md的Agent是否优于无Skill的基准版本(包含通过率差值、均值±标准差、基准测试)。当你需要测试、基准测试、验证、评级或量化某个Skill的质量,检查某个Skill“是否真的可用”,比较两个Skill版本,优化Skill的触发逻辑,或搭建评估套件时均可使用——即使用户只是问“这个Skill好用吗”、“我的Skill能正常工作吗”或“对这个Skill做基准测试”。支持以无头模式驱动Claude Code、OpenAI Codex、Antigravity(agy)、Cursor、GitHub Copilot、Amp、opencode或Grok。
在 shunk031/skills 和 shunk031/skills-private 仓库间调度并执行 coding-agent 技能相关工作。适用于以下场景:当需要添加、编辑、重命名、拆分或移除技能时;当需要确定某个技能归属哪个仓库时;当需要编写或转换 eval(评估用例)和 trigger(触发用例)时;或者当技能变更需要通过 dotfiles 订阅同步到机器时。此外,当你在 dotfiles 仓库中工作且请求涉及某个技能时也需使用本流程,因为技能内容已不再存储于 dotfiles 仓库中。