Loading...
Loading...
一种迭代式的工作者-审阅者循环机制,会生成一个批评家子代理(subagent)对工作成果进行1-10分的评分并提供可落地的反馈,然后反复修订直到达到质量门槛(quality gate)。适用于功能开发、编写规格文档、审阅现有代码,或任何质量优先于速度的任务场景。触发短语:"use review-loop"、"polish this"、"iterate on this"、"/review-loop"、"review with feedback loop"。
npx skill4agent add 2dmurali/review-loop-skill review-loop平台说明: 此技能在支持子代理生成的Agent平台上效果最佳。 在不具备该能力的平台上,可以通过打开新的聊天上下文,仅粘贴工作成果(不包含之前的推理过程),并要求其给出1-10分的评分和具体反馈,以此模拟审阅者环节。
"实现X,use review-loop""对我刚写的文件run review-loop"| 设置项 | 默认值 |
|---|---|
| 最小循环次数 | 2 |
| 最大循环次数 | 4 |
| 质量门槛 | 8/10 |
| 工作者模型 | (当前使用的模型) |
| 审阅者模型 | (当前使用的模型或快速/平衡替代模型) |
| 任务复杂度 | 工作者能力 | 审阅者能力 | 理由 |
|---|---|---|---|
| 简单/机械性(CRUD、格式化、模板代码) | 快速/轻量型 | 平衡型 | 轻量型工作者速度快,平衡型审阅者能轻松发现问题 |
| 标准型(功能开发、重构、文档) | 平衡型 | 平衡型 | 在成本、速度和质量之间达到良好平衡 |
| 复杂型(多文件、集成、设计) | 平衡型 | 高级/推理型 | 高级审阅者能捕捉细微的架构问题,平衡型工作者可实现相应修改 |
| 极复杂型(安全、量化、分布式系统) | 高级/推理型 | 高级/推理型 | 两者都需要完整的上下文和推理能力。审阅者模型必须与工作者模型能力匹配 |
"实现X并use review-loop,质量门槛设为9,使用高级模型作为审阅者,最大循环次数5次"
"polish this,最小循环次数2次,质量门槛8"
"run review-loop,使用快速审阅者,最大循环次数2次"
"use review-loop,推理型审阅者,质量门槛9,最小3次最大6次循环"flowchart TD
A[完成工作] --> B[生成审阅者子代理]
B --> C{达到最小循环次数?}
C -- 未达到,继续循环 --> E[根据反馈修订]
C -- 已达到 --> D{评分≥质量门槛?}
D -- 是 --> F[最终润色]
D -- 否 --> G{达到最大循环次数?}
G -- 是,强制停止 --> F
G -- 否 --> E
E --> B
F --> H([完成])你是一名严格的审阅者。请对以下工作成果给出1-10分的评分,并提供具体、可落地的反馈。
## 任务内容
{任务简要描述}
## 审阅标准
{任务特定标准——此任务的核心要求}
优秀标准示例:
对于REST API端点:
- 使用正确的HTTP状态码
- 所有参数均有输入验证
- 强制认证;不允许未授权访问
- 无N+1查询模式
对于设计文档:
- 问题陈述清晰明确
- 考虑了替代方案并分析了利弊
- 对实现复杂度没有含糊表述
- 成功指标可衡量
对于数据管道:
- 幂等性——可安全重跑
- 优雅处理 schema 变更
- 记录故障模式
- 处理PII数据
## 说明
1. 仔细阅读工作成果
2. 给出1-10分评分,评分标准:
- 1-3分:存在根本性缺陷或缺失主要需求
- 4-6分:可运行但存在显著问题
- 7-8分:良好,仅存在 minor 问题
- 9-10分:优秀,可直接交付
3. 列出具体问题,如有可能注明文件:行号
4. 针对每个问题,说明**为什么重要**以及**如何修复**
5. 无需客气——保持诚实直接
6. 明确给出评分格式:"Score: N/10"
## 待审阅文件
{粘贴文件内容或列出文件路径及相关片段}第{N}/{max}次循环:评分{X}/10
- {关键反馈要点总结}| 任务类型 | 审阅者重点关注 |
|---|---|
| 代码 | 正确性、边界情况、错误处理、可读性、无安全问题 |
| 规格/设计文档 | 完整性、可行性、无含糊表述、可实现性 |
| 重构 | 无行为变更、无回归问题、比之前更简洁 |
| 写作 | 清晰度、结构、符合受众需求、无冗余内容 |
| Bug修复 | 解决根本原因、存在回归测试、无副作用 |
| 基础设施/IaC | 幂等性、最小权限原则、无硬编码密钥、销毁安全性 |
| 数据库迁移 | 可逆性、索引策略、数据丢失风险、大规模场景下的性能 |
| API设计 | 向后兼容性、认证、版本控制、错误契约 |
| 测试套件 | 边界场景覆盖、无测试依赖、有意义的断言 |
用户:"实现缓存层。Use review-loop,质量门槛8。"
你:
1. 实现缓存层
2. 生成审阅者 → 评分6,反馈:缺少淘汰机制、无TTL
3. 修订:添加淘汰机制 + TTL
4. 生成审阅者 → 评分8,反馈:minor命名问题
5. 最终润色,完成用户:"对我刚写的认证模块run review-loop"
你:
1. 读取认证模块
2. 生成审阅者 → 评分5,反馈:存在SQL注入风险、无速率限制
3. 修复:参数化查询、添加速率限制器
4. 生成审阅者 → 评分8,通过
5. 完成--- 审阅循环:{任务名称} ---
第1/4次循环:评分6/10
审阅者反馈:缺少输入验证、无网络超时错误处理、
函数过长(80行)。
行动:修复所有三个问题。
第2/4次循环:评分8/10
审阅者反馈:代码简洁。Minor问题:变量名`d`可更具描述性。
行动:达到质量门槛(8≥8)。进行最终润色。
结果:2次循环后评分8/10。完成。