Loading...
Loading...
Diagnose surprising, negative, unstable, or ambiguous ML/AI experiment results and decide whether to debug implementation, rerun experiments, change metrics or baselines, revise the algorithm, narrow the paper claim, park, or kill a direction. Use this skill whenever results do not match expectations, a method fails, metrics conflict, seeds vary, baselines beat the method, plots look suspicious, or the user asks what to do next after experimental results.
npx skill4agent add a-green-hand-jack/ml-research-skills result-diagnosisexperiment-report-writerresearch-project-memoryexperiment-report-writeralgorithm-design-plannerexperiment-design-plannerrun-experimentconference-writing-adapter<installed-skill-dir>/
├── SKILL.md
└── references/
├── diagnosis-taxonomy.md
├── evidence-audit.md
├── next-decision-rules.md
├── report-template.md
└── triage-protocol.mdreferences/diagnosis-taxonomy.mdreferences/triage-protocol.mdreferences/next-decision-rules.mdreferences/evidence-audit.mdreferences/report-template.mdExpected [method] to improve [metric/diagnostic] over [baseline] on [setting], but observed [result] under [controls].experiment-design-plannerreferences/diagnosis-taxonomy.mdreferences/evidence-audit.mdreferences/triage-protocol.mdreferences/next-decision-rules.mddebugrerunablaterevise-methodnarrow-claimwriteparkkillwritereferences/report-template.mddocs/diagnosis/result_diagnosis_YYYY-MM-DD_<short-name>.md# Result Diagnosis: [Short Name]
## Result Snapshot
## Expected vs Observed
## Symptom Classification
## Evidence Checked
## Competing Explanations
## Most Likely Diagnosis
## Decision
## Next Checks or Actions
## Claim Impact
## Project Memory Writebackresearch-project-memorymemory/evidence-board.mdmemory/claim-board.mdmemory/risk-board.mdmemory/action-board.mdmemory/decision-log.md.agent/worktree-status.mdobservedinferred