Analyze Results
Berekent statistieken en vergelijkingstabellen uit ML-experimentresultaten.
Werkt met setup
Wat het doet
Analyseert ML-experimentresultaten, berekent statistieken en genereert vergelijkingstabellen en inzichten. Gebruik dit wanneer de gebruiker "analyseer resultaten" of "vergelijk" zegt, of experimentele data moet interpreteren.
Testrapport
Getest op een accuracy/loss-sweep van 3 configs x 3 seeds met één ingeplante afwijkende run (config_B seed 2 op 0.400 tegenover 0.78/0.79 bij de andere). Verbatim installatie (git clone + cp) werkt schoon; de skill is één self-contained prompt-workflow-SKILL.md zonder scripts, API-sleutels of externe dependencies. In de A/B-test signaleerden zowel de skill-arm als de kale basisarm correct de uitschieter, berekenden ze de juiste deltas ten opzichte van de baseline, en brachten ze de config_A-vs-config_B-rankingkanttekening naar voren met gelijke statistische degelijkheid en presentatie — de skill leverde dus geen meetbare meerwaarde op boven een agent zonder skill bij deze taak.
Getest op: 2026-07-12 · Claude Code 2.x (agent harness)
Installatie
git clone https://github.com/wanshuiyin/Auto-claude-code-research-in-sleep cd Auto-claude-code-research-in-sleep mkdir -p ~/.claude/skills cp -r skills/analyze-results ~/.claude/skills/analyze-results
Commando's en voorbeeldprompts
/analyze-resultsBerekent statistieken en vergelijkingstabellen uit ML-experimentresultaten.
Skills reageren op gewone verzoeken — geen commando's om te onthouden. Na installatie activeren prompts zoals deze de skill (in het Engels):
Compare these experiment results and summarize findingsAnalyze the results from my last training runGenerate a comparison table across these model runs