Analyze Results

Berekent statistieken en vergelijkingstabellen uit ML-experimentresultaten.

Door wanshuiyin · wanshuiyin/Auto-claude-code-research-in-sleep

Werkt met setup ★ 6.8/10

Analyze Results — Berekent statistieken en vergelijkingstabellen uit ML-experimentresultaten.

Wat het doet

Analyseert ML-experimentresultaten, berekent statistieken en genereert vergelijkingstabellen en inzichten. Gebruik dit wanneer de gebruiker "analyseer resultaten" of "vergelijk" zegt, of experimentele data moet interpreteren.

Testrapport

Getest op een accuracy/loss-sweep van 3 configs x 3 seeds met één ingeplante afwijkende run (config_B seed 2 op 0.400 tegenover 0.78/0.79 bij de andere). Verbatim installatie (git clone + cp) werkt schoon; de skill is één self-contained prompt-workflow-SKILL.md zonder scripts, API-sleutels of externe dependencies. In de A/B-test signaleerden zowel de skill-arm als de kale basisarm correct de uitschieter, berekenden ze de juiste deltas ten opzichte van de baseline, en brachten ze de config_A-vs-config_B-rankingkanttekening naar voren met gelijke statistische degelijkheid en presentatie — de skill leverde dus geen meetbare meerwaarde op boven een agent zonder skill bij deze taak.

Getest op: 2026-07-12 · Claude Code 2.x (agent harness)

Installatie

git clone https://github.com/wanshuiyin/Auto-claude-code-research-in-sleep
cd Auto-claude-code-research-in-sleep
mkdir -p ~/.claude/skills
cp -r skills/analyze-results ~/.claude/skills/analyze-results

Commando's en voorbeeldprompts

  • /analyze-resultsBerekent statistieken en vergelijkingstabellen uit ML-experimentresultaten.

Skills reageren op gewone verzoeken — geen commando's om te onthouden. Na installatie activeren prompts zoals deze de skill (in het Engels):

  • Compare these experiment results and summarize findings
  • Analyze the results from my last training run
  • Generate a comparison table across these model runs