Analyze Results

Beregner statistik og sammenligningstabeller ud fra ML-eksperimentresultater.

Af wanshuiyin · wanshuiyin/Auto-claude-code-research-in-sleep

Virker med opsætning ★ 6.8/10

Analyze Results — Beregner statistik og sammenligningstabeller ud fra ML-eksperimentresultater.

Hvad det gør

Analysér ML-eksperimentresultater, beregn statistik, generér sammenligningstabeller og indsigter. Brug det, når brugeren skriver "analyze results", "compare", eller har brug for at fortolke eksperimentelle data.

Testrapport

Testet på en 3-config x 3-seed accuracy/loss-sweep med én plantet divergeret kørsel (config_B seed 2 på 0.400 mod søskende på 0.78/0.79). Verbatim-installationen (git clone + cp) fungerer rent; skillet er en enkelt selvstændig prompt-workflow-SKILL.md uden scripts, API-nøgler eller eksterne afhængigheder. I A/B-testen markerede både skill-armen og den almindelige basisarm korrekt outlieren, beregnede korrekte deltaer mod baseline og fremhævede forbeholdet om config_A-vs-config_B-rangering med lige stor statistisk soliditet og præsentation, så skillet tilførte ingen målbar forbedring i forhold til en agent uden skill på denne opgave.

Testet: 2026-07-12 · Claude Code 2.x (agent harness)

Installation

git clone https://github.com/wanshuiyin/Auto-claude-code-research-in-sleep
cd Auto-claude-code-research-in-sleep
mkdir -p ~/.claude/skills
cp -r skills/analyze-results ~/.claude/skills/analyze-results

Kommandoer og eksempelprompter

  • /analyze-resultsBeregner statistik og sammenligningstabeller ud fra ML-eksperimentresultater.

Skills udløses af almindelige forespørgsler — ingen kommandoer at huske. Efter installationen aktiverer prompter som disse skillen (på engelsk):

  • Compare these experiment results and summarize findings
  • Analyze the results from my last training run
  • Generate a comparison table across these model runs