Analyze Results
Beregner statistik og sammenligningstabeller ud fra ML-eksperimentresultater.
Virker med opsætning
Hvad det gør
Analysér ML-eksperimentresultater, beregn statistik, generér sammenligningstabeller og indsigter. Brug det, når brugeren skriver "analyze results", "compare", eller har brug for at fortolke eksperimentelle data.
Testrapport
Testet på en 3-config x 3-seed accuracy/loss-sweep med én plantet divergeret kørsel (config_B seed 2 på 0.400 mod søskende på 0.78/0.79). Verbatim-installationen (git clone + cp) fungerer rent; skillet er en enkelt selvstændig prompt-workflow-SKILL.md uden scripts, API-nøgler eller eksterne afhængigheder. I A/B-testen markerede både skill-armen og den almindelige basisarm korrekt outlieren, beregnede korrekte deltaer mod baseline og fremhævede forbeholdet om config_A-vs-config_B-rangering med lige stor statistisk soliditet og præsentation, så skillet tilførte ingen målbar forbedring i forhold til en agent uden skill på denne opgave.
Testet: 2026-07-12 · Claude Code 2.x (agent harness)
Installation
git clone https://github.com/wanshuiyin/Auto-claude-code-research-in-sleep cd Auto-claude-code-research-in-sleep mkdir -p ~/.claude/skills cp -r skills/analyze-results ~/.claude/skills/analyze-results
Kommandoer og eksempelprompter
/analyze-resultsBeregner statistik og sammenligningstabeller ud fra ML-eksperimentresultater.
Skills udløses af almindelige forespørgsler — ingen kommandoer at huske. Efter installationen aktiverer prompter som disse skillen (på engelsk):
Compare these experiment results and summarize findingsAnalyze the results from my last training runGenerate a comparison table across these model runs