Analyze Results

Beräknar statistik och jämförelsetabeller från ML-experimentresultat.

av wanshuiyin · wanshuiyin/Auto-claude-code-research-in-sleep

Fungerar med konfiguration ★ 6.8/10

Analyze Results — Beräknar statistik och jämförelsetabeller från ML-experimentresultat.

Vad den gör

Analysera ML-experimentresultat, beräkna statistik, generera jämförelsetabeller och insikter. Används när användaren säger "analysera resultat", "jämför", eller behöver tolka experimentell data.

Testrapport

Testad på en svep med 3 konfigurationer x 3 seeds för noggrannhet/förlust med en inplanterad divergerad körning (config_B seed 2 på 0,400 mot 0,78/0,79 hos syskonen). Installation ord för ord (git clone + cp) fungerar rent; skillen är en enda självständig prompt-arbetsflödes-SKILL.md utan skript, API-nycklar eller externa beroenden. I A/B-testet flaggade både skill-armen och den vanliga baslinje-armen korrekt avvikaren, beräknade korrekta deltan mot baslinjen, och lyfte fram förbehållet om rangordningen config_A mot config_B med samma statistiska stringens och presentation, så skillen tillförde inget mätbart lyft jämfört med en oguidad agent på den här uppgiften.

Testad: 2026-07-12 · Claude Code 2.x (agent harness)

Installation

git clone https://github.com/wanshuiyin/Auto-claude-code-research-in-sleep
cd Auto-claude-code-research-in-sleep
mkdir -p ~/.claude/skills
cp -r skills/analyze-results ~/.claude/skills/analyze-results

Kommandon och exempelprompter

  • /analyze-resultsBeräknar statistik och jämförelsetabeller från ML-experimentresultat.

Skills triggas av vanliga förfrågningar — inga kommandon att memorera. Efter installationen aktiverar prompter som dessa skillen (på engelska):

  • Compare these experiment results and summarize findings
  • Analyze the results from my last training run
  • Generate a comparison table across these model runs