Analyze Results

Liczy statystyki i tabele porównawcze na podstawie wyników eksperymentów ML.

Autor: wanshuiyin · wanshuiyin/Auto-claude-code-research-in-sleep

Działa po konfiguracji ★ 6.8/10

Analyze Results — Liczy statystyki i tabele porównawcze na podstawie wyników eksperymentów ML.

Co robi ten skill

Analizuje wyniki eksperymentów ML, liczy statystyki, generuje tabele porównawcze i wnioski. Używaj, gdy użytkownik pisze "analyze results", "compare", albo potrzebuje zinterpretować dane eksperymentalne.

Raport z testu

Testowany na przeglądzie accuracy/loss w układzie 3 konfiguracje x 3 seedy, z jednym celowo podrzuconym rozbieżnym przebiegiem (config_B seed 2 na poziomie 0.400 wobec 0.78/0.79 u sąsiadów). Dosłowna instalacja (git clone + cp) działa bez zarzutu; skill to pojedynczy, samodzielny SKILL.md typu prompt-workflow, bez skryptów, kluczy API czy zewnętrznych zależności. W A/B zarówno wariant ze skillem, jak i zwykły wariant bazowy poprawnie wychwyciły odstającą wartość, policzyły prawidłowe delty względem baseline'u i wskazały zastrzeżenie dotyczące rankingu config_A vs config_B z tą samą rzetelnością statystyczną i prezentacją — więc na tym zadaniu skill nie dał żadnego wymiernego zysku względem agenta bez skilla.

Testowano: 2026-07-12 · Claude Code 2.x (agent harness)

Instalacja

git clone https://github.com/wanshuiyin/Auto-claude-code-research-in-sleep
cd Auto-claude-code-research-in-sleep
mkdir -p ~/.claude/skills
cp -r skills/analyze-results ~/.claude/skills/analyze-results

Komendy i przykładowe prompty

  • /analyze-resultsLiczy statystyki i tabele porównawcze na podstawie wyników eksperymentów ML.

Skille uruchamiają się na zwykłe polecenia — bez komend do zapamiętania. Po instalacji aktywują go prompty takie jak te (po angielsku):

  • Compare these experiment results and summarize findings
  • Analyze the results from my last training run
  • Generate a comparison table across these model runs