Analyze Results
Liczy statystyki i tabele porównawcze na podstawie wyników eksperymentów ML.
Działa po konfiguracji
Co robi ten skill
Analizuje wyniki eksperymentów ML, liczy statystyki, generuje tabele porównawcze i wnioski. Używaj, gdy użytkownik pisze "analyze results", "compare", albo potrzebuje zinterpretować dane eksperymentalne.
Raport z testu
Testowany na przeglądzie accuracy/loss w układzie 3 konfiguracje x 3 seedy, z jednym celowo podrzuconym rozbieżnym przebiegiem (config_B seed 2 na poziomie 0.400 wobec 0.78/0.79 u sąsiadów). Dosłowna instalacja (git clone + cp) działa bez zarzutu; skill to pojedynczy, samodzielny SKILL.md typu prompt-workflow, bez skryptów, kluczy API czy zewnętrznych zależności. W A/B zarówno wariant ze skillem, jak i zwykły wariant bazowy poprawnie wychwyciły odstającą wartość, policzyły prawidłowe delty względem baseline'u i wskazały zastrzeżenie dotyczące rankingu config_A vs config_B z tą samą rzetelnością statystyczną i prezentacją — więc na tym zadaniu skill nie dał żadnego wymiernego zysku względem agenta bez skilla.
Testowano: 2026-07-12 · Claude Code 2.x (agent harness)
Instalacja
git clone https://github.com/wanshuiyin/Auto-claude-code-research-in-sleep cd Auto-claude-code-research-in-sleep mkdir -p ~/.claude/skills cp -r skills/analyze-results ~/.claude/skills/analyze-results
Komendy i przykładowe prompty
/analyze-resultsLiczy statystyki i tabele porównawcze na podstawie wyników eksperymentów ML.
Skille uruchamiają się na zwykłe polecenia — bez komend do zapamiętania. Po instalacji aktywują go prompty takie jak te (po angielsku):
Compare these experiment results and summarize findingsAnalyze the results from my last training runGenerate a comparison table across these model runs