Analyze Results

Počítá statistiky a srovnávací tabulky z výsledků ML experimentů.

od wanshuiyin · wanshuiyin/Auto-claude-code-research-in-sleep

Funguje s nastavením ★ 6.8/10

Analyze Results — Počítá statistiky a srovnávací tabulky z výsledků ML experimentů.

Co umí

Analyzuje výsledky ML experimentů, počítá statistiky, generuje srovnávací tabulky a poznatky. Použijte, když uživatel řekne „analyze results", „compare", nebo potřebuje interpretovat experimentální data.

Testovací report

Testováno na sweepu přesnost/ztráta se 3 konfiguracemi x 3 semeny s jedním záměrně vloženým divergujícím během (config_B seed 2 na 0,400 oproti sourozencům 0,78/0,79). Doslovná instalace (git clone + cp) funguje čistě; skill je jediný samostatný SKILL.md typu prompt-workflow bez skriptů, API klíčů nebo externích závislostí. V A/B testu obě varianty — se skillem i základní bez skillu — správně označily odlehlou hodnotu, spočítaly správné delty oproti baseline a upozornily na výhradu k pořadí config_A vs. config_B se stejnou statistickou pečlivostí a prezentací, takže skill nepřinesl žádný měřitelný přínos oproti agentovi bez skillu na této úloze.

Testováno: 2026-07-12 · Claude Code 2.x (agent harness)

Instalace

git clone https://github.com/wanshuiyin/Auto-claude-code-research-in-sleep
cd Auto-claude-code-research-in-sleep
mkdir -p ~/.claude/skills
cp -r skills/analyze-results ~/.claude/skills/analyze-results

Příkazy a ukázkové prompty

  • /analyze-resultsPočítá statistiky a srovnávací tabulky z výsledků ML experimentů.

Skilly se spouštějí běžnými požadavky — žádné příkazy k zapamatování. Po instalaci ho aktivují prompty jako tyto (anglicky):

  • Compare these experiment results and summarize findings
  • Analyze the results from my last training run
  • Generate a comparison table across these model runs