Analyze Results

Calcola statistiche e tabelle di confronto a partire dai risultati di esperimenti ML.

di wanshuiyin · wanshuiyin/Auto-claude-code-research-in-sleep

Richiede configurazione ★ 6.8/10

Analyze Results — Calcola statistiche e tabelle di confronto a partire dai risultati di esperimenti ML.

Cosa fa

Analizza i risultati di esperimenti ML, calcola statistiche, genera tabelle di confronto e insight. Da usare quando l'utente dice "analizza i risultati", "confronta", o ha bisogno di interpretare dati sperimentali.

Rapporto di test

Testato su uno sweep accuracy/loss 3-config x 3-seed con un run divergente inserito appositamente (config_B seed 2 a 0.400 contro 0.78/0.79 dei fratelli). L'installazione letterale (git clone + cp) funziona in modo pulito; lo skill è un singolo SKILL.md prompt-workflow autonomo, senza script, API key o dipendenze esterne. Nell'A/B, sia il ramo con skill sia il ramo base semplice hanno correttamente segnalato l'outlier, calcolato i delta corretti rispetto alla baseline, e fatto emergere l'avvertenza sul ranking config_A-contro-config_B con pari solidità statistica e presentazione, quindi lo skill non ha aggiunto alcun vantaggio misurabile rispetto a un agente senza skill su questo compito.

Testato il: 2026-07-12 · Claude Code 2.x (agent harness)

Installazione

git clone https://github.com/wanshuiyin/Auto-claude-code-research-in-sleep
cd Auto-claude-code-research-in-sleep
mkdir -p ~/.claude/skills
cp -r skills/analyze-results ~/.claude/skills/analyze-results

Comandi e prompt di esempio

  • /analyze-resultsCalcola statistiche e tabelle di confronto a partire dai risultati di esperimenti ML.

Gli skill si attivano con richieste in linguaggio naturale, senza comandi da ricordare. Dopo l'installazione, prompt come questi lo attivano (in inglese):

  • Compare these experiment results and summarize findings
  • Analyze the results from my last training run
  • Generate a comparison table across these model runs