Analyze Results
Calcola statistiche e tabelle di confronto a partire dai risultati di esperimenti ML.
Richiede configurazione
Cosa fa
Analizza i risultati di esperimenti ML, calcola statistiche, genera tabelle di confronto e insight. Da usare quando l'utente dice "analizza i risultati", "confronta", o ha bisogno di interpretare dati sperimentali.
Rapporto di test
Testato su uno sweep accuracy/loss 3-config x 3-seed con un run divergente inserito appositamente (config_B seed 2 a 0.400 contro 0.78/0.79 dei fratelli). L'installazione letterale (git clone + cp) funziona in modo pulito; lo skill è un singolo SKILL.md prompt-workflow autonomo, senza script, API key o dipendenze esterne. Nell'A/B, sia il ramo con skill sia il ramo base semplice hanno correttamente segnalato l'outlier, calcolato i delta corretti rispetto alla baseline, e fatto emergere l'avvertenza sul ranking config_A-contro-config_B con pari solidità statistica e presentazione, quindi lo skill non ha aggiunto alcun vantaggio misurabile rispetto a un agente senza skill su questo compito.
Testato il: 2026-07-12 · Claude Code 2.x (agent harness)
Installazione
git clone https://github.com/wanshuiyin/Auto-claude-code-research-in-sleep cd Auto-claude-code-research-in-sleep mkdir -p ~/.claude/skills cp -r skills/analyze-results ~/.claude/skills/analyze-results
Comandi e prompt di esempio
/analyze-resultsCalcola statistiche e tabelle di confronto a partire dai risultati di esperimenti ML.
Gli skill si attivano con richieste in linguaggio naturale, senza comandi da ricordare. Dopo l'installazione, prompt come questi lo attivano (in inglese):
Compare these experiment results and summarize findingsAnalyze the results from my last training runGenerate a comparison table across these model runs