Analyze Results

Calcula estadísticas y tablas comparativas a partir de resultados de experimentos de ML.

Por wanshuiyin · wanshuiyin/Auto-claude-code-research-in-sleep

Funciona con configuración ★ 6.8/10

Analyze Results — Calcula estadísticas y tablas comparativas a partir de resultados de experimentos de ML.

Qué hace

Analiza resultados de experimentos de ML, calcula estadísticas, genera tablas comparativas e ideas. Úsalo cuando el usuario diga "analiza los resultados", "compara", o necesite interpretar datos experimentales.

Informe de la prueba

Probado sobre un barrido de precisión/pérdida de 3 configuraciones x 3 semillas con una ejecución divergente sembrada a propósito (config_B semilla 2 en 0.400 frente a 0.78/0.79 de sus pares). La instalación literal (git clone + cp) funciona sin problemas; la skill es un único SKILL.md de flujo de prompts autocontenido, sin scripts, claves de API ni dependencias externas. En el A/B, tanto el brazo con skill como el brazo base sencillo señalaron correctamente el valor atípico, calcularon los deltas correctos respecto a la línea base, y expusieron la advertencia sobre la clasificación config_A frente a config_B con igual solidez estadística y presentación, por lo que la skill no aportó ninguna mejora medible frente a un agente sin skill en esta tarea.

Probado el: 2026-07-12 · Claude Code 2.x (agent harness)

Instalación

git clone https://github.com/wanshuiyin/Auto-claude-code-research-in-sleep
cd Auto-claude-code-research-in-sleep
mkdir -p ~/.claude/skills
cp -r skills/analyze-results ~/.claude/skills/analyze-results

Comandos y prompts de ejemplo

  • /analyze-resultsCalcula estadísticas y tablas comparativas a partir de resultados de experimentos de ML.

Los skills se activan con peticiones en lenguaje natural, sin comandos que memorizar. Tras instalarlo, prompts como estos lo activan (en inglés):

  • Compare these experiment results and summarize findings
  • Analyze the results from my last training run
  • Generate a comparison table across these model runs