Skill Evaluator

Puntúa un SKILL.md según las mejores prácticas de Anthropic con un script validador y una rúbrica ponderada

Por gotalab · gotalab/skillport

Probado · Funciona ★ 8.4/10

Skill Evaluator — Puntúa un SKILL.md según las mejores prácticas de Anthropic con un script validador y una rúbrica ponderada

Qué hace

Evalúa el SKILL.md de una habilidad de agente según las mejores prácticas de autoría de Anthropic, combinando un validador Python automatizado (nomenclatura, longitud de descripción, longitud de cuerpo, profundidad de referencia) con una rúbrica ponderada de seis dimensiones que produce una puntuación de 1 a 5 y un informe con plantilla. Se activa cuando el usuario solicita revisar, evaluar, valorar o auditar una habilidad por su calidad. Produce puntuaciones por dimensión, anti-patrones detectados y recomendaciones de corrección priorizadas.

Informe de la prueba

Cloné el repositorio y ejecuté scripts/validate_skill.py contra una deliberately weak test skill (name "pdf", vague description); emitió valid JSON flagging the non-gerund name and missing activation triggers, exit 0. Noté una real gap: la path_style check only inspects markdown-link references, so the bare Windows path "references\extra.md" was NOT flagged. Luego produje two artifacts: una baseline free-form review (6 lines, no score) vs a skill-followed report (weighted 1.50/5.0 with a per-dimension table, reproduced validator warnings, and a "Poor" recommendation band) - la habilidad demonstrably adds a reproducible number and forces the checks to run. Los 3 archivos referenciados devolvieron HTTP 200; sin problemas de seguridad.

Probado el: 2026-07-21 · Claude Code 2.x (agent harness)

Instalación

git clone --depth 1 https://github.com/gotalab/skillport.git /tmp/skill-evaluator-src
mkdir -p ~/.claude/skills
cp -R /tmp/skill-evaluator-src/.skills/experimental/skill-evaluator ~/.claude/skills/skill-evaluator
# No deps: scripts/validate_skill.py is pure Python 3 stdlib (argparse, re, json, pathlib).
# Run the validator: python3 ~/.claude/skills/skill-evaluator/scripts/validate_skill.py <path/to/skill> --json

Comandos y prompts de ejemplo

  • /skill-evaluatorPuntúa un SKILL.md según las mejores prácticas de Anthropic con un script validador y una rúbrica ponderada

Los skills se activan con peticiones en lenguaje natural, sin comandos que memorizar. Tras instalarlo, prompts como estos lo activan (en inglés):

  • Evaluate this skill's SKILL.md for quality
  • Review my skill description for clarity
  • Audit this skill for structural anti-patterns