Skill Evaluator

Scorer en SKILL.md mot Anthropic beste praksis med et validator-skript og vektet rubrikk

av gotalab · gotalab/skillport

Bestått ★ 8.4/10

Skill Evaluator — Scorer en SKILL.md mot Anthropic beste praksis med et validator-skript og vektet rubrikk

Hva den gjør

Evaluerer en agents ferdighets SKILL.md mot Anthropic sine beste praksiser for forfatterskap, og kombinerer en automatisert Python-validator (navngivning, beskrivelseslengde, kroppslengde, referansedybde) med en seks-dimensjonal vektet rubrikk som gir en 1-5 poengsum og en malbasert rapport. Utløses når brukeren ber om å gjennomgå, evaluere, vurdere eller revidere en ferdighet for kvalitet. Produserer poengsummer per dimensjon, oppdagede anti-mønstre og prioriterte fiksanbefalinger.

Testrapport

Klonet repoet og kjørte scripts/validate_skill.py mot en bevisst svak testferdighet (navn "pdf", vag beskrivelse); den sendte ut gyldig JSON som flagget det ikke-gerundiske navnet og manglende aktiveringstriggere, exit 0. Jeg la merke til et reelt gap: path_style-sjekken inspiserer kun markdown-lenkereferanser, så den bare Windows-stien "references\extra.md" ble IKKE flagget. Deretter produserte jeg to artefakter: en baseline fri-form gjennomgang (6 linjer, ingen poengsum) vs en ferdighetsfølgende rapport (vektet 1.50/5.0 med en per-dimensjonstabell, reproduserte validatoradvarsler, og et "Dårlig" anbefalingsbånd) - ferdigheten legger demonstrativt til et reproduserbart tall og tvinger sjekkene til å kjøre. Alle 3 refererte filer returnerte HTTP 200; ingen sikkerhetsfeil.

Testet på: 2026-07-21 · Claude Code 2.x (agent harness)

Installer

git clone --depth 1 https://github.com/gotalab/skillport.git /tmp/skill-evaluator-src
mkdir -p ~/.claude/skills
cp -R /tmp/skill-evaluator-src/.skills/experimental/skill-evaluator ~/.claude/skills/skill-evaluator
# No deps: scripts/validate_skill.py is pure Python 3 stdlib (argparse, re, json, pathlib).
# Run the validator: python3 ~/.claude/skills/skill-evaluator/scripts/validate_skill.py <path/to/skill> --json

Kommandoer og eksempelprompter

  • /skill-evaluatorScorer en SKILL.md mot Anthropic beste praksis med et validator-skript og vektet rubrikk

Skills utløses av vanlige forespørsler — ingen kommandoer å huske. Etter installasjonen aktiverer prompter som disse skillen (på engelsk):

  • Evaluate this skill's SKILL.md for quality
  • Review my skill description for clarity
  • Audit this skill for structural anti-patterns