Executing Distributed System Tests

Ejecuta un plan de prueba de sistemas distribuidos diseñado, puntuando cada ejecución en una taxonomía de veredictos de 10 estados

Por shenli · shenli/distributed-system-testing

Funciona con configuración ★ 8.0/10

Executing Distributed System Tests — Ejecuta un plan de prueba de sistemas distribuidos diseñado, puntuando cada ejecución en una taxonomía de veredictos de 10 estados

Qué hace

Ejecuta un plan de prueba de sistemas distribuidos previamente diseñado contra un clúster real o simulado: descubre el conjunto de herramientas de prueba existente del SUT, impulsa la carga de trabajo y la inyección de fallos, captura evidencia de aterrizaje de némesis por escenario y asigna uno de diez estados de veredicto con auditorías de 'verde pero roto' y 'oráculo débil' antes de cualquier APROBADO. Se activa con "execute the plan", "reproduce a distributed bug", "run stability/chaos tests", "validate a release end-to-end", o cuando existe un archivo de plan en docs/testing-plans/. Para escenarios de límite y equidad, puntúa cada brazo de superficie por separado y aplica una regla de degradación para que un brazo no probado no pueda integrarse en un pase de escenario.

Informe de la prueba

Se obtuvo SKILL.md a través de la API de GitHub; el frontmatter se analiza (name+description), y 3 archivos referenciados en el cuerpo devolvieron HTTP 200 (verdict-taxonomy.md, green-but-broken-red-flags.md, findings-report-template.md). Sin rutas codificadas ni problemas de seguridad; incluye plugin.json/marketplace.json válidos. La ruta de ejecución completa (dirigir la inyección de fallos contra un clúster en vivo) necesita Docker + un SUT distribuido + un archivo de plan diseñado que no pude proporcionar, por lo que medí la porción distintiva de disciplina de veredicto/informe de la habilidad: dado un escenario de límite con 4 brazos de superficie donde 2 pasaron y 2 nunca fueron alcanzados, mi línea base lo llamó "PASS (with caveats), nothing blocks shipping", mientras que siguiendo la regla de degradación por brazo del cuerpo forzó "PARTIAL-surface, NOT a pass, should NOT ship" más una tabla de cobertura de superficie — el fallo exacto de superficie plegada que la habilidad afirma prevenir (exec_baseline.md vs exec_skill.md).

Probado el: 2026-07-31 · Claude Code 2.x (agent harness)

Instalación

git clone --depth 1 https://github.com/shenli/distributed-system-testing.git /tmp/executing-distributed-system-tests-src
mkdir -p ~/.claude/skills
cp -R /tmp/executing-distributed-system-tests-src/skills/executing-distributed-system-tests ~/.claude/skills/executing-distributed-system-tests
# Plugin-marketplace alternative: /plugin marketplace add shenli/distributed-system-testing  then install the 'distributed-testing-skills' plugin (installs both design + execute skills)
# To ACTUALLY RUN a plan end-to-end you additionally need, none of which the skill bundles:
#   - a plan file produced by the paired 'designing-distributed-system-tests' skill (the skill halts if oracles/budget tiers are missing)
#   - a distributed system-under-test repo to run against
#   - container + fault-injection tooling: docker/podman + compose, iptables/tc/netem, optionally toxiproxy/libfaketime

Comandos y prompts de ejemplo

  • /executing-distributed-system-testsEjecuta un plan de prueba de sistemas distribuidos diseñado, puntuando cada ejecución en una taxonomía de veredictos de 10 estados

Los skills se activan con peticiones en lenguaje natural, sin comandos que memorizar. Tras instalarlo, prompts como estos lo activan (en inglés):

  • Execute the test plan against the staging cluster
  • Reproduce this distributed bug with chaos testing
  • Run tenant isolation tests before this release