Executing Distributed System Tests

Esegue un piano di test per sistemi distribuiti progettato, valutando ogni esecuzione su una tassonomia di verdetto a 10 stati

di shenli · shenli/distributed-system-testing

Richiede configurazione ★ 8.0/10

Executing Distributed System Tests — Esegue un piano di test per sistemi distribuiti progettato, valutando ogni esecuzione su una tassonomia di verdetto a 10 stati

Cosa fa

Esegue un piano di test per sistemi distribuiti precedentemente progettato contro un cluster reale o simulato: scopre la toolbox di test esistente del SUT, guida il carico di lavoro e l'iniezione di errori, cattura prove di nemesis-landing per scenario e assegna uno dei dieci stati di verdetto con audit green-but-broken e weak-oracle prima di qualsiasi PASS. Si attiva su "execute the plan", "reproduce a distributed bug", "run stability/chaos tests", "validate a release end-to-end", o quando un file di piano esiste in docs/testing-plans/. Per scenari di boundary e fairness, valuta ogni braccio di superficie separatamente e applica una regola di downgrade in modo che un braccio non testato non possa rientrare in un pass di scenario.

Rapporto di test

Recuperato SKILL.md tramite l'API di GitHub; il frontmatter viene parsato (name+description), e 3 file referenziati nel corpo hanno restituito HTTP 200 (verdict-taxonomy.md, green-but-broken-red-flags.md, findings-report-template.md). Nessun percorso hardcoded o problemi di sicurezza; spedisce plugin.json/marketplace.json validi. Il percorso di esecuzione completo (guida l'iniezione di errori contro un cluster live) necessita di Docker + un SUT distribuito + un file di piano progettato che non ho potuto fornire, quindi ho misurato la fetta distintiva di verdetto/disciplina del report della skill: dato uno scenario di boundary con 4 bracci di superficie dove 2 sono passati e 2 non sono mai stati raggiunti, la mia baseline lo ha chiamato "PASS (with caveats), nothing blocks shipping", mentre seguendo la regola di downgrade per braccio del corpo ha forzato "PARTIAL-surface, NOT a pass, should NOT ship" più una tabella di copertura della superficie — l'esatto fallimento della superficie ripiegata che la skill afferma di prevenire (exec_baseline.md vs exec_skill.md).

Testato il: 2026-07-31 · Claude Code 2.x (agent harness)

Installazione

git clone --depth 1 https://github.com/shenli/distributed-system-testing.git /tmp/executing-distributed-system-tests-src
mkdir -p ~/.claude/skills
cp -R /tmp/executing-distributed-system-tests-src/skills/executing-distributed-system-tests ~/.claude/skills/executing-distributed-system-tests
# Plugin-marketplace alternative: /plugin marketplace add shenli/distributed-system-testing  then install the 'distributed-testing-skills' plugin (installs both design + execute skills)
# To ACTUALLY RUN a plan end-to-end you additionally need, none of which the skill bundles:
#   - a plan file produced by the paired 'designing-distributed-system-tests' skill (the skill halts if oracles/budget tiers are missing)
#   - a distributed system-under-test repo to run against
#   - container + fault-injection tooling: docker/podman + compose, iptables/tc/netem, optionally toxiproxy/libfaketime

Comandi e prompt di esempio

  • /executing-distributed-system-testsEsegue un piano di test per sistemi distribuiti progettato, valutando ogni esecuzione su una tassonomia di verdetto a 10 stati

Gli skill si attivano con richieste in linguaggio naturale, senza comandi da ricordare. Dopo l'installazione, prompt come questi lo attivano (in inglese):

  • Execute the test plan against the staging cluster
  • Reproduce this distributed bug with chaos testing
  • Run tenant isolation tests before this release