Test Guard
Überprüft KI-geschriebene Tests anhand von neun Regeln: Mock-Grenzen, keine doppelten oder leeren Tests
Getestet · Funktioniert
Was es kann
Test Guard ist ein Überprüfungslauf für Testcode, den ein Agent gerade geschrieben oder geändert hat, wobei neun Regeln angewendet werden: Mocks nur an Systemgrenzen, niemals DataClasses oder State-Objekte mocken, nahezu doppelte Tests parametrisieren, Tests löschen, die nichts abfangen, Tests nach dem Szenario benennen und Produktions-Regressionstests beibehalten. Es lädt eine Stack-spezifische Referenz für pytest, Jest/Vitest, PHPUnit/Pest oder LLM-Anwendungen und meldet dann Verstöße als Regelnummer plus Ort, Ursache und Behebung. Wird ausgelöst bei Anfragen zum Schreiben, Hinzufügen oder Überprüfen von Tests und bei Diffs, die test_*.py, *Test.php, *.test.ts, *_test.go oder Dateien unter tests/ und __tests__/ betreffen.
Testbericht
Das Repo in ein temporäres HOME geklont und bestätigt, dass die Kopie SKILL.md unter ~/.claude/skills/test-guard/SKILL.md ablegt; Frontmatter wird mit name+description (815 Zeichen) geparst, und alle vier vom Body verlinkten Dateien (references/pytest.md, jest.md, phpunit.md, llm-app-testing.md) lieferten HTTP 200; kein curl|sh, base64 oder Text, der Anmeldeinformationen berührt, irgendwo. Aufgabe: Ich schrieb ein 30-zeiliges Python-Preismodul plus eine bewusst KI-angehauchte 9-Test-pytest-Datei (MagicMock als Ersatz für die Cart-Dataclass, @patch auf dem privaten _tax_rate, assert_called_once auf log.info), dann erstellte ich eine Baseline-Überprüfung ohne Skill und eine zweite Überprüfung gemäß SKILL.md und references/pytest.md. Die Baseline erkannte die Parametrisierungsduplikation, schwache Benennung und fehlende arithmetische Assertions, bemerkte aber nie die gemockte Dataclass und nannte test_cart_dataclass_sets_attributes „geringwertig, aber harmlos; sie zu behalten kostet nichts“; die Skill-Überprüfung markierte denselben Test als Rule 4-Löschung, markierte die MagicMock Cart als Rule 8 über drei Tests hinweg und reduzierte 9 Tests auf 4 mit einem „do not merge“-Urteil und einer umgeschriebenen Suite, deren erwartete Gesamtsummen (119.00 DE, 107.10 mit einem 10%-Code) ich durch Ausführen des Moduls überprüfte. Trigger-Phrasierungen – sollte auslösen: „Ich habe gerade Tests für das Zahlungsmodul geschrieben, überprüfe sie, bevor ich committe“, „Füge Unit-Tests für src/parser.ts hinzu, die den Pfad für fehlerhafte Eingaben abdecken“, „Hier ist ein PR-Diff, der tests/test_orders.py berührt, ist etwas falsch an diesen Tests?“; sollte nicht auslösen: „Meine pytest-Suite schlägt mit einem Fixture ScopeMismatch-Fehler fehl, hilf mir beim Debuggen“, „Überprüfe dieses Refactoring der OrderService-Klasse“ – 5/5, die explizite DO NOT USE-Klausel der Beschreibung leitet beide Negative sauber ab.
Getestet am: 2026-07-21 · Claude Code 2.x (agent harness)
Installation
git clone --depth 1 https://github.com/amElnagdy/guard-skills.git /tmp/test-guard-src mkdir -p ~/.claude/skills cp -R /tmp/test-guard-src/skills/test-guard ~/.claude/skills/test-guard # No dependencies, no API keys, no scripts — SKILL.md plus 4 markdown references. # The repo also ships clean-code-guard, docs-guard, wp-guard, woo-guard in /tmp/test-guard-src/skills/. # CLI alternative (installs a copy, same result): npx skills add amElnagdy/guard-skills --skill test-guard # Usage: after your agent writes tests, say "Use test-guard on the tests you just wrote."
Befehle & Beispiel-Prompts
/test-guardÜberprüft KI-geschriebene Tests anhand von neun Regeln: Mock-Grenzen, keine doppelten oder leeren Tests
Skills reagieren auf normale Anfragen — keine Slash-Befehle nötig. Nach der Installation aktivieren Prompts wie diese den Skill (auf Englisch):
Review these tests before I commit themWrite tests for this new functionCheck this test file for common testing mistakes