A/B Testing
Entwirft statistisch valide Experimente und führt ein vollständiges ICE-bewertetes Experimentierprogramm durch.
Getestet · Funktioniert
Was es kann
Erstellt Hypothesen-basierte A/B/A-B-n-Testpläne mit Stichprobengrößen-Anleitung, primären/sekundären/Guardrail-Metriken und einer dokumentierten Warnung vor dem Peeking-Problem. Behandelt auch die Durchführung von Experimenten als fortlaufendes Programm: ICE-bewerteter Backlog, Experiment-Geschwindigkeitsziele und ein wiederverwendbares Gewinner-Playbook. Kein Code oder Plattformintegration – es ist reine Planungs- und Analyseanleitung, keine Statistik-Engine.
Testbericht
Folgt seiner eigenen Peeking-Regel bis ins letzte Detail: Angesichts eines gefälschten 3-Tage-Ergebnisses mit 95% Konfidenz weigerte es sich, einen Gewinner zu nennen und zitierte Regression zur Mitte und Tageseffekte, anstatt den Sieg zu erklären, etwas, das die Baseline-Antwort nicht einmal zu erwähnen wagte.
Getestet am: 2026-07-14 · Claude Code 2.x (agent harness)
Installation
git clone https://github.com/coreyhaines31/marketingskills cd marketingskills mkdir -p ~/.claude/skills cp -r skills/ab-testing ~/.claude/skills/ab-testing
Befehle & Beispiel-Prompts
/ab-testingEntwirft statistisch valide Experimente und führt ein vollständiges ICE-bewertetes Experimentierprogramm durch.
Skills reagieren auf normale Anfragen — keine Slash-Befehle nötig. Nach der Installation aktivieren Prompts wie diese den Skill (auf Englisch):
Design an A/B test and calculate the needed sample sizeCheck if my test duration is long enough to be validFrame a hypothesis and stats plan for this experiment