Research Proof
Zwingt Forschungs- und Benchmark-Behauptungen durch eine gefrorene Verifizierer-Beweisleiter anstelle von zuversichtlicher Prosa.
Getestet · Funktioniert
Was es kann
Verwandelt eine vage Forschungs-, Benchmark- oder Kausalitätsbehauptung in ein strukturiertes Beweisprogramm mit festen Überschriften: Behauptung / Verifizierer-Grenze / Ablehnungs-Gates / Urteil / Beweis-Ledger. Löst bei Forschungsüberprüfungen, Evaluierungsdesigns, Benchmark- oder Kausalitätsbehauptungen und Fragen zur Evidenzsicherheit aus und erzwingt eine PROVEN/SUPPORTED/REJECTED/OPEN-Kennzeichnung anstelle von unqualifizierter Zuversicht.
Testbericht
Habe eine echte Produktionslatenz-Behauptung durch beide Pfade laufen lassen: Die Skill-Version zwang eine unabhängige Evaluatorprüfung und ein Randomisierungs-Ablehnungs-Gate, das die freie Baseline nie auslöste, und stufte dann das Urteil korrekt von einem informellen 'stark unterstützt' auf das disziplinierte SUPPORTED-Label herab.
Getestet am: 2026-07-14 · Claude Code 2.x (agent harness)
Installation
git clone https://github.com/tonyblu331/research-proof.git cd research-proof mkdir -p ~/.claude/skills cp -r skills/research-proof ~/.claude/skills/research-proof
Befehle & Beispiel-Prompts
/research-proofZwingt Forschungs- und Benchmark-Behauptungen durch eine gefrorene Verifizierer-Beweisleiter anstelle von zuversichtlicher Prosa.
Skills reagieren auf normale Anfragen — keine Slash-Befehle nötig. Nach der Installation aktivieren Prompts wie diese den Skill (auf Englisch):
Prove this latency benchmark claim before I publish itMy research says X is faster — verify that properlyCheck whether this experiment actually supports its claim