Research Proof

Zwingt Forschungs- und Benchmark-Behauptungen durch eine gefrorene Verifizierer-Beweisleiter anstelle von zuversichtlicher Prosa.

von tonyblu331 · tonyblu331/research-proof

Getestet · Funktioniert ★ 9.2/10

Research Proof — Zwingt Forschungs- und Benchmark-Behauptungen durch eine gefrorene Verifizierer-Beweisleiter anstelle von zuversichtlicher Prosa.

Was es kann

Verwandelt eine vage Forschungs-, Benchmark- oder Kausalitätsbehauptung in ein strukturiertes Beweisprogramm mit festen Überschriften: Behauptung / Verifizierer-Grenze / Ablehnungs-Gates / Urteil / Beweis-Ledger. Löst bei Forschungsüberprüfungen, Evaluierungsdesigns, Benchmark- oder Kausalitätsbehauptungen und Fragen zur Evidenzsicherheit aus und erzwingt eine PROVEN/SUPPORTED/REJECTED/OPEN-Kennzeichnung anstelle von unqualifizierter Zuversicht.

Testbericht

Habe eine echte Produktionslatenz-Behauptung durch beide Pfade laufen lassen: Die Skill-Version zwang eine unabhängige Evaluatorprüfung und ein Randomisierungs-Ablehnungs-Gate, das die freie Baseline nie auslöste, und stufte dann das Urteil korrekt von einem informellen 'stark unterstützt' auf das disziplinierte SUPPORTED-Label herab.

Getestet am: 2026-07-14 · Claude Code 2.x (agent harness)

Installation

git clone https://github.com/tonyblu331/research-proof.git
cd research-proof
mkdir -p ~/.claude/skills
cp -r skills/research-proof ~/.claude/skills/research-proof

Befehle & Beispiel-Prompts

  • /research-proofZwingt Forschungs- und Benchmark-Behauptungen durch eine gefrorene Verifizierer-Beweisleiter anstelle von zuversichtlicher Prosa.

Skills reagieren auf normale Anfragen — keine Slash-Befehle nötig. Nach der Installation aktivieren Prompts wie diese den Skill (auf Englisch):

  • Prove this latency benchmark claim before I publish it
  • My research says X is faster — verify that properly
  • Check whether this experiment actually supports its claim