Research Proof
Dwingt onderzoeks- en benchmarkclaims door een bevroren-verifier bewijs ladder in plaats van zelfverzekerde proza.
Getest · Werkt
Wat het doet
Zet een vage onderzoeks-, benchmark-, of causale claim om in een gestructureerd bewijs programma met vaste koppen Claim / Verifier Boundary / Rejection Gates / Verdict / Proof Ledger. Triggers op onderzoeksreviews, eval design, benchmark of causale claims, en bewijs-zekerheid vragen, en dwingt PROVEN/SUPPORTED/REJECTED/OPEN labeling af in plaats van ongekwalificeerde zekerheid.
Testrapport
Een echte productie-latentie claim door beide paden uitgevoerd: de skill-versie dwong een onafhankelijke evaluator check en een randomisatie afwijzingspoort af die de freeform baseline nooit opwierp, degradeerde vervolgens correct de verdict van een informeel 'sterk ondersteund' naar het gedisciplineerde SUPPORTED label.
Getest op: 2026-07-14 · Claude Code 2.x (agent harness)
Installatie
git clone https://github.com/tonyblu331/research-proof.git cd research-proof mkdir -p ~/.claude/skills cp -r skills/research-proof ~/.claude/skills/research-proof
Commando's en voorbeeldprompts
/research-proofDwingt onderzoeks- en benchmarkclaims door een bevroren-verifier bewijs ladder in plaats van zelfverzekerde proza.
Skills reageren op gewone verzoeken — geen commando's om te onthouden. Na installatie activeren prompts zoals deze de skill (in het Engels):
Prove this latency benchmark claim before I publish itMy research says X is faster — verify that properlyCheck whether this experiment actually supports its claim