Adversarial Claims Reviewer
Nepřátelská recenze článků/whitepaperů, která přepočítá každý vzorec a číslo pomocí skutečných skriptů.
Funguje s nastavením
Co umí
Inventarizuje každý vzorec a kvantitativní tvrzení v technickém dokumentu, ověřuje každé přesně podle názvu (nikdy parafráze) deterministickými skripty (SymPy/numpy) a klasifikuje OVĚŘENO/VYVRÁCENO/NEOVĚŘITELNÉ/PRÁZDNÉ. Spouští se na požadavky na kontrolu článku, ověření tvrzení nebo audit odvození/benchmarku; explicitně odmítá revizi zdrojového kódu, bezpečnostní postoj a hodnocení kvality prózy, které patří sesterským dovednostem.
Testovací report
Do dočasného mini-článku vložil dva falešné nároky (zaměněná derivace sin/cos a nadpis o 40% relativním zlepšení, který SymPy/aritmetika skutečně umístila na 23,1 %) — obecný revizní průchod oba pochválil jako platné, skutečný protokol INVENTORY-to-REPORT dovednosti oba zachytil pomocí provedených, reprodukovatelných skriptů a jeden skutečný nárok správně nechal být. Jeho vlastní sekce 'Tier discipline' vyžaduje .claude/rules/review-tiers.md a ../findings-ledger/SKILL.md, obojí sesterské soubory mimo složku dovednosti, které prosté `git clone` a `cp` pouze této složky nepřinesou.
Testováno: 2026-07-15 · Claude Code 2.x (agent harness)
Instalace
git clone https://github.com/LazyIsEfficient/agentic-os mkdir -p ~/.claude/skills cp -r agentic-os/.claude/skills/adversarial-claims-reviewer ~/.claude/skills/adversarial-claims-reviewer
Příkazy a ukázkové prompty
/adversarial-claims-reviewerNepřátelská recenze článků/whitepaperů, která přepočítá každý vzorec a číslo pomocí skutečných skriptů.
Skilly se spouštějí běžnými požadavky — žádné příkazy k zapamatování. Po instalaci ho aktivují prompty jako tyto (anglicky):
Can you check if the math in this paper's derivation is correct?Verify these benchmark numbers in my whitepaper actually add up.Recompute the equations in this draft and flag anything wrong.