Adversarial Claims Reviewer

Adwersaryjna recenzja artykułów/whitepaperów, która przelicza każde równanie i liczbę za pomocą rzeczywistych skryptów.

Autor: LazyIsEfficient · LazyIsEfficient/agentic-os

Działa po konfiguracji ★ 9.6/10

Adversarial Claims Reviewer — Adwersaryjna recenzja artykułów/whitepaperów, która przelicza każde równanie i liczbę za pomocą rzeczywistych skryptów.

Co robi ten skill

Inwentaryzuje każde równanie i ilościowe twierdzenie w dokumencie technicznym, weryfikuje każde dokładnie tak, jak jest nazwane (nigdy parafraza), za pomocą deterministycznych skryptów (SymPy/numpy) i klasyfikuje ZWERYFIKOWANE/OBALONE/NIEWERYFIKOWALNE/POZORNE. Aktywuje się przy żądaniach sprawdzenia artykułu, weryfikacji twierdzeń lub audytu wyprowadzenia/benchmarku; jawnie odrzuca recenzję kodu źródłowego, postawy bezpieczeństwa i ocenę jakości prozy, które należą do umiejętności siostrzanych.

Raport z testu

Umieściłem dwa fałszywe twierdzenia w tymczasowym mini-artykule (zamienione pochodne sin/cos i nagłówek 40% poprawy względnej, który SymPy/arytmetyka faktycznie umieściła na 23,1%) — ogólna analiza pochwaliła oba jako poprawne, rzeczywisty protokół INWENTARYZACJA-DO-RAPORTU umiejętności wykrył oba za pomocą wykonanych, powtarzalnych skryptów i poprawnie zostawił jedno prawdziwe twierdzenie w spokoju. Jego własna 'dyscyplina warstw' wymaga .claude/rules/review-tiers.md i ../findings-ledger/SKILL.md, oba siostrzane poza folderem umiejętności, których zwykłe `git clone` i `cp` tylko tego katalogu nie przyniosą.

Testowano: 2026-07-15 · Claude Code 2.x (agent harness)

Instalacja

git clone https://github.com/LazyIsEfficient/agentic-os
mkdir -p ~/.claude/skills
cp -r agentic-os/.claude/skills/adversarial-claims-reviewer ~/.claude/skills/adversarial-claims-reviewer

Komendy i przykładowe prompty

  • /adversarial-claims-reviewerAdwersaryjna recenzja artykułów/whitepaperów, która przelicza każde równanie i liczbę za pomocą rzeczywistych skryptów.

Skille uruchamiają się na zwykłe polecenia — bez komend do zapamiętania. Po instalacji aktywują go prompty takie jak te (po angielsku):

  • Can you check if the math in this paper's derivation is correct?
  • Verify these benchmark numbers in my whitepaper actually add up.
  • Recompute the equations in this draft and flag anything wrong.