Adversarial Claims Reviewer

Revisión de árbitro hostil de artículos/documentos técnicos que recalcula cada ecuación y número con scripts reales.

Por LazyIsEfficient · LazyIsEfficient/agentic-os

Funciona con configuración ★ 9.6/10

Adversarial Claims Reviewer — Revisión de árbitro hostil de artículos/documentos técnicos que recalcula cada ecuación y número con scripts reales.

Qué hace

Inventaría cada ecuación y afirmación cuantitativa en un documento técnico, verificando cada una exactamente como se nombra (nunca una paráfrasis) con scripts deterministas (SymPy/numpy), y clasifica VERIFICADO/REFUTADO/NO VERIFICABLE/VACUO. Se activa ante solicitudes de verificar un artículo, validar afirmaciones o auditar una derivación/benchmark; declina explícitamente la revisión del código fuente, la postura de seguridad y la puntuación de calidad de la prosa, que pertenecen a habilidades hermanas.

Informe de la prueba

Plantó dos afirmaciones falsas en un mini-artículo desechable (una derivada de seno/coseno intercambiada y un titular de mejora relativa del 40% que SymPy/aritmética en realidad situó en 23.1%) — una pasada de revisión genérica elogió ambas como sólidas, el protocolo real de INVENTARIO-a-INFORME de la habilidad capturó ambas con scripts ejecutados y reproducibles y correctamente dejó la única afirmación verdadera en paz. Su propia sección 'Disciplina de Niveles' requiere .claude/rules/review-tiers.md y ../findings-ledger/SKILL.md, ambos hermanos fuera de la carpeta de la habilidad que un simple git-clone-and-cp solo de este directorio no traerá.

Probado el: 2026-07-15 · Claude Code 2.x (agent harness)

Instalación

git clone https://github.com/LazyIsEfficient/agentic-os
mkdir -p ~/.claude/skills
cp -r agentic-os/.claude/skills/adversarial-claims-reviewer ~/.claude/skills/adversarial-claims-reviewer

Comandos y prompts de ejemplo

  • /adversarial-claims-reviewerRevisión de árbitro hostil de artículos/documentos técnicos que recalcula cada ecuación y número con scripts reales.

Los skills se activan con peticiones en lenguaje natural, sin comandos que memorizar. Tras instalarlo, prompts como estos lo activan (en inglés):

  • Can you check if the math in this paper's derivation is correct?
  • Verify these benchmark numbers in my whitepaper actually add up.
  • Recompute the equations in this draft and flag anything wrong.