Multi-Model Adversarial Review

Kjører claude/codex/gemini som uavhengige anmeldere, lar dem krysse-kritikkere, deretter syntetiserer én deduplisert rapport

av prime-radiant-inc · prime-radiant-inc/parallel-adversarial-review

Krever oppsett ★ 8.0/10

Multi-Model Adversarial Review — Kjører claude/codex/gemini som uavhengige anmeldere, lar dem krysse-kritikkere, deretter syntetiserer én deduplisert rapport

Hva den gjør

En tre-trinns driver (parallell gjennomgang, NxN-1 kryss-kritikk, syntese) som skreller ut til hvilke kodingsagent CLI-er du har installert, slipper funn en kritiker beviser er fabrikkert, og eskalerer alvorlighetsgrad ved uenighet. Utløses på 'MMAR review', 'multi-model review', 'cross-model adversarial', eller 'review with all the models' for høy-innsats diffs; prosjektets egen veiledning sier å bruke dens billigere søster-skill for rutinemessig gjennomgang.

Testrapport

SKILL.md-kroppen kaller ${CLAUDE_PLUGIN_ROOT}/scripts/mmar.py, en 645-linjers driver som ligger ved repo-roten, ikke inne i skill-mappen -- en bar kopi 404-er i ekte GitHub rå-hentinger og feiler 'No such file or directory' når den faktisk kjøres; men å kjøre den ekte driveren i prosjektets egen mock-modus mot dens bundne fixturer fungerte perfekt (4/4 eval-fixturer bestått, og den fanget og droppet korrekt et fabrikkert Gemini-funn som to andre anmeldere flagget som fiksjon) -- så mekanismen i seg selv er genuint god, den trenger bare hele repo/plugin, ikke bare skill-undermappen.

Testet på: 2026-07-15 · Claude Code 2.x (agent harness)

Installer

git clone https://github.com/prime-radiant-inc/parallel-adversarial-review
cd parallel-adversarial-review
mkdir -p ~/.claude/skills
cp -r skills/multi-model-adversarial-review ~/.claude/skills/multi-model-adversarial-review

Kommandoer og eksempelprompter

  • /multi-model-adversarial-reviewKjører claude/codex/gemini som uavhengige anmeldere, lar dem krysse-kritikkere, deretter syntetiserer én deduplisert rapport

Skills utløses av vanlige forespørsler — ingen kommandoer å huske. Etter installasjonen aktiverer prompter som disse skillen (på engelsk):

  • Run a full cross-model review on this PR before we merge to main
  • This diff is security-critical, get several models to cross-check each other
  • One reviewer isn't enough here, have Claude, Codex, and Gemini all weigh in