Multi-Model Adversarial Review

Kör claude/codex/gemini som oberoende granskare, låt dem korsgranska, syntetisera sedan en dedupad rapport

av prime-radiant-inc · prime-radiant-inc/parallel-adversarial-review

Fungerar med konfiguration ★ 8.0/10

Multi-Model Adversarial Review — Kör claude/codex/gemini som oberoende granskare, låt dem korsgranska, syntetisera sedan en dedupad rapport

Vad den gör

En tre-stegs drivrutin (parallell granskning, NxN-1 korsgranskning, syntes) som anropar de kodningsagent CLIs du har installerade, släpper fynd som en kritiker bevisar är fabricerade, och eskalerar allvarlighetsgrad vid oenighet. Triggers på 'MMAR review', 'multi-model review', 'cross-model adversarial', eller 'review with all the models' för hög-insats diffar; projektets egen vägledning säger att använda dess billigare syskon-skill för rutinmässig granskning.

Testrapport

SKILL.md-kroppen anropar ${CLAUDE_PLUGIN_ROOT}/scripts/mmar.py, en 645-raders drivrutin som ligger vid repo-roten, inte inuti skill-mappen -- en bar kopia 404:ar i riktiga GitHub rå-hämtningar och felar 'No such file or directory' när den faktiskt körs; men att köra den riktiga drivrutinen i projektets egen mock-läge mot dess bundlade fixtures fungerade perfekt (4/4 eval-fixtures passerade, och den fångade korrekt och släppte ett fabricerat Gemini-fynd som två andra granskare flaggade som fiktion) -- så mekanismen i sig är genuint bra, den behöver bara hela repo/plugin, inte bara skill-undermappen ensam.

Testad: 2026-07-15 · Claude Code 2.x (agent harness)

Installation

git clone https://github.com/prime-radiant-inc/parallel-adversarial-review
cd parallel-adversarial-review
mkdir -p ~/.claude/skills
cp -r skills/multi-model-adversarial-review ~/.claude/skills/multi-model-adversarial-review

Kommandon och exempelprompter

  • /multi-model-adversarial-reviewKör claude/codex/gemini som oberoende granskare, låt dem korsgranska, syntetisera sedan en dedupad rapport

Skills triggas av vanliga förfrågningar — inga kommandon att memorera. Efter installationen aktiverar prompter som dessa skillen (på engelska):

  • Run a full cross-model review on this PR before we merge to main
  • This diff is security-critical, get several models to cross-check each other
  • One reviewer isn't enough here, have Claude, Codex, and Gemini all weigh in