Literature Review Agent

Verifieert papiercitaten, markeert gehallucineerde, bouwt BibTeX, stelt gerelateerd werk op

Door Ar9av · Ar9av/PaperOrchestra

Getest · Werkt ★ 8.4/10

Literature Review Agent — Verifieert papiercitaten, markeert gehallucineerde, bouwt BibTeX, stelt gerelateerd werk op

Wat het doet

Voert de citatiefase van een academische-papierpijplijn uit: ontdekt kandidaat-papers via webzoekopdracht, verifieert elk via Semantic Scholar (fuzzy titelmatch, temporele cutoff, dedup), kruiscontroleert met Crossref en OpenAlex om gehallucineerde referenties te markeren, bouwt een BibTeX-bestand met deterministische sleutels en stelt de Introduction- en Related Work-secties op. Activeert wanneer gevraagd wordt om citaten voor een paper te vinden, het gerelateerde werk op te stellen of een geverifieerde bibliografie te bouwen.

Testrapport

De repo gekloond; alle 14 scripts en elk steekproefsgewijs gecontroleerd referentiebestand (bibtex_format.py, levenshtein_match.py, dedupe_by_id.py, references/prompt.md) retourneren HTTP 200. bibtex_format.py uitgevoerd op een handmatig gebouwde pool van 3 papers: het gaf deterministische stopwoord-bewuste sleutels (vaswani2017attention, zhao2023survey, he2016deep) uit, schreef eprint/doi alleen wanneer aanwezig, en schreef bibtex_key terug in citation_pool.json — de handgeschreven bib van de basislijn zou ad-hoc sleutels gebruiken en de pool nooit vullen, waardoor de downstream coverage gate zou breken. check_cutoff.py en citation_coverage.py gedroegen zich zoals gespecificeerd (coverage gates op een floor(0.9*N) telling, dus 2/3 'geslaagd' bij telling 2 — iets losser dan de '≥90% van de pool' formulering van de SKILL). levenshtein_match.py faalt met een duidelijke 'pip install python-Levenshtein' fout totdat die ongedocumenteerde afhankelijkheid is geïnstalleerd, waarna het 100 PASS / 31 FAIL correct retourneerde. Web-discovery + live Semantic Scholar/Crossref/OpenAlex verificatie werden niet geoefend (vereist host webzoekopdracht + netwerk), dus de outputscore weerspiegelt alleen de deterministische BibTeX/coverage slice. Geen beveiligingsrisico's: sleutels gelezen uit env, geen curl|sh, geen exfiltratie.

Getest op: 2026-07-21 · Claude Code 2.x (agent harness)

Installatie

git clone --depth 1 https://github.com/Ar9av/PaperOrchestra.git /tmp/literature-review-agent-src
mkdir -p ~/.claude/skills
cp -R /tmp/literature-review-agent-src/skills/literature-review-agent ~/.claude/skills/literature-review-agent
# Undocumented runtime dep: scripts/levenshtein_match.py needs python-Levenshtein
pip install python-Levenshtein
# Optional deps used only if you enable those backends / cross-index checks:
#   requests            (s2_search.py, crossref_client.py, openalex_client.py, exa_search.py)
# Optional API keys (all read from env, none committed):
#   SEMANTIC_SCHOLAR_API_KEY  — higher S2 rate limit (public endpoint works without it)
#   EXA_API_KEY               — optional Exa web-search backend for Phase 1
#   PAPER_ORCHESTRA_MAILTO    — polite-pool email for Crossref/OpenAlex
# Designed as Step 3 of the PaperOrchestra pipeline; needs a workspace/outline.json + host web search for the full run.

Commando's en voorbeeldprompts

  • /literature-review-agentVerifieert papiercitaten, markeert gehallucineerde, bouwt BibTeX, stelt gerelateerd werk op

Skills reageren op gewone verzoeken — geen commando's om te onthouden. Na installatie activeren prompts zoals deze de skill (in het Engels):

  • Find citations for my paper's related work section
  • Draft the related work from this outline.json
  • Verify these citations against Semantic Scholar