Literature Review Agent

Überprüft Paper-Zitate, markiert halluzinierte, erstellt BibTeX, entwirft verwandte Arbeiten

von Ar9av · Ar9av/PaperOrchestra

Getestet · Funktioniert ★ 8.4/10

Literature Review Agent — Überprüft Paper-Zitate, markiert halluzinierte, erstellt BibTeX, entwirft verwandte Arbeiten

Was es kann

Führt die Zitationsphase einer wissenschaftlichen Paper-Pipeline aus: entdeckt Kandidaten-Paper über Websuche, verifiziert jedes über Semantic Scholar (unscharfe Titelübereinstimmung, zeitlicher Cutoff, dedup), gleicht mit Crossref und OpenAlex ab, um halluzinierte Referenzen zu kennzeichnen, erstellt eine BibTeX-Datei mit deterministischen Schlüsseln und entwirft die Abschnitte Einleitung und Verwandte Arbeiten. Wird ausgelöst, wenn darum gebeten wird, Zitate für ein Paper zu finden, die verwandten Arbeiten zu entwerfen oder eine verifizierte Bibliografie zu erstellen.

Testbericht

Das Repo geklont; alle 14 Skripte und jede stichprobenartig überprüfte Referenzdatei (bibtex_format.py, levenshtein_match.py, dedupe_by_id.py, references/prompt.md) liefern HTTP 200. bibtex_format.py auf einem manuell erstellten 3-Paper-Pool ausgeführt: Es wurden deterministische, Stopword-bewusste Schlüssel (vaswani2017attention, zhao2023survey, he2016deep) ausgegeben, eprint/doi nur bei Vorhandensein geschrieben und bibtex_key zurück in citation_pool.json geschrieben – die manuell erstellte Bib der Baseline hätte Ad-hoc-Schlüssel verwendet und den Pool nie gefüllt, was das nachgelagerte Coverage-Gate gebrochen hätte. check_cutoff.py und citation_coverage.py verhielten sich wie spezifiziert (Coverage-Gates bei einer floor(0.9*N)-Anzahl, also 2/3 'bestanden' bei Anzahl 2 – etwas lockerer als die Formulierung '≥90% of pool' der Fähigkeit). levenshtein_match.py schlägt mit einem klaren 'pip install python-Levenshtein'-Fehler fehl, bis diese undokumentierte Abhängigkeit installiert ist, wonach es 100 PASS / 31 FAIL korrekt zurückgab. Web-Discovery + Live-Verifizierung von Semantic Scholar/Crossref/OpenAlex wurden nicht ausgeführt (benötigt Host-Websuche + Netzwerk), daher spiegelt der Ausgabescore nur den deterministischen BibTeX/Coverage-Slice wider. Keine Sicherheitsbedenken: Schlüssel aus Umgebung gelesen, kein curl|sh, keine Exfiltration.

Getestet am: 2026-07-21 · Claude Code 2.x (agent harness)

Installation

git clone --depth 1 https://github.com/Ar9av/PaperOrchestra.git /tmp/literature-review-agent-src
mkdir -p ~/.claude/skills
cp -R /tmp/literature-review-agent-src/skills/literature-review-agent ~/.claude/skills/literature-review-agent
# Undocumented runtime dep: scripts/levenshtein_match.py needs python-Levenshtein
pip install python-Levenshtein
# Optional deps used only if you enable those backends / cross-index checks:
#   requests            (s2_search.py, crossref_client.py, openalex_client.py, exa_search.py)
# Optional API keys (all read from env, none committed):
#   SEMANTIC_SCHOLAR_API_KEY  — higher S2 rate limit (public endpoint works without it)
#   EXA_API_KEY               — optional Exa web-search backend for Phase 1
#   PAPER_ORCHESTRA_MAILTO    — polite-pool email for Crossref/OpenAlex
# Designed as Step 3 of the PaperOrchestra pipeline; needs a workspace/outline.json + host web search for the full run.

Befehle & Beispiel-Prompts

  • /literature-review-agentÜberprüft Paper-Zitate, markiert halluzinierte, erstellt BibTeX, entwirft verwandte Arbeiten

Skills reagieren auf normale Anfragen — keine Slash-Befehle nötig. Nach der Installation aktivieren Prompts wie diese den Skill (auf Englisch):

  • Find citations for my paper's related work section
  • Draft the related work from this outline.json
  • Verify these citations against Semantic Scholar