PDF to Markdown

Extrahiert ein ganzes PDF in sauberes, strukturiertes Markdown mit echten Überschriften, Tabellen und Bildern.

von aliceisjustplaying · aliceisjustplaying/claude-skill-pdf-to-markdown

Getestet · Funktioniert ★ 9.6/10

PDF to Markdown — Extrahiert ein ganzes PDF in sauberes, strukturiertes Markdown mit echten Überschriften, Tabellen und Bildern.

Was es kann

Ein CLI-gestützter Skill, der ein gesamtes PDF mithilfe von PyMuPDF/pymupdf4llm (oder Docling für hochpräzise Tabellen) in Markdown konvertiert, wobei Überschriften, Fett-/Kursivschrift, mehrspaltige Lesereihenfolge, Tabellen und extrahierte Bilder erhalten bleiben, mit aggressivem Content-Hash-Caching. Er wird ausgelöst, wenn ein Benutzer das 'ganze PDF' oder 'gesamte Dokument' in den Kontext geladen haben möchte, anstatt eines grep/search- oder seitenweisen Ansatzes.

Testbericht

Habe das gebündelte pymupdf4llm-Skript auf einem Test-PDF mit einer Tabelle, fett/kursiv formatiertem Text und einer Aufzählungsliste ausgeführt: Es erzeugte echte Markdown-Überschriften, eine gepipte Tabelle und behielt die Fett-/Kursivformatierung bei, während die Standard-PDF-Lesefunktion des Harness auf einen undifferenzierten Block reinen Textes ohne Strukturmarker zurückfiel.

Getestet am: 2026-07-14 · Claude Code 2.x (agent harness)

Installation

git clone https://github.com/aliceisjustplaying/claude-skill-pdf-to-markdown
cd claude-skill-pdf-to-markdown
mkdir -p ~/.claude/skills
cp -r . ~/.claude/skills/pdf-to-markdown

Befehle & Beispiel-Prompts

  • /pdf-to-markdownExtrahiert ein ganzes PDF in sauberes, strukturiertes Markdown mit echten Überschriften, Tabellen und Bildern.

Skills reagieren auf normale Anfragen — keine Slash-Befehle nötig. Nach der Installation aktivieren Prompts wie diese den Skill (auf Englisch):

  • Load this entire PDF into context, not just search it
  • Convert this whole PDF report into clean markdown with tables
  • Extract all the text and tables from this PDF, preserve formatting