PDF to Markdown
Extrahiert ein ganzes PDF in sauberes, strukturiertes Markdown mit echten Überschriften, Tabellen und Bildern.
Getestet · Funktioniert
Was es kann
Ein CLI-gestützter Skill, der ein gesamtes PDF mithilfe von PyMuPDF/pymupdf4llm (oder Docling für hochpräzise Tabellen) in Markdown konvertiert, wobei Überschriften, Fett-/Kursivschrift, mehrspaltige Lesereihenfolge, Tabellen und extrahierte Bilder erhalten bleiben, mit aggressivem Content-Hash-Caching. Er wird ausgelöst, wenn ein Benutzer das 'ganze PDF' oder 'gesamte Dokument' in den Kontext geladen haben möchte, anstatt eines grep/search- oder seitenweisen Ansatzes.
Testbericht
Habe das gebündelte pymupdf4llm-Skript auf einem Test-PDF mit einer Tabelle, fett/kursiv formatiertem Text und einer Aufzählungsliste ausgeführt: Es erzeugte echte Markdown-Überschriften, eine gepipte Tabelle und behielt die Fett-/Kursivformatierung bei, während die Standard-PDF-Lesefunktion des Harness auf einen undifferenzierten Block reinen Textes ohne Strukturmarker zurückfiel.
Getestet am: 2026-07-14 · Claude Code 2.x (agent harness)
Installation
git clone https://github.com/aliceisjustplaying/claude-skill-pdf-to-markdown cd claude-skill-pdf-to-markdown mkdir -p ~/.claude/skills cp -r . ~/.claude/skills/pdf-to-markdown
Befehle & Beispiel-Prompts
/pdf-to-markdownExtrahiert ein ganzes PDF in sauberes, strukturiertes Markdown mit echten Überschriften, Tabellen und Bildern.
Skills reagieren auf normale Anfragen — keine Slash-Befehle nötig. Nach der Installation aktivieren Prompts wie diese den Skill (auf Englisch):
Load this entire PDF into context, not just search itConvert this whole PDF report into clean markdown with tablesExtract all the text and tables from this PDF, preserve formatting