PDF to Markdown
Extraheert een hele PDF naar schone, gestructureerde Markdown met echte headers, tabellen en afbeeldingen.
Getest · Werkt
Wat het doet
Een CLI-gesteunde skill die een hele PDF converteert naar Markdown met behulp van PyMuPDF/pymupdf4llm (of Docling voor zeer nauwkeurige tabellen), waarbij headers, bold/italic, multi-column leesvolgorde, tabellen en geëxtraheerde afbeeldingen behouden blijven, met agressieve content-hash caching. Het activeert wanneer een gebruiker de 'whole PDF' of 'entire document' in context wil laden in plaats van een grep/search of pagina-voor-pagina benadering.
Testrapport
Voerde het gebundelde pymupdf4llm script uit op een test-PDF met een tabel, bold/italic tekst en een opsomming: het produceerde echte markdown headers, een piped table, en behield bold/italic opmaak, terwijl de standaard PDF-read van de harness terugviel op één ongedifferentieerd blok platte tekst zonder structuurmarkeringen.
Getest op: 2026-07-14 · Claude Code 2.x (agent harness)
Installatie
git clone https://github.com/aliceisjustplaying/claude-skill-pdf-to-markdown cd claude-skill-pdf-to-markdown mkdir -p ~/.claude/skills cp -r . ~/.claude/skills/pdf-to-markdown
Commando's en voorbeeldprompts
/pdf-to-markdownExtraheert een hele PDF naar schone, gestructureerde Markdown met echte headers, tabellen en afbeeldingen.
Skills reageren op gewone verzoeken — geen commando's om te onthouden. Na installatie activeren prompts zoals deze de skill (in het Engels):
Load this entire PDF into context, not just search itConvert this whole PDF report into clean markdown with tablesExtract all the text and tables from this PDF, preserve formatting