PDF to Markdown

Extraheert een hele PDF naar schone, gestructureerde Markdown met echte headers, tabellen en afbeeldingen.

Door aliceisjustplaying · aliceisjustplaying/claude-skill-pdf-to-markdown

Getest · Werkt ★ 9.6/10

PDF to Markdown — Extraheert een hele PDF naar schone, gestructureerde Markdown met echte headers, tabellen en afbeeldingen.

Wat het doet

Een CLI-gesteunde skill die een hele PDF converteert naar Markdown met behulp van PyMuPDF/pymupdf4llm (of Docling voor zeer nauwkeurige tabellen), waarbij headers, bold/italic, multi-column leesvolgorde, tabellen en geëxtraheerde afbeeldingen behouden blijven, met agressieve content-hash caching. Het activeert wanneer een gebruiker de 'whole PDF' of 'entire document' in context wil laden in plaats van een grep/search of pagina-voor-pagina benadering.

Testrapport

Voerde het gebundelde pymupdf4llm script uit op een test-PDF met een tabel, bold/italic tekst en een opsomming: het produceerde echte markdown headers, een piped table, en behield bold/italic opmaak, terwijl de standaard PDF-read van de harness terugviel op één ongedifferentieerd blok platte tekst zonder structuurmarkeringen.

Getest op: 2026-07-14 · Claude Code 2.x (agent harness)

Installatie

git clone https://github.com/aliceisjustplaying/claude-skill-pdf-to-markdown
cd claude-skill-pdf-to-markdown
mkdir -p ~/.claude/skills
cp -r . ~/.claude/skills/pdf-to-markdown

Commando's en voorbeeldprompts

  • /pdf-to-markdownExtraheert een hele PDF naar schone, gestructureerde Markdown met echte headers, tabellen en afbeeldingen.

Skills reageren op gewone verzoeken — geen commando's om te onthouden. Na installatie activeren prompts zoals deze de skill (in het Engels):

  • Load this entire PDF into context, not just search it
  • Convert this whole PDF report into clean markdown with tables
  • Extract all the text and tables from this PDF, preserve formatting