PDF to Markdown

Extraherar en hel PDF till ren, strukturerad Markdown med riktiga rubriker, tabeller och bilder.

av aliceisjustplaying · aliceisjustplaying/claude-skill-pdf-to-markdown

Testad · Fungerar ★ 9.6/10

PDF to Markdown — Extraherar en hel PDF till ren, strukturerad Markdown med riktiga rubriker, tabeller och bilder.

Vad den gör

En CLI-stödd skill som konverterar en hel PDF till Markdown med PyMuPDF/pymupdf4llm (eller Docling för tabeller med hög noggrannhet), bevarar rubriker, fet/kursiv stil, flerkolumns läsordning, tabeller och extraherade bilder, med aggressiv innehålls-hash-caching. Den utlöses när en användare vill ha 'whole PDF' eller 'entire document' laddad i kontexten istället för en grep/sökning eller sida-för-sida-metod.

Testrapport

Körde det medföljande pymupdf4llm-skriptet på en test-PDF med en tabell, fet/kursiv text och en punktlista: den producerade riktiga markdown-rubriker, en piped-tabell och bevarade fet/kursiv formatering, medan selens egen standard-PDF-läsning föll tillbaka till ett odifferentierat block av vanlig text utan strukturmarkörer.

Testad: 2026-07-14 · Claude Code 2.x (agent harness)

Installation

git clone https://github.com/aliceisjustplaying/claude-skill-pdf-to-markdown
cd claude-skill-pdf-to-markdown
mkdir -p ~/.claude/skills
cp -r . ~/.claude/skills/pdf-to-markdown

Kommandon och exempelprompter

  • /pdf-to-markdownExtraherar en hel PDF till ren, strukturerad Markdown med riktiga rubriker, tabeller och bilder.

Skills triggas av vanliga förfrågningar — inga kommandon att memorera. Efter installationen aktiverar prompter som dessa skillen (på engelska):

  • Load this entire PDF into context, not just search it
  • Convert this whole PDF report into clean markdown with tables
  • Extract all the text and tables from this PDF, preserve formatting