PDF to Markdown

Udpakker en hel PDF til ren, struktureret Markdown med ægte overskrifter, tabeller og billeder.

Af aliceisjustplaying · aliceisjustplaying/claude-skill-pdf-to-markdown

Testet · Virker ★ 9.6/10

PDF to Markdown — Udpakker en hel PDF til ren, struktureret Markdown med ægte overskrifter, tabeller og billeder.

Hvad det gør

En CLI-understøttet skill, der konverterer en hel PDF til Markdown ved hjælp af PyMuPDF/pymupdf4llm (eller Docling for tabeller med høj nøjagtighed), bevarer overskrifter, fed/kursiv, læserækkefølge i flere kolonner, tabeller og udpakkede billeder, med aggressiv content-hash caching. Den udløses, når en bruger ønsker 'hele PDF'en' eller 'hele dokumentet' indlæst i kontekst i stedet for en grep/søgning eller side-for-side tilgang.

Testrapport

Kørte det medfølgende pymupdf4llm script på en test-PDF med en tabel, fed/kursiv tekst og en punktopstilling: det producerede ægte markdown-overskrifter, en piped tabel og bevarede fed/kursiv formatering, mens harness'ens egen standard PDF-læsning faldt tilbage til en udifferentieret blok af almindelig tekst uden strukturmarkører.

Testet: 2026-07-14 · Claude Code 2.x (agent harness)

Installation

git clone https://github.com/aliceisjustplaying/claude-skill-pdf-to-markdown
cd claude-skill-pdf-to-markdown
mkdir -p ~/.claude/skills
cp -r . ~/.claude/skills/pdf-to-markdown

Kommandoer og eksempelprompter

  • /pdf-to-markdownUdpakker en hel PDF til ren, struktureret Markdown med ægte overskrifter, tabeller og billeder.

Skills udløses af almindelige forespørgsler — ingen kommandoer at huske. Efter installationen aktiverer prompter som disse skillen (på engelsk):

  • Load this entire PDF into context, not just search it
  • Convert this whole PDF report into clean markdown with tables
  • Extract all the text and tables from this PDF, preserve formatting