PDF to Markdown

Ekstraherer en hel PDF til ren, strukturert Markdown med ekte overskrifter, tabeller og bilder.

av aliceisjustplaying · aliceisjustplaying/claude-skill-pdf-to-markdown

Bestått ★ 9.6/10

PDF to Markdown — Ekstraherer en hel PDF til ren, strukturert Markdown med ekte overskrifter, tabeller og bilder.

Hva den gjør

En CLI-støttet skill som konverterer en hel PDF til Markdown ved hjelp av PyMuPDF/pymupdf4llm (eller Docling for tabeller med høy nøyaktighet), bevarer overskrifter, fet/kursiv skrift, flerkolonne leserekkefølge, tabeller og ekstraherte bilder, med aggressiv innholdshash-mellomlagring. Den utløses når en bruker ønsker 'whole PDF' eller 'entire document' lastet inn i kontekst i stedet for en grep/søk eller side-for-side tilnærming.

Testrapport

Kjørte det medfølgende pymupdf4llm-skriptet på en test-PDF med en tabell, fet/kursiv tekst og en punktliste: den produserte ekte markdown-overskrifter, en piped-tabell og bevarte fet/kursiv formatering, mens testrammeverkets egen standard PDF-lesing falt tilbake til en udifferensiert blokk med ren tekst uten strukturmarkører.

Testet på: 2026-07-14 · Claude Code 2.x (agent harness)

Installer

git clone https://github.com/aliceisjustplaying/claude-skill-pdf-to-markdown
cd claude-skill-pdf-to-markdown
mkdir -p ~/.claude/skills
cp -r . ~/.claude/skills/pdf-to-markdown

Kommandoer og eksempelprompter

  • /pdf-to-markdownEkstraherer en hel PDF til ren, strukturert Markdown med ekte overskrifter, tabeller og bilder.

Skills utløses av vanlige forespørsler — ingen kommandoer å huske. Etter installasjonen aktiverer prompter som disse skillen (på engelsk):

  • Load this entire PDF into context, not just search it
  • Convert this whole PDF report into clean markdown with tables
  • Extract all the text and tables from this PDF, preserve formatting