PDF to Markdown

Extrahování celého PDF do čistého, strukturovaného Markdownu se skutečnými záhlavími, tabulkami a obrázky.

od aliceisjustplaying · aliceisjustplaying/claude-skill-pdf-to-markdown

Otestováno · Funguje ★ 9.6/10

PDF to Markdown — Extrahování celého PDF do čistého, strukturovaného Markdownu se skutečnými záhlavími, tabulkami a obrázky.

Co umí

Dovednost podporovaná CLI, která převádí celé PDF do Markdownu pomocí PyMuPDF/pymupdf4llm (nebo Docling pro vysoce přesné tabulky), zachovává záhlaví, tučné/kurzivní písmo, pořadí čtení ve více sloupcích, tabulky a extrahované obrázky, s agresivním cachováním hashů obsahu. Spouští se, když uživatel chce načíst 'whole PDF' nebo 'entire document' do kontextu namísto přístupu grep/search nebo stránku po stránce.

Testovací report

Spustil jsem přibalený skript pymupdf4llm na testovacím PDF s tabulkou, tučným/kurzivním textem a odrážkovým seznamem: vytvořil skutečné markdown záhlaví, tabulku s oddělovači a zachoval tučné/kurzivní formátování, zatímco výchozí čtení PDF samotného harnessu se vrátilo k jednomu nerozlišenému bloku prostého textu s nulovými strukturními značkami.

Testováno: 2026-07-14 · Claude Code 2.x (agent harness)

Instalace

git clone https://github.com/aliceisjustplaying/claude-skill-pdf-to-markdown
cd claude-skill-pdf-to-markdown
mkdir -p ~/.claude/skills
cp -r . ~/.claude/skills/pdf-to-markdown

Příkazy a ukázkové prompty

  • /pdf-to-markdownExtrahování celého PDF do čistého, strukturovaného Markdownu se skutečnými záhlavími, tabulkami a obrázky.

Skilly se spouštějí běžnými požadavky — žádné příkazy k zapamatování. Po instalaci ho aktivují prompty jako tyto (anglicky):

  • Load this entire PDF into context, not just search it
  • Convert this whole PDF report into clean markdown with tables
  • Extract all the text and tables from this PDF, preserve formatting