PDF to Markdown
Extrahování celého PDF do čistého, strukturovaného Markdownu se skutečnými záhlavími, tabulkami a obrázky.
Otestováno · Funguje
Co umí
Dovednost podporovaná CLI, která převádí celé PDF do Markdownu pomocí PyMuPDF/pymupdf4llm (nebo Docling pro vysoce přesné tabulky), zachovává záhlaví, tučné/kurzivní písmo, pořadí čtení ve více sloupcích, tabulky a extrahované obrázky, s agresivním cachováním hashů obsahu. Spouští se, když uživatel chce načíst 'whole PDF' nebo 'entire document' do kontextu namísto přístupu grep/search nebo stránku po stránce.
Testovací report
Spustil jsem přibalený skript pymupdf4llm na testovacím PDF s tabulkou, tučným/kurzivním textem a odrážkovým seznamem: vytvořil skutečné markdown záhlaví, tabulku s oddělovači a zachoval tučné/kurzivní formátování, zatímco výchozí čtení PDF samotného harnessu se vrátilo k jednomu nerozlišenému bloku prostého textu s nulovými strukturními značkami.
Testováno: 2026-07-14 · Claude Code 2.x (agent harness)
Instalace
git clone https://github.com/aliceisjustplaying/claude-skill-pdf-to-markdown cd claude-skill-pdf-to-markdown mkdir -p ~/.claude/skills cp -r . ~/.claude/skills/pdf-to-markdown
Příkazy a ukázkové prompty
/pdf-to-markdownExtrahování celého PDF do čistého, strukturovaného Markdownu se skutečnými záhlavími, tabulkami a obrázky.
Skilly se spouštějí běžnými požadavky — žádné příkazy k zapamatování. Po instalaci ho aktivují prompty jako tyto (anglicky):
Load this entire PDF into context, not just search itConvert this whole PDF report into clean markdown with tablesExtract all the text and tables from this PDF, preserve formatting