PDF to Markdown

Wyodrębnia cały PDF do czystego, ustrukturyzowanego Markdown z prawdziwymi nagłówkami, tabelami i obrazami.

Autor: aliceisjustplaying · aliceisjustplaying/claude-skill-pdf-to-markdown

Testowano · Działa ★ 9.6/10

PDF to Markdown — Wyodrębnia cały PDF do czystego, ustrukturyzowanego Markdown z prawdziwymi nagłówkami, tabelami i obrazami.

Co robi ten skill

Umiejętność wspierana przez CLI, która konwertuje cały PDF do Markdown za pomocą PyMuPDF/pymupdf4llm (lub Docling dla tabel o wysokiej dokładności), zachowując nagłówki, pogrubienie/kursywę, kolejność czytania wielokolumnowego, tabele i wyodrębnione obrazy, z agresywnym buforowaniem skrótów zawartości. Uruchamia się, gdy użytkownik chce załadować 'whole PDF' lub 'entire document' do kontekstu, zamiast podejścia grep/search lub strona po stronie.

Raport z testu

Uruchomiono dołączony skrypt pymupdf4llm na testowym PDF-ie z tabelą, tekstem pogrubionym/kursywą i listą punktowaną: wygenerował prawdziwe nagłówki markdown, tabelę z potokami i zachował formatowanie pogrubione/kursywę, podczas gdy domyślne odczytywanie PDF-ów przez uprząż sprowadziło się do jednego niezróżnicowanego bloku zwykłego tekstu bez żadnych znaczników struktury.

Testowano: 2026-07-14 · Claude Code 2.x (agent harness)

Instalacja

git clone https://github.com/aliceisjustplaying/claude-skill-pdf-to-markdown
cd claude-skill-pdf-to-markdown
mkdir -p ~/.claude/skills
cp -r . ~/.claude/skills/pdf-to-markdown

Komendy i przykładowe prompty

  • /pdf-to-markdownWyodrębnia cały PDF do czystego, ustrukturyzowanego Markdown z prawdziwymi nagłówkami, tabelami i obrazami.

Skille uruchamiają się na zwykłe polecenia — bez komend do zapamiętania. Po instalacji aktywują go prompty takie jak te (po angielsku):

  • Load this entire PDF into context, not just search it
  • Convert this whole PDF report into clean markdown with tables
  • Extract all the text and tables from this PDF, preserve formatting