PDF to Markdown
Extrait un PDF entier en Markdown propre et structuré avec de vrais en-têtes, tableaux et images.
Testé · Fonctionne
Ce que fait
Une compétence basée sur CLI qui convertit un PDF entier en Markdown en utilisant PyMuPDF/pymupdf4llm (ou Docling pour les tableaux de haute précision), préservant les en-têtes, le gras/italique, l'ordre de lecture multi-colonnes, les tableaux et les images extraites, avec une mise en cache agressive des hachages de contenu. Elle se déclenche lorsqu'un utilisateur souhaite que le 'whole PDF' ou 'entire document' soit chargé dans le contexte plutôt qu'une approche grep/recherche ou page par page.
Rapport de test
Exécuté le script pymupdf4llm fourni sur un PDF de test avec un tableau, du texte gras/italique et une liste à puces : il a produit de vrais en-têtes markdown, un tableau avec des pipes, et a préservé le formatage gras/italique, tandis que la lecture PDF par défaut du harnais est revenue à un bloc de texte brut indifférencié sans marqueurs de structure.
Testé le: 2026-07-14 · Claude Code 2.x (agent harness)
Installation
git clone https://github.com/aliceisjustplaying/claude-skill-pdf-to-markdown cd claude-skill-pdf-to-markdown mkdir -p ~/.claude/skills cp -r . ~/.claude/skills/pdf-to-markdown
Commandes et exemples de prompts
/pdf-to-markdownExtrait un PDF entier en Markdown propre et structuré avec de vrais en-têtes, tableaux et images.
Les skills se déclenchent sur des demandes en langage courant — aucune commande à retenir. Après installation, des prompts comme ceux-ci l'activent (en anglais) :
Load this entire PDF into context, not just search itConvert this whole PDF report into clean markdown with tablesExtract all the text and tables from this PDF, preserve formatting