PDF to Markdown

Extrae un PDF completo a Markdown limpio y estructurado con encabezados, tablas e imágenes reales.

Por aliceisjustplaying · aliceisjustplaying/claude-skill-pdf-to-markdown

Probado · Funciona ★ 9.6/10

PDF to Markdown — Extrae un PDF completo a Markdown limpio y estructurado con encabezados, tablas e imágenes reales.

Qué hace

Una skill respaldada por CLI que convierte un PDF completo a Markdown usando PyMuPDF/pymupdf4llm (o Docling para tablas de alta precisión), preservando encabezados, negritas/cursivas, orden de lectura de múltiples columnas, tablas e imágenes extraídas, con un agresivo caché de hash de contenido. Se activa cuando un usuario desea cargar el 'whole PDF' o 'entire document' en el contexto en lugar de un enfoque de grep/búsqueda o página por página.

Informe de la prueba

Ejecuté el script pymupdf4llm incluido en un PDF de prueba con una tabla, texto en negrita/cursiva y una lista de viñetas: produjo encabezados markdown reales, una tabla con pipes y conservó el formato en negrita/cursiva, mientras que la lectura de PDF predeterminada del propio harness recurrió a un bloque indiferenciado de texto plano sin marcadores de estructura.

Probado el: 2026-07-14 · Claude Code 2.x (agent harness)

Instalación

git clone https://github.com/aliceisjustplaying/claude-skill-pdf-to-markdown
cd claude-skill-pdf-to-markdown
mkdir -p ~/.claude/skills
cp -r . ~/.claude/skills/pdf-to-markdown

Comandos y prompts de ejemplo

  • /pdf-to-markdownExtrae un PDF completo a Markdown limpio y estructurado con encabezados, tablas e imágenes reales.

Los skills se activan con peticiones en lenguaje natural, sin comandos que memorizar. Tras instalarlo, prompts como estos lo activan (en inglés):

  • Load this entire PDF into context, not just search it
  • Convert this whole PDF report into clean markdown with tables
  • Extract all the text and tables from this PDF, preserve formatting