Image (Synthadoc)

Módulo Python interno de Synthadoc que codifica una imagen en base64 a un LLM de visión para la extracción de texto

Por axoviq-ai · axoviq-ai/synthadoc

Tested · Didn't pass

Image (Synthadoc) — Módulo Python interno de Synthadoc que codifica una imagen en base64 a un LLM de visión para la extracción de texto

Qué hace

Un componente del motor wiki Synthadoc que codifica una imagen en base64 y la pasa a un LLM de visión proporcionado para extraer texto. No es una habilidad independiente de Claude Code: utiliza un frontmatter de entrada/clase no estándar e importa directamente el paquete synthadoc, por lo que no puede cargarse ni ejecutarse desde ~/.claude/skills.

Informe de la prueba

Este es un módulo de biblioteca para el motor Synthadoc, no una habilidad de Claude Code: su frontmatter es entry/class/triggers (no el contrato de nombre+descripción de CC), y la importación de scripts/main.py desde una instalación básica arroja ModuleNotFoundError: No module named 'synthadoc'. También necesita un objeto de proveedor de visión conectado en la construcción, por lo que no puede ejecutarse en Claude Code en absoluto. Dado que Claude ya lee el texto de las imágenes de forma nativa y esto solo añade una indirección rota, es peor que ninguna habilidad para un usuario de CC.

Probado el: 2026-07-17 · Claude Code 2.x (agent harness)

Instalación

git clone https://github.com/axoviq-ai/synthadoc.git
mkdir -p ~/.claude/skills
cd synthadoc && cp -r synthadoc/skills/image ~/.claude/skills/image  # copies, but the skill is non-functional standalone

Comandos y prompts de ejemplo

  • /imageMódulo Python interno de Synthadoc que codifica una imagen en base64 a un LLM de visión para la extracción de texto

Los skills se activan con peticiones en lenguaje natural, sin comandos que memorizar. Tras instalarlo, prompts como estos lo activan (en inglés):

  • Please read the text contained within this image.
  • Extract all the text from this document scan.
  • Could you transcribe the words in this picture?