Image (Synthadoc)

Synthadoc-intern Python-modul som base64-kodar en bild till en vision LLM för textutvinning

av axoviq-ai · axoviq-ai/synthadoc

Tested · Didn't pass

Image (Synthadoc) — Synthadoc-intern Python-modul som base64-kodar en bild till en vision LLM för textutvinning

Vad den gör

En komponent i Synthadoc wiki engine som base64-kodar en bild och skickar den till en tillhandahållen vision LLM för att extrahera text. Det är inte en fristående Claude Code skill: den använder en icke-standard entry/class frontmatter och hard-imports synthadoc-paketet, så den kan inte laddas eller köras från ~/.claude/skills.

Testrapport

Detta är en biblioteksmodul för Synthadoc-motorn, inte en Claude Code skill: dess frontmatter är entry/class/triggers (inte CC name+description contract), och att importera scripts/main.py från en bare install kastar ModuleNotFoundError: No module named 'synthadoc'. Den behöver också ett vision provider object inkopplat vid konstruktion, så den kan inte köras i Claude Code alls. Eftersom Claude redan läser bildtext nativt och detta bara lägger till en trasig indirektion, är det sämre än ingen färdighet för en CC-användare.

Testad: 2026-07-17 · Claude Code 2.x (agent harness)

Installation

git clone https://github.com/axoviq-ai/synthadoc.git
mkdir -p ~/.claude/skills
cd synthadoc && cp -r synthadoc/skills/image ~/.claude/skills/image  # copies, but the skill is non-functional standalone

Kommandon och exempelprompter

  • /imageSynthadoc-intern Python-modul som base64-kodar en bild till en vision LLM för textutvinning

Skills triggas av vanliga förfrågningar — inga kommandon att memorera. Efter installationen aktiverar prompter som dessa skillen (på engelska):

  • Please read the text contained within this image.
  • Extract all the text from this document scan.
  • Could you transcribe the words in this picture?