Image (Synthadoc)

Synthadoc-intern Python-modul, der base64-koder et billede til en vision LLM for tekstekstraktion

Af axoviq-ai · axoviq-ai/synthadoc

Tested · Didn't pass

Image (Synthadoc) — Synthadoc-intern Python-modul, der base64-koder et billede til en vision LLM for tekstekstraktion

Hvad det gør

En komponent af Synthadoc wiki-motoren, der base64-koder et billede og sender det til en leveret vision LLM for at udtrække tekst. Det er ikke en selvstændig Claude Code-færdighed: den bruger en ikke-standard entry/class frontmatter og hard-importerer synthadoc-pakken, så den kan ikke indlæses eller køres fra ~/.claude/skills.

Testrapport

Dette er et biblioteksmodul til Synthadoc-motoren, ikke en Claude Code-færdighed: dens frontmatter er entry/class/triggers (ikke CC name+description-kontrakten), og import af scripts/main.py fra en bar installation kaster ModuleNotFoundError: No module named 'synthadoc'. Den kræver også et vision provider-objekt forbundet ved konstruktion, så den kan slet ikke køre i Claude Code. Da Claude allerede læser billedtekst nativt, og dette kun tilføjer en brudt indirektion, er det værre end ingen færdighed for en CC-bruger.

Testet: 2026-07-17 · Claude Code 2.x (agent harness)

Installation

git clone https://github.com/axoviq-ai/synthadoc.git
mkdir -p ~/.claude/skills
cd synthadoc && cp -r synthadoc/skills/image ~/.claude/skills/image  # copies, but the skill is non-functional standalone

Kommandoer og eksempelprompter

  • /imageSynthadoc-intern Python-modul, der base64-koder et billede til en vision LLM for tekstekstraktion

Skills udløses af almindelige forespørgsler — ingen kommandoer at huske. Efter installationen aktiverer prompter som disse skillen (på engelsk):

  • Please read the text contained within this image.
  • Extract all the text from this document scan.
  • Could you transcribe the words in this picture?