Image (Synthadoc)

Modulo Python interno a Synthadoc che codifica un'immagine in base64 a un LLM di visione per l'estrazione del testo

di axoviq-ai · axoviq-ai/synthadoc

Tested · Didn't pass

Image (Synthadoc) — Modulo Python interno a Synthadoc che codifica un'immagine in base64 a un LLM di visione per l'estrazione del testo

Cosa fa

Un componente del motore wiki Synthadoc che codifica un'immagine in base64 e la passa a un LLM di visione fornito per estrarre il testo. Non è una skill Claude Code autonoma: utilizza un frontmatter entry/class non standard e importa rigidamente il pacchetto synthadoc, quindi non può essere caricata o eseguita da ~/.claude/skills.

Rapporto di test

Questo è un modulo di libreria per il motore Synthadoc, non una skill Claude Code: il suo frontmatter è entry/class/triggers (non il contratto name+description di CC), e l'importazione di scripts/main.py da un'installazione base genera ModuleNotFoundError: No module named 'synthadoc'. Richiede anche un oggetto provider di visione collegato in fase di costruzione, quindi non può essere eseguito affatto in Claude Code. Poiché Claude legge già il testo delle immagini nativamente e questo aggiunge solo un'indirezione rotta, è peggio di nessuna skill per un utente CC.

Testato il: 2026-07-17 · Claude Code 2.x (agent harness)

Installazione

git clone https://github.com/axoviq-ai/synthadoc.git
mkdir -p ~/.claude/skills
cd synthadoc && cp -r synthadoc/skills/image ~/.claude/skills/image  # copies, but the skill is non-functional standalone

Comandi e prompt di esempio

  • /imageModulo Python interno a Synthadoc che codifica un'immagine in base64 a un LLM di visione per l'estrazione del testo

Gli skill si attivano con richieste in linguaggio naturale, senza comandi da ricordare. Dopo l'installazione, prompt come questi lo attivano (in inglese):

  • Please read the text contained within this image.
  • Extract all the text from this document scan.
  • Could you transcribe the words in this picture?