VLM Run CLI

Stuur de vlmrun CLI aan om afbeeldingen/video/PDF's te OCR'en, extraheren en analyseren

Door vlm-run · vlm-run/skills

Werkt met setup ★ 8.0/10

VLM Run CLI — Stuur de vlmrun CLI aan om afbeeldingen/video/PDF's te OCR'en, extraheren en analyseren

Wat het doet

Leert de agent om de vlmrun CLI aan te roepen om afbeeldingen, video en documenten naar VLM Run's Orion visuele model te sturen voor OCR, objectdetectie, extractie, samenvatting en beeld/videogeneratie. Activeert bij verzoeken zoals 'extract text from this image', 'summarize this video', of 'parse this invoice PDF'.

Testrapport

De skill is een accurate wrapper doc voor de echte vlmrun CLI: pip install 'vlmrun[cli]' slaagde en elk gedocumenteerd subcommand (chat, generate, files, hub, models, artifacts) en elke flag bestaat precies zoals de SKILL.md beschrijft. Output kon niet worden gemeten tegen een baseline omdat `vlmrun chat` op een testafbeelding 'API key not found' retourneert en een sleutel van app.vlm.run vereist -- een aanmeld-/betaalmuur, dus er werd geen echt visueel-AI resultaat geproduceerd. Geen oververkoop van iets controleerbaars, maar elke taak in de skill heeft een gefinancierd VLM Run account nodig voordat het iets doet.

Getest op: 2026-07-25 · Claude Code 2.x (agent harness)

Installatie

git clone https://github.com/vlm-run/skills
mkdir -p ~/.claude/skills
cd skills && cp -r skills/vlmrun-cli-skill ~/.claude/skills/vlmrun-cli-skill

Commando's en voorbeeldprompts

  • /vlmrun-cli-skillStuur de vlmrun CLI aan om afbeeldingen/video/PDF's te OCR'en, extraheren en analyseren

Skills reageren op gewone verzoeken — geen commando's om te onthouden. Na installatie activeren prompts zoals deze de skill (in het Engels):

  • Extract text from this scanned invoice image
  • Summarize what's happening in this uploaded video file
  • Parse this receipt PDF and pull out the line items