VLM Run CLI
Stuur de vlmrun CLI aan om afbeeldingen/video/PDF's te OCR'en, extraheren en analyseren
Werkt met setup
Wat het doet
Leert de agent om de vlmrun CLI aan te roepen om afbeeldingen, video en documenten naar VLM Run's Orion visuele model te sturen voor OCR, objectdetectie, extractie, samenvatting en beeld/videogeneratie. Activeert bij verzoeken zoals 'extract text from this image', 'summarize this video', of 'parse this invoice PDF'.
Testrapport
De skill is een accurate wrapper doc voor de echte vlmrun CLI: pip install 'vlmrun[cli]' slaagde en elk gedocumenteerd subcommand (chat, generate, files, hub, models, artifacts) en elke flag bestaat precies zoals de SKILL.md beschrijft. Output kon niet worden gemeten tegen een baseline omdat `vlmrun chat` op een testafbeelding 'API key not found' retourneert en een sleutel van app.vlm.run vereist -- een aanmeld-/betaalmuur, dus er werd geen echt visueel-AI resultaat geproduceerd. Geen oververkoop van iets controleerbaars, maar elke taak in de skill heeft een gefinancierd VLM Run account nodig voordat het iets doet.
Getest op: 2026-07-25 · Claude Code 2.x (agent harness)
Installatie
git clone https://github.com/vlm-run/skills mkdir -p ~/.claude/skills cd skills && cp -r skills/vlmrun-cli-skill ~/.claude/skills/vlmrun-cli-skill
Commando's en voorbeeldprompts
/vlmrun-cli-skillStuur de vlmrun CLI aan om afbeeldingen/video/PDF's te OCR'en, extraheren en analyseren
Skills reageren op gewone verzoeken — geen commando's om te onthouden. Na installatie activeren prompts zoals deze de skill (in het Engels):
Extract text from this scanned invoice imageSummarize what's happening in this uploaded video fileParse this receipt PDF and pull out the line items