Document Extraction (ADE)
Template-vrije PDF/afbeelding/spreadsheet parsing naar gestructureerde Markdown+JSON met schema-extractie en bounding boxes.
Getest · Werkt
Wat het doet
Wikkelt LandingAI's Agentic Document Extraction (ADE) API/SDK om PDF's, afbeeldingen, spreadsheets en presentaties te parsen naar gestructureerde Markdown met per-chunk grounding, en vervolgens specifieke velden te extraheren via een JSON Schema of Pydantic model. Behandelt ook het classificeren en splitsen van gemengde documentbatches, het genereren van een inhoudsopgave en asynchrone taken voor grote bestanden. Triggert op schema-gebaseerde extractie, paginaclassificatie, documentsplitsing, TOC-generatie, of elke vermelding van bounding boxes/grounding/word locations.
Testrapport
Dezelfde factuurveldextractietaak tweemaal ontworpen: baseline bereikt voor OCR + regex/LLM gokwerk, het Pydantic-to-JSON-Schema + client.extract() pad van de skill retourneert de velden plus per-veld chunk traceability en confidence scores out of the box.
Getest op: 2026-07-14 · Claude Code 2.x (agent harness)
Installatie
git clone https://github.com/landing-ai/ade-document-processing-skills cd ade-document-processing-skills mkdir -p ~/.claude/skills cp -r plugins/ade-document-processing/skills/document-extraction ~/.claude/skills/document-extraction
Commando's en voorbeeldprompts
/document-extractionTemplate-vrije PDF/afbeelding/spreadsheet parsing naar gestructureerde Markdown+JSON met schema-extractie en bounding boxes.
Skills reageren op gewone verzoeken — geen commando's om te onthouden. Na installatie activeren prompts zoals deze de skill (in het Engels):
Extract the invoice number, date, and total from this PDFSplit this folder of mixed invoices and receipts by typePull the exact text location for each clause in this contract