Document Extraction (ADE)
Mallfri PDF-/bild-/kalkylbladsanalys till strukturerad Markdown+JSON med schemaextraktion och avgränsningsrutor.
Testad · Fungerar
Vad den gör
Kapslar in LandingAI:s Agentic Document Extraction (ADE) API/SDK för att tolka PDF:er, bilder, kalkylblad och presentationer till strukturerad Markdown med per-chunk-grundning, och sedan extrahera specifika fält via ett JSON Schema eller Pydantic-modell. Täcker även klassificering och delning av blandade dokumentbatchar, generering av innehållsförteckning och asynkrona jobb för stora filer. Utlöses vid schemabaserad extraktion, sidklassificering, dokumentdelning, TOC-generering eller omnämnande av avgränsningsrutor/grundning/ordpositioner.
Testrapport
Utförde samma uppgift för fakturafältsextraktion två gånger: baslinjen uppnåddes med OCR + regex/LLM-gissningar, färdighetens Pydantic-till-JSON-Schema + client.extract()-väg returnerar fälten plus spårbarhet per fält och konfidenspoäng direkt.
Testad: 2026-07-14 · Claude Code 2.x (agent harness)
Installation
git clone https://github.com/landing-ai/ade-document-processing-skills cd ade-document-processing-skills mkdir -p ~/.claude/skills cp -r plugins/ade-document-processing/skills/document-extraction ~/.claude/skills/document-extraction
Kommandon och exempelprompter
/document-extractionMallfri PDF-/bild-/kalkylbladsanalys till strukturerad Markdown+JSON med schemaextraktion och avgränsningsrutor.
Skills triggas av vanliga förfrågningar — inga kommandon att memorera. Efter installationen aktiverar prompter som dessa skillen (på engelska):
Extract the invoice number, date, and total from this PDFSplit this folder of mixed invoices and receipts by typePull the exact text location for each clause in this contract