Document Extraction (ADE)

Mallfri PDF-/bild-/kalkylbladsanalys till strukturerad Markdown+JSON med schemaextraktion och avgränsningsrutor.

av landing-ai · landing-ai/ade-document-processing-skills

Testad · Fungerar ★ 9.2/10

Document Extraction (ADE) — Mallfri PDF-/bild-/kalkylbladsanalys till strukturerad Markdown+JSON med schemaextraktion och avgränsningsrutor.

Vad den gör

Kapslar in LandingAI:s Agentic Document Extraction (ADE) API/SDK för att tolka PDF:er, bilder, kalkylblad och presentationer till strukturerad Markdown med per-chunk-grundning, och sedan extrahera specifika fält via ett JSON Schema eller Pydantic-modell. Täcker även klassificering och delning av blandade dokumentbatchar, generering av innehållsförteckning och asynkrona jobb för stora filer. Utlöses vid schemabaserad extraktion, sidklassificering, dokumentdelning, TOC-generering eller omnämnande av avgränsningsrutor/grundning/ordpositioner.

Testrapport

Utförde samma uppgift för fakturafältsextraktion två gånger: baslinjen uppnåddes med OCR + regex/LLM-gissningar, färdighetens Pydantic-till-JSON-Schema + client.extract()-väg returnerar fälten plus spårbarhet per fält och konfidenspoäng direkt.

Testad: 2026-07-14 · Claude Code 2.x (agent harness)

Installation

git clone https://github.com/landing-ai/ade-document-processing-skills
cd ade-document-processing-skills
mkdir -p ~/.claude/skills
cp -r plugins/ade-document-processing/skills/document-extraction ~/.claude/skills/document-extraction

Kommandon och exempelprompter

  • /document-extractionMallfri PDF-/bild-/kalkylbladsanalys till strukturerad Markdown+JSON med schemaextraktion och avgränsningsrutor.

Skills triggas av vanliga förfrågningar — inga kommandon att memorera. Efter installationen aktiverar prompter som dessa skillen (på engelska):

  • Extract the invoice number, date, and total from this PDF
  • Split this folder of mixed invoices and receipts by type
  • Pull the exact text location for each clause in this contract