Document Extraction (ADE)
Vorlagenfreies PDF-/Bild-/Tabellenkalkulations-Parsing zu strukturiertem Markdown+JSON mit Schema-Extraktion und Bounding Boxes.
Getestet · Funktioniert
Was es kann
Umschließt die Agentic Document Extraction (ADE) API/SDK von LandingAI, um PDFs, Bilder, Tabellenkalkulationen und Präsentationen in strukturiertes Markdown mit chunk-weiser Verankerung zu parsen und dann spezifische Felder über ein JSON Schema oder Pydantic-Modell zu extrahieren. Behandelt auch die Klassifizierung und Aufteilung gemischter Dokumentstapel, die Generierung eines Inhaltsverzeichnisses und asynchrone Jobs für große Dateien. Wird ausgelöst bei schema-basierter Extraktion, Seitenklassifizierung, Dokumentenaufteilung, TOC-Generierung oder jeder Erwähnung von bounding boxes/grounding/word locations.
Testbericht
Dieselbe Aufgabe zur Rechnungsfeldextraktion zweimal entworfen: Baseline erreichte OCR + regex/LLM-Schätzungen, der Pydantic-to-JSON-Schema + client.extract()-Pfad der Skill liefert die Felder plus chunk-weise Rückverfolgbarkeit pro Feld und Konfidenzwerte sofort.
Getestet am: 2026-07-14 · Claude Code 2.x (agent harness)
Installation
git clone https://github.com/landing-ai/ade-document-processing-skills cd ade-document-processing-skills mkdir -p ~/.claude/skills cp -r plugins/ade-document-processing/skills/document-extraction ~/.claude/skills/document-extraction
Befehle & Beispiel-Prompts
/document-extractionVorlagenfreies PDF-/Bild-/Tabellenkalkulations-Parsing zu strukturiertem Markdown+JSON mit Schema-Extraktion und Bounding Boxes.
Skills reagieren auf normale Anfragen — keine Slash-Befehle nötig. Nach der Installation aktivieren Prompts wie diese den Skill (auf Englisch):
Extract the invoice number, date, and total from this PDFSplit this folder of mixed invoices and receipts by typePull the exact text location for each clause in this contract