PDF rein.
Sauberes Markdown raus.
Ein REST-Aufruf — oder ein nativer MCP-Server, den Ihr KI-Agent direkt nutzen kann. Markdown, strukturierte Elemente und Embedding-fertige Chunks mit Quellen-Nachverfolgbarkeit.
Kostenloser Tarif · keine Kreditkarte · anonymes Ausprobieren ohne Schlüssel
REST mit einem Aufruf
Senden Sie eine PDF-URL per POST und erhalten Sie das kanonische ExtractedDocument — synchron. Auch Doc Links haben REST-Endpunkte (/api/v1/links) — jedes Tool zeigt unten seinen REST-Spiegel. OpenAPI-Spezifikation (JSON)
curl -X POST https://doc.page/api/v1/extract \
-H "Content-Type: application/json" \
-H "Authorization: Bearer dk_live_..." \
-d '{
"url": "https://example.com/report.pdf",
"outputs": ["markdown", "elements", "chunks"]
}' {
"schemaVersion": "1.0",
"source": { "engine": "server-pdfjs", "pages": 12 },
"markdown": "# Title\n...",
"elements": [{ "id": "el_0001", "type": "heading", "page": 1, "text": "Title" }],
"chunks": [{ "id": "ch_0001", "text": "...", "tokens": 486, "page": 1,
"section": "Introduction", "elementIds": ["el_0002"] }]
} Nativer MCP-Server
Verbinden Sie Ihren Agenten mit dem Endpunkt und er kann PDFs selbstständig lesen. Funktioniert mit Claude Code, Claude Desktop, Cursor und jedem MCP-Client.
claude mcp add --transport http docpage https://doc.page/api/mcp {
"mcpServers": {
"docpage": {
"type": "http",
"url": "https://doc.page/api/mcp",
"headers": { "Authorization": "Bearer dk_live_..." }
}
}
} Tools
-
extract_pdf— Vollständige Extraktion: Markdown + strukturierte Elemente, optionale Chunks. Modus "hybrid" ergänzt rekonstruierte Tabellen und Bounding Boxes. REST: POST /api/v1/extract -
get_chunks— Semantische Chunks in Ihrer Token-Größe, jeweils mit Seite, Abschnitt und den IDs der Quell-Elemente. -
list_tables— Alle Tabellen des PDFs als strukturierte Zeilen und Spalten, jeweils mit Seite und Bounding Box für überprüfbare Zitate. -
create_doc_linkAPI-Schlüssel — Veröffentlicht ein PDF als doc.page-Link mit Tracking (Ablauf, Öffnungsbenachrichtigung). Der Link erscheint wie jeder Doc Link in Ihrer Bibliothek. REST: POST /api/v1/links -
list_doc_linksAPI-Schlüssel — Listet die Doc Links des Kontos mit Status und Aufrufen — so findet ein Agent Links aus früheren Sitzungen wieder. REST: GET /api/v1/links -
get_doc_link_statsAPI-Schlüssel — Lese-Analytik eines Links: Besuche, erfasste E-Mails, Länder, Besucher-Firmen und Lesezeit pro Seite. REST: GET /api/v1/links/:id -
revoke_doc_linkAPI-Schlüssel — Deaktiviert einen Link. Dokument und Statistiken bleiben in der Bibliothek; im Gratis-Plan wird ein Platz frei. REST: DELETE /api/v1/links/:id -
classify_documentdemnächst — Routet Dokumente ohne Voll-Extraktion: Typ (Rechnung, Vertrag, Lebenslauf…), Sprache, nativer Text vs. Scan, OCR-Bedarf.
Was Sie zurückbekommen
Jede Antwort ist dasselbe kanonische Objekt, unabhängig von der Engine:
-
markdowndas gesamte Dokument als sauberes Markdown
-
elements[]Blöcke in Lesereihenfolge mit Typ und Seite (heading, paragraph, list…)
-
chunks[]Embedding-fertige Textstücke mit Token-Schätzung, Abschnitt und nachverfolgbaren Element-IDs
-
confidencedie ehrliche Selbsteinschätzung der Engine — niedrige Tabellen-Konfidenz heißt: Hybrid-Modus nutzen
Zwei Engines, ein Schema: Die Standard-Engine ("fast") ist auf Fließtext fokussiert (keine Tabellen/bbox); "hybrid" nutzt eine schwerere semantische Engine, die Tabellen und Bounding Boxes rekonstruiert. Ist hybrid vorübergehend nicht verfügbar, fällt die Antwort mit einer expliziten Warnung auf fast zurück.
Für echte Dokumente gebaut
Wo es glänzt
- Geschäftsberichte und Abschlüsse mit regulären, linierten Tabellen
- Rechnungen, Lieferscheine und Bestellungen — Positionen als strukturierte Zeilen
- Verträge, Policen und juristische Texte mit sauberer Überschriften-Hierarchie
- Technische Handbücher und Dokumentation, direkt in RAG-Pipelines
- Bücher, Artikel und lange Texte für Zusammenfassungen oder Audio
Wo Vorsicht gilt
- Randlose akademische Tabellen mit mathematischer Notation können als Text statt als strukturierte Zeilen zurückkommen — der Inhalt geht nie verloren, aber prüfen Sie confidence.tables
- Dichte Tabellen mit verbundenen mehrzeiligen Zellen können an Ausrichtung verlieren
- Gescannte PDFs (ohne Textebene) noch nicht — OCR steht auf der Roadmap
Limits & Tarife
| Ohne Schlüssel | Gratis-Schlüssel | Premium | |
|---|---|---|---|
| Seiten / Monat | — | 500 | 10.000 |
| Anfragen / Minute | — | 10 | 60 |
| Extraktionen / Tag | 25 pro IP | nach Kontingent | nach Kontingent |
| Max. PDF-Größe | 25 MB | 25 MB | 25 MB |
Schlüssel erstellen und verwalten Sie in Ihren Kontoeinstellungen (Reiter "API-Schlüssel"). Gezählt wird jede Seite des verarbeiteten PDFs.
Premium
4,99 $ pro Monat
10.000 Seiten pro Monat — plus alles, was Premium bei Doc Links freischaltet.
Premium holen — 4,99 $/MonatGuthaben-Pakete
$5 / $30
Einmalzahlung. Das Guthaben verfällt nie und wird genutzt, sobald Ihr Monatskontingent aufgebraucht ist.
Fehler
-
401unbekannter oder widerrufener Schlüssel -
429Rate-Limit erreicht — nach den angegebenen Sekunden erneut versuchen -
402monatliches Seitenkontingent aufgebraucht
Häufige Fragen
Speichert ihr die PDFs, die ich sende?
Nein. Das Dokument wird geladen, im Speicher verarbeitet und verworfen. Gespeichert werden nur aggregierte Nutzungszähler (Seiten, Anfragen) für die Abrechnung.
Gibt es wirklich einen kostenlosen Tarif?
Ja, sogar zwei: Ohne Schlüssel gibt es ein kleines Tageskontingent pro IP zum Ausprobieren, und ein kostenloser API-Schlüssel bietet 500 Seiten pro Monat.
Funktioniert es mit gescannten PDFs (OCR)?
Noch nicht. Die aktuelle Engine extrahiert die Textebene digitaler PDFs. OCR ist als Teil des Hybrid-Modus geplant.
Rekonstruiert es Tabellen?
Ja — nutzen Sie den Modus "hybrid" oder das Tool list_tables. Eine schwerere semantische Engine rekonstruiert jede Tabelle als strukturierte Zeilen und Spalten, mit Seite und Bounding Box für exakte Quellenangaben. Die Standard-Engine "fast" bleibt reiner Fließtext.
Warum ein MCP-Server?
Damit KI-Agenten doc.page ohne Integrationscode nutzen können: Endpunkt einmal verbinden, und der Agent extrahiert PDFs oder holt RAG-Chunks in natürlicher Sprache.