API & MCP

PDF rein.
Sauberes Markdown raus.

Ein REST-Aufruf — oder ein nativer MCP-Server, den Ihr KI-Agent direkt nutzen kann. Markdown, strukturierte Elemente und Embedding-fertige Chunks mit Quellen-Nachverfolgbarkeit.

Kostenlosen API-Schlüssel holen

Kostenloser Tarif · keine Kreditkarte · anonymes Ausprobieren ohne Schlüssel

REST mit einem Aufruf

Senden Sie eine PDF-URL per POST und erhalten Sie das kanonische ExtractedDocument — synchron. Auch Doc Links haben REST-Endpunkte (/api/v1/links) — jedes Tool zeigt unten seinen REST-Spiegel. OpenAPI-Spezifikation (JSON)

curl -X POST https://doc.page/api/v1/extract \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer dk_live_..." \
  -d '{
    "url": "https://example.com/report.pdf",
    "outputs": ["markdown", "elements", "chunks"]
  }'
{
  "schemaVersion": "1.0",
  "source": { "engine": "server-pdfjs", "pages": 12 },
  "markdown": "# Title\n...",
  "elements": [{ "id": "el_0001", "type": "heading", "page": 1, "text": "Title" }],
  "chunks":   [{ "id": "ch_0001", "text": "...", "tokens": 486, "page": 1,
                 "section": "Introduction", "elementIds": ["el_0002"] }]
}

Nativer MCP-Server

Verbinden Sie Ihren Agenten mit dem Endpunkt und er kann PDFs selbstständig lesen. Funktioniert mit Claude Code, Claude Desktop, Cursor und jedem MCP-Client.

claude mcp add --transport http docpage https://doc.page/api/mcp
{
  "mcpServers": {
    "docpage": {
      "type": "http",
      "url": "https://doc.page/api/mcp",
      "headers": { "Authorization": "Bearer dk_live_..." }
    }
  }
}

Tools

  • extract_pdf — Vollständige Extraktion: Markdown + strukturierte Elemente, optionale Chunks. Modus "hybrid" ergänzt rekonstruierte Tabellen und Bounding Boxes. REST: POST /api/v1/extract
  • get_chunks — Semantische Chunks in Ihrer Token-Größe, jeweils mit Seite, Abschnitt und den IDs der Quell-Elemente.
  • list_tables — Alle Tabellen des PDFs als strukturierte Zeilen und Spalten, jeweils mit Seite und Bounding Box für überprüfbare Zitate.
  • create_doc_link API-Schlüssel — Veröffentlicht ein PDF als doc.page-Link mit Tracking (Ablauf, Öffnungsbenachrichtigung). Der Link erscheint wie jeder Doc Link in Ihrer Bibliothek. REST: POST /api/v1/links
  • list_doc_links API-Schlüssel — Listet die Doc Links des Kontos mit Status und Aufrufen — so findet ein Agent Links aus früheren Sitzungen wieder. REST: GET /api/v1/links
  • get_doc_link_stats API-Schlüssel — Lese-Analytik eines Links: Besuche, erfasste E-Mails, Länder, Besucher-Firmen und Lesezeit pro Seite. REST: GET /api/v1/links/:id
  • revoke_doc_link API-Schlüssel — Deaktiviert einen Link. Dokument und Statistiken bleiben in der Bibliothek; im Gratis-Plan wird ein Platz frei. REST: DELETE /api/v1/links/:id
  • classify_document demnächst — Routet Dokumente ohne Voll-Extraktion: Typ (Rechnung, Vertrag, Lebenslauf…), Sprache, nativer Text vs. Scan, OCR-Bedarf.

Was Sie zurückbekommen

Jede Antwort ist dasselbe kanonische Objekt, unabhängig von der Engine:

Zwei Engines, ein Schema: Die Standard-Engine ("fast") ist auf Fließtext fokussiert (keine Tabellen/bbox); "hybrid" nutzt eine schwerere semantische Engine, die Tabellen und Bounding Boxes rekonstruiert. Ist hybrid vorübergehend nicht verfügbar, fällt die Antwort mit einer expliziten Warnung auf fast zurück.

Für echte Dokumente gebaut

Wo es glänzt

  • Geschäftsberichte und Abschlüsse mit regulären, linierten Tabellen
  • Rechnungen, Lieferscheine und Bestellungen — Positionen als strukturierte Zeilen
  • Verträge, Policen und juristische Texte mit sauberer Überschriften-Hierarchie
  • Technische Handbücher und Dokumentation, direkt in RAG-Pipelines
  • Bücher, Artikel und lange Texte für Zusammenfassungen oder Audio

Wo Vorsicht gilt

  • Randlose akademische Tabellen mit mathematischer Notation können als Text statt als strukturierte Zeilen zurückkommen — der Inhalt geht nie verloren, aber prüfen Sie confidence.tables
  • Dichte Tabellen mit verbundenen mehrzeiligen Zellen können an Ausrichtung verlieren
  • Gescannte PDFs (ohne Textebene) noch nicht — OCR steht auf der Roadmap

Limits & Tarife

Ohne SchlüsselGratis-SchlüsselPremium
Seiten / Monat50010.000
Anfragen / Minute1060
Extraktionen / Tag25 pro IPnach Kontingentnach Kontingent
Max. PDF-Größe25 MB25 MB25 MB

Schlüssel erstellen und verwalten Sie in Ihren Kontoeinstellungen (Reiter "API-Schlüssel"). Gezählt wird jede Seite des verarbeiteten PDFs.

Gratis-Schlüssel

$0

500 Seiten pro Monat. Keine Kreditkarte.

Kostenlosen Schlüssel erstellen

Premium

4,99 $ pro Monat

10.000 Seiten pro Monat — plus alles, was Premium bei Doc Links freischaltet.

Premium holen — 4,99 $/Monat

Guthaben-Pakete

$5 / $30

Einmalzahlung. Das Guthaben verfällt nie und wird genutzt, sobald Ihr Monatskontingent aufgebraucht ist.

Fehler

Häufige Fragen

Speichert ihr die PDFs, die ich sende?

Nein. Das Dokument wird geladen, im Speicher verarbeitet und verworfen. Gespeichert werden nur aggregierte Nutzungszähler (Seiten, Anfragen) für die Abrechnung.

Gibt es wirklich einen kostenlosen Tarif?

Ja, sogar zwei: Ohne Schlüssel gibt es ein kleines Tageskontingent pro IP zum Ausprobieren, und ein kostenloser API-Schlüssel bietet 500 Seiten pro Monat.

Funktioniert es mit gescannten PDFs (OCR)?

Noch nicht. Die aktuelle Engine extrahiert die Textebene digitaler PDFs. OCR ist als Teil des Hybrid-Modus geplant.

Rekonstruiert es Tabellen?

Ja — nutzen Sie den Modus "hybrid" oder das Tool list_tables. Eine schwerere semantische Engine rekonstruiert jede Tabelle als strukturierte Zeilen und Spalten, mit Seite und Bounding Box für exakte Quellenangaben. Die Standard-Engine "fast" bleibt reiner Fließtext.

Warum ein MCP-Server?

Damit KI-Agenten doc.page ohne Integrationscode nutzen können: Endpunkt einmal verbinden, und der Agent extrahiert PDFs oder holt RAG-Chunks in natürlicher Sprache.