PDF in JSON

JSON aus einem PDF extrahieren

Holen Sie strukturierte Daten als sauberes JSON aus jedem PDF — legen Sie Ihre Felder fest und lassen Sie die KI sie füllen.

JSON aus einem PDF extrahieren online

Statt das ganze Dokument als Text auszugeben, fragt PDF Vision, welche Felder zählen — invoiceNumber, invoiceDate, totalAmount, partyA — und welchen Typ jedes hat: string, number, boolean, date, array oder object. Die KI liest dann das PDF und liefert genau diese Form als JSON zurück, bereit zum Einfügen in einen Request-Body, eine Datenbankzeile oder einen Automatisierungsschritt. Vorlagen für Rechnungen, Kontakte und Verträge geben Ihnen ein Ausgangsschema. Die Extraktion läuft auf unseren Servern über einen kostenpflichtigen KI-Dienst, daher erfordert dieses Werkzeug einen Gold-Tarif — ein kostenloses Konto wird an diesem Endpunkt abgelehnt.

So funktioniert es

  1. Schema festlegen

    Fügen Sie pro Feld eine Zeile hinzu, benennen Sie es in camelCase und legen Sie seinen Typ fest, oder laden Sie die Vorlage für Rechnung, Kontakt oder Vertrag.

  2. PDF hochladen

    Wählen Sie das zu lesende Dokument; die Extraktion läuft im Rahmen Ihres Gold-Tarifs auf unseren Servern und dauert bei dichten oder mehrseitigen Dateien länger.

  3. JSON kopieren oder herunterladen

    Prüfen Sie das Ergebnis in der Baumansicht und kopieren Sie es dann in die Zwischenablage oder speichern Sie es als .json-Datei.

Warum dieses Werkzeug

Sie bestimmen das Schema

Feldnamen und Typen legen Sie fest, sodass die Antwort direkt in ein bestehendes TypeScript-Interface oder eine Datenbankspalte passt, ohne dass Sie eine Zuordnungsschicht dazwischen schreiben müssen.

Typisiert, nicht nur Strings

Wird ein Wert als number, boolean oder date deklariert, kommen Summen als Zahlen und Daten in vergleichbarer Form zurück, statt als Strings, die Ihr Code parsen und validieren muss.

Jeder Durchlauf wird gespeichert

Frühere Extraktionen bleiben in einem Verlaufsbereich: Öffnen Sie eine erneut, um ihr JSON in der Baumansicht zu prüfen oder die Datei noch einmal herunterzuladen, ohne das PDF erneut hochzuladen.

Häufige Fragen

Wie wähle ich die zu extrahierenden Felder?
Sie listen sie selbst auf, Zeile für Zeile: einen Feldnamen plus einen Typ aus string, number, boolean, date, array oder object. Namen müssen gültige Bezeichner sein, schreiben Sie also invoiceTotal statt „invoice total“.
Gibt es einen Ausgangspunkt für gängige Dokumente?
Ja, drei Vorlagen füllen das Schema für Sie: Rechnung (Nummer, Datum, Lieferant, Summe, Währung), Kontakt (vollständiger Name, E-Mail, Telefon, Firma) und Vertrag (Titel, beide Parteien, Beginn- und Enddatum). Jede Zeile lässt sich danach bearbeiten.
Funktioniert es mit gescannten PDFs?
Nicht zuverlässig. Die Extraktion liest den Text, den das PDF bereits enthält, ein reiner Scan liefert also dünne oder leere Felder. Führen Sie zuerst OCR PDF aus, um eine Textebene hinzuzufügen, und extrahieren Sie dann.
Was, wenn ein Feld nicht im Dokument steht?
KI-Extraktion kann nur lesen, was auf der Seite steht, ein Feld, das das Dokument nie erwähnt, lässt sich also nicht füllen. Behandeln Sie das Ergebnis als zu prüfende Daten, besonders Zahlen, die Zahlungen oder Buchungen auslösen.
Brauche ich ein Konto?
Ja, und zwar ein kostenpflichtiges: PDF in JSON erfordert einen Gold-Tarif. Ein kostenloses Konto wird bei diesem Werkzeug abgelehnt, eine Registrierung allein verschafft Ihnen also keinen Zugang. Die Extraktion läuft außerdem serverseitig, das Dokument wird also zur Verarbeitung hochgeladen, statt in Ihrem Browser ausgewertet zu werden.
Was kann ich danach mit dem JSON tun?
Kopieren Sie es aus der Baumansicht oder laden Sie die Datei herunter und senden Sie sie dann per POST an eine API, fügen Sie sie als Datenbankzeile ein oder übergeben Sie sie an einen Tabellenimport, ein Buchhaltungssystem oder einen Automatisierungs-Workflow.