Zum Hauptinhalt springen

Formulardaten extrahieren PDF In n8n

Formulardaten extrahieren PDF ist ein PDF4me Knotenaktion in n8n das die eingegebenen Werte aus einem ausfüllbaren PDF und gibt sie als strukturierte Datei zurück. formData JSON Objekt. Verwenden Sie es, um zurückgesendete Antragsformulare, unterschriebene Aufnahmeformulare oder Umfragen umzudrehen. PDFs in Datenbankzeilen, ohne dass jemand die Antworten erneut eintippen muss.

Was dieser Knoten bewirkt

PDF4me: Formulardaten extrahieren aus PDF benötigt ein vollständig ausfüllbares Formular PDF aus Binärdaten, ein Base64 Stringoder ein URLliest seine interaktive Formularschicht und gibt jedes Feld als Name-Wert-Paar innerhalb eines einzigen formData Objekt. Texteingabefelder, Kontrollkästchen, Optionsfelder und Dropdown-Auswahlen werden alle wieder zusammengeführt und sind bereit, einer Tabellenzeile zugeordnet zu werden. CRM einen Datensatz oder eine bedingte Verzweigung im Workflow.

Verwandte Blog-Beiträge(1)

Authentifizierung Ihres API Anfrage

Jeder PDF4me Knoten in n8n erfordert eine gültige Anmeldeinformationen zum Verbinden mitErstellen oder wählen Sie einen Eintrag aus, der Ihre Daten enthält. PDF4me API Schlüssel, damit der Workflow Extraktionsanfragen sicher authentifizieren kann.

Wichtige Fakten, die Sie nicht verpassen sollten

Der PDF müssen echte Formularfelder haben
Dieser Knoten liest die interaktive AcroForm-Ebene. Eine gescannte Seite oder ein flachgelegtes PDF hat keine Feldobjekte mehr zum Lesen, also leite diese an einen weiter OCR oder AI Stattdessen wird der Parsing-Knoten verwendet.
Im Ergebnis werden weiterhin leere Felder angezeigt.
Ein nicht ausgefülltes Feld wird mit einer leeren Zeichenkette zurückgegeben, anstatt ausgelassen zu werden. Prüfen Sie daher nachgelagert auf leere Werte, anstatt anzunehmen, dass der Schlüssel fehlt.
Die Feldnamen stammen vom Formularersteller.
Die Schlüssel passen zu dem, was auch immer PDF Der Designer hat jedem Feld einen Namen gegeben, und Kontrollkästchen geben ihren Exportwert zurück, anstatt garantiert „wahr“ oder „falsch“ zu liefern. Führen Sie zunächst eine Beispieldatei aus und überprüfen Sie die tatsächliche Ausgabe.
Der PDF4me-Knoten in n8n ist wie folgt konfiguriert: Aktion „Formulardaten aus PDF extrahieren“, Eingabedatentyp „Binärdaten“, Eingabefeld „Daten“, Dokumentname „document.pdf“ und benutzerdefinierte Profile unter „Erweiterte Optionen“.

PDF4me Formulardaten extrahieren PDF Parameterbereich in n8n

Formulardatenextraktion vs. Extraktion von Klartext

Beide Ansätze extrahieren Inhalte aus einem PDFAber nur eine der beiden bietet benannte Felder. Diese Unterscheidung entscheidet darüber, welcher Knoten zu Ihrem Workflow gehört.

AnsatzWas Sie zurückbekommenOptimale Passform
Extract Form Data From PDFNamed field and value pairs from the interactive form layerGenuine fillable PDFs where every answer already sits in a named field
Plain text extractionThe visible page content as one flat string, with no field namesStatic PDFs with no form layer, where you will parse the text yourself
AI document parsingModel-inferred fields from any layout, including scansScanned, flattened, or wildly inconsistent documents with no usable form structure

Aus welchen Parametern werden Formulardaten extrahiert? PDF Brauchen?

Erforderlich: Aktion, Eingabedatentyp, das Feld, das diesem Eingabetyp entspricht, und Dokumentname. Benutzerdefinierte Profile unter Erweiterte Optionen sind optional.

ParameterErforderlichWas es tutBeispiel
ActionRequiredSelects the PDF4me node action to run. Choose Extract Form Data From PDF.Extract Form Data From PDF
Input Data TypeRequiredFormat of the source PDF input. Choose Binary Data (from a previous node), Base64 String, or URL.Binary Data
Input Binary FieldConditionalName of the binary property on the incoming n8n item that holds the filled PDF. Required when Input Data Type is Binary Data. Defaults to data.data
Base64 Document ContentConditionalBase64-encoded content of the filled PDF. Required when Input Data Type is Base64 String.JVBERi0xLjQK...
File URLConditionalPublicly reachable HTTPS URL to the filled PDF. Required when Input Data Type is URL.https://example.com/application_form.pdf
Document NameRequiredFilename of the source PDF, used for reference and tracking in the extraction request. Include the .pdf extension.application_form.pdf
Custom ProfilesOptionalAdvanced Options field for extra processing settings, supplied in a JSON-like format. Leave blank unless you have a specific profile to apply.{ 'outputDataFormat': 'json' }

Ausgabefelder

Ein erfolgreicher Lauf bringt eins zurück n8n Element, das die extrahierten Formularwerte enthält als JSONDie

FeldTypWas es enthält
formDataObjectEvery form field read from the PDF, as a set of field name and field value pairs.
formData.<fieldName>StringThe name of an individual field exactly as the PDF author defined it, for example name, email, or country.
formData.<fieldValue>String, Number, or BooleanThe value entered or selected for that field. Blank fields return an empty string, and checkboxes return their export value.

Ein typischer Antworttext sieht folgendermaßen aus:

{
"formData": {
"name": "PDF4me",
"email": "",
"country": "USA"
}
}

Wie richte ich das Extrahieren von Formulardaten ein? PDF In n8n?

  1. Hinzufügen PDF4me zu Ihrem n8n Workflow und wählen Sie den Formulardaten extrahieren PDF Aktion.
  2. In Anmeldeinformationen zum Verbinden mit, wählen Sie Ihre PDF4me Anmeldeinformationen oder klicken Neue Anmeldeinformationen erstellen und fügen Sie Ihren ein API Schlüssel.
  3. Satz Eingabedatentyp Zu Binärdaten (Standard), Base64 String, oder URL und liefern Sie die passenden ausgefüllten PDF Feld.
  4. Satz Dokumentname zum Quelldateinamen, zum Beispiel application_form.pdfDie
  5. Verlassen Benutzerdefinierte Profile unter Erweiterte Optionen Lassen Sie das Feld leer, es sei denn, Sie benötigen ein bestimmtes Verarbeitungsprofil.
  6. Führe den Knoten aus und ordne anschließend die Werte aus dem zurückgegebenen formData Fügen Sie das Objekt dem nächsten Schritt Ihres Arbeitsablaufs hinzu.

Typische Konfigurationen

Workflow-BeispieleCommon n8n workflow patterns using Extract Form Data From PDF.
Bewerbungsformulare wurden per E-Mail an eine Tabelle gesendet.
  1. Ein E-Mail-Trigger wird ausgelöst, wenn eine Bewerbung vollständig eingereicht wurde. PDF kommt an.
  2. Formulardaten extrahieren PDF Liest den Anhang in ein formData-Objekt ein.
  3. Ein Google Sheets oder Excel Der Knoten fügt eine Zeile hinzu und ordnet jedem Feldnamen eine Spalte zu.
CRM Leadgenerierung aus Eingangsformularen
  1. Ein Cloud-Speicher-Trigger wird beim Hochladen neuer Daten ausgelöst. PDFDie
  2. Formulardaten extrahieren PDF Extrahiert die Kontaktdaten aus der Formularebene.
  3. A CRM Der Knoten erstellt oder aktualisiert den Datensatz anhand der extrahierten Werte für Name, E-Mail-Adresse und Firma.
Routing für bedingte Genehmigungen
  1. Ein Webhook empfängt ein signiertes Anfrageformular von einem externen Portal.
  2. Formulardaten extrahieren PDF Gibt den angeforderten Betrag und die Abteilungsfelder zurück.
  3. Ein IF-Knoten verzweigt sich anhand dieser Werte zum richtigen Genehmiger.
Stapeldigitalisierung eines Archivs
  1. Ein Knoten vom Typ „Schleife über Elemente“ iteriert über eine Liste archivierter Formulare. URLsDie
  2. Formulardaten extrahieren PDF wird ausgeführt, wenn der Eingabedatentyp auf „“ eingestellt ist. URL für jede Datei.
  3. Jedes formData-Objekt wird in eine Datenbanktabelle geschrieben, deren Schlüssel der Name des Quelldokuments ist.

Praktische Tipps

Run one sample file before you map anything
Field names and checkbox export values are set by whoever designed the form, so inspect the real formData output first instead of guessing the key names.
Test for empty strings, not missing keys
Unfilled fields are still present in the output with an empty value, so a simple key existence check will not tell you whether the user answered.
Check the PDF is not flattened
A form that looks fillable in a viewer may have been flattened on save, which strips the field layer. If formData comes back empty, that is usually why.
Send scans to an AI parser instead
Scanned paper forms have no interactive fields at all. Route those to Parse Document rather than expecting this node to read them.
Keep Document Name meaningful
It is used for reference and tracking on the request, so passing the real source filename makes execution logs far easier to audit later.
Validate before writing to a system of record
Add a check on required fields after extraction so an incomplete submission is flagged rather than silently creating a half-empty CRM record.

Spickzettel

FeldWert
ActionExtract Form Data From PDF
Input Data TypeBinary Data
Input Binary Fielddata
Document Namedocument.pdf
Custom Profiles{ 'outputDataFormat': 'json' }
CredentialsPDF4me API credential
ReturnsformData object of field name and value pairs

Häufig gestellte Fragen

Does Extract Form Data From PDF work on a scanned or flattened PDF?+
No. This node reads values from real interactive form fields, the AcroForm layer described in the ISO 32000 PDF specification. A scanned page is just an image, and a flattened PDF has had its fields painted into static content, so in both cases there are no field objects left to read. For those files use an OCR or AI parsing node instead, such as Parse Document.
What do empty form fields return?+
A field the user left blank still appears in the formData object, with an empty string as its value. The key set reflects the fields defined in the PDF, not only the ones that were filled in, so downstream nodes should test for empty values rather than assume a missing key.
How are checkboxes and radio buttons returned?+
Checkbox and radio button fields return their underlying export value as defined in the PDF, not always a literal true or false. Common values include Yes, Off, or a named choice set by whoever built the form. Run the node once on a sample filled PDF and inspect the actual output before writing comparison logic against it.
Can I send extracted PDF form data straight to Excel or a database?+
Yes. The formData object is standard JSON, so any node that accepts item fields can consume it. Map formData keys onto columns in a spreadsheet, database, or CRM node placed after the PDF4me node, using the standard n8n data mapping approach.
What is the difference between extracting form data and extracting text from a PDF?+
Extracting form data reads named field values from the interactive form layer, so you get reliable key and value pairs such as email mapped to its entered address. Extracting text returns the visible page content as a flat string with no field names attached, leaving you to parse it. Prefer form data extraction whenever the PDF is a genuine fillable form.

Verwandte Aktionen

Dieselbe Aufgabe auf anderen Plattformen

Hilfe erhalten