Dokument parsen in n8n
PDF4me Dokument analysieren Führt Ihre gespeicherte Parse-Vorlage gegen eine PDF innerhalb eines n8n Der Workflow gibt die extrahierten Felder als strukturierte Daten zurück. Er erhält Binärdaten von einem vorherigen Knoten. Base64 Zeichenkette oder öffentlich URL, beziehen Sie sich auf die Vorlage durch Parse-IDund leiten Sie das resultierende JSON, XML, oder CSV direkt in Set, IF, HTTP Request oder eine beliebige nachgelagerte Funktion n8n Der Knoten enthält die Extraktionslogik, sodass derselbe Knoten Rechnungen, Verträge, Quittungen und alle von Ihnen konfigurierten benutzerdefinierten Layouts extrahiert.
Bevor Sie diesen Knoten ausführen: Erstellen Sie eine Parse-Vorlage im PDF4me Dashboard. Definieren Sie Ihre Erfassungsschlüssel und wählen Sie aus Regex-Ausdruck für stabile Muster oder JavaScript Ausdruck für bedingte Logik. Die n8n Knotenverweise, die diese Vorlage verwenden Parse-ID. Sehen Parse-Informationen für Dokument vorbereiten Für die vollständige Einrichtung, Regex-Beispiele (INV-\d{6,10}, \d{2}/\d{2}/\d{4}), und zwei arbeitende JavaScript Beispiele für Ausdrucksklassifikatoren.
Authentifizierung Ihres API Anfrage
Der PDF4me Knoten in n8n erfordert PDF4me API ZugangsdatenErstellen Sie die Anmeldeinformationen einmalig in n8n mit Ihrem API Nehmen Sie den Schlüssel aus dem Dashboard und verweisen Sie dann von jedem darauf. PDF4me Knoten in Ihrem Workflow.
Wichtige Fakten, die Sie nicht verpassen sollten
Text Variable für Klassifizierungs- und Ausweichregeln.
Parameter
| Parameter | Erforderlich | Was es tut | Beispiel |
|---|---|---|---|
| Input Data Type | Yes | How the PDF reaches the node. Binary Data (from a prior node), Base64 String (inline encoded), or URL (public file URL). | Binary Data |
| Input Binary Field | Conditional | Name of the binary field on the input item containing the PDF. Required when Input Data Type is Binary Data. | data |
| Base64 PDF Content | Conditional | Base64 encoded PDF content. Required when Input Data Type is Base64 String. No data: prefix. | JVBERi0xLjQK... |
| PDF URL | Conditional | Publicly reachable URL of the PDF. Required when Input Data Type is URL. The PDF4me service downloads and processes it. | https://example.com/invoice.pdf |
| Document Name | Yes | Source filename including .pdf extension. Used for format detection and error tracing. | invoice.pdf |
| Parse ID | Yes | TemplateId GUID from the PDF4me dashboard. Identifies the parse template (capture keys + extraction rules) to apply. | 12345678-1234-1234-1234-123456789abc |
| Output Format | Yes | Shape of the returned data. JSON (default, structured object), XML (hierarchical), or CSV (flat tabular). JSON is the right choice for almost every n8n workflow. | JSON |
| Output Binary Field Name | Yes | Name of the binary field the node attaches the parsed output to on the output item. Reference it from downstream nodes. | data |
| Custom Profiles | No | Advanced JSON-style overrides for parsing behaviour (output sub-format, include metadata flag, etc). Leave empty for default behaviour. | { "outputDataFormat": "json", "includeMetadata": true } |
Ausdruckstypen in Ihrer Parsevorlage
Die Erfassungsregeln befinden sich in der Vorlage, nicht in der Datei. n8n Knoten. Beide Ausdruckstypen werden mit jedem Knoten ausgeliefert. PDF4me Konto.
Regex-AusdruckStabile MusterINV-\d{6,10}), Daten (\d{2}/\d{2}/\d{4}), Beträge ($?\d{1,3}(?:,\d{3})*(?:.\d{2})?Rund 80 % der Produktionsschlüssel.JavaScript-AusdruckBedingte Logik und KlassifikatorenTextGibt eine Zeichenkette zurück. Klassifizierung mehrerer Marker, Ausweichregeln, Datumsnormalisierung. Siehe Parse-Informationen für Dokument vorbereiten für zwei Arbeitsmuster.Ausgabe
| Feld | Typ | Was es enthält |
|---|---|---|
fileName | String | Generated output filename with timestamp and extension matching Output Format (.json / .xml / .csv). |
mimeType | String | MIME type of the output (application/json, application/xml, text/csv). |
fileSize | Number | Size of the parsed output in bytes. |
success | Boolean | true on a successful parse, false otherwise. Wire into an IF node for branching. |
message | String | Status message. Document parsed successfully on the happy path, or a descriptive error. |
docName | String | Original input filename, preserved for audit trails. |
Die geparsten Schlüssel/Wert-Daten selbst befinden sich in dem von Ihnen benannten Binärfeld. Name des binären AusgabefeldsDie
Workflow-Beispiele
Gängige n8n-Workflow-MusterTypical ways to chain Parse Document into an n8n workflow.
- Der Gmail-Trigger wird bei neuen Rechnungen mit der Bezeichnung „Lieferantenrechnung“ ausgelöst.
- Der Filter lässt nur Anhänge mit der Endung .pdf durch.
- Parse Document wendet die Rechnungsvorlage auf den binären Anhang an.
- Knotenzuordnungen analysiert invoiceNumber, totalAmount, invoiceDateDie
- Postgres Insert schreibt die Zeile in die Tabelle accounts_payable.
- Der Webhook empfängt eine PDF von einem Partner-Upload-Portal.
- Parse Document führt eine Vorlage mit einem JavaScript Der Ausdrucksschlüssel gibt den Dokumenttyp zurück.
- Routen der Knoten werden anhand des zurückgegebenen Typs (Rechnung / Bestellung / Quittung) zu typspezifischen nachgelagerten Zweigen umgeleitet.
- Jeder Zweig sendet die analysierten Felder an das richtige Zielsystem.
- Der Zeitplan-Trigger wird alle 15 Minuten ausgelöst.
- S3 List + Get Object lädt jedes neue PDF im Eingangs-Bucket.
- Parse Document wendet die Vorlage auf jedes Binärelement an.
- Airtable Create Record schreibt die analysierten Felder in die Tracking-Datenbank.