KI - Dokumentenparser in n8n
Was dieser Knoten bewirkt
PDF4me KI-Dokumentenparser extrahiert strukturierte Daten aus beliebigen Dokumenten durch Ausführen eines gespeicherten AI Analysator von Ihrem PDF4me Das Konto wird der Datei zugeordnet. Im Gegensatz zu festen Parsern (AI-Rechnungsparser, AI-Vertragsverarbeitung) wählen Sie den Parser aus. AI Analysator-ID aus einer Dropdown-Liste von Analysetools, die in der PDF4me Das Dashboard ermöglicht es, dass derselbe Knoten Rechnungen, Bestellungen, Quittungen, benutzerdefinierte Formulare, Laborberichte, interne Vorlagen und alles, was Sie in einem Schema beschreiben, verarbeitet. Verwenden Sie ein Parse Analysator für ein einzelnes Schema oder ein Klassifizieren Analysator für viele Dokumentvarianten in einem Aufruf. Gibt dynamische Werte zurück. JSON indiziert durch Ihr Schema plus ein _metadata Block, keine Binärdatei.
Musterrechnung für Testzwecke
Verwenden Sie diese Beispielrechnung eines Lieferanten, um die vollständige Funktionsfähigkeit des Knotens zu bestätigen, bevor Sie Ihren Workflow auf Live-Daten ausrichten. Ordnen Sie sie als Binäreingabe zu und wählen Sie sie aus. default_invoice_extraction als die AI Analysator-IDDie
Authentifizierung Ihres API Anfrage
Jeder PDF4me Knoten in n8n erfordert eine gültige Anmeldeinformationen zum Verbinden mitErstellen oder wählen Sie einen Eintrag aus, der Ihre Daten enthält. PDF4me API Schlüssel, damit der Workflow authentifiziert werden kann AI Sichere Extraktionsanfragen. Dieselbe Anmeldeinformation wird auch für die AI Analysator-ID Dropdown-Menü über GetAnalyzerId APIDie
Richten Sie zuerst Ihren Analysator ein.
- Analysatorliste (Schritte 1–2):
https://dev.pdf4me.com/dashboard/#/ai-document-parser/ - Analysator-Details (Schritte 3–5):
https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>
Wichtige Fakten, die Sie nicht verpassen sollten
_metadata Dem Objekt werden stets Erfolg, Nachricht, Zeitstempel, Quelldateiname, Analysetool-ID und Operation angehängt. Es gibt keine Name des binären AusgabefeldsDie
Vollständiges Knotenpanel: Extrahieren → AI Dokumentenparser mit Binärdateneingabe. Wählen Sie einen AI Analysator-ID vor dem Laufen.
Parameter
- Analysatorliste (Schritte 1–2):
https://dev.pdf4me.com/dashboard/#/ai-document-parser/ - Analysator-Details (Schritte 3–5):
https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>
Erforderlich in der n8n Benutzeroberfläche: Anmeldeinformationen für die Verbindung, Eingabedatentyp, Dokumentname, AI Die Analyse-ID. Bedingte Pflichtfelder (binäres Eingabefeld, Base64-Dokumentinhalt oder Dokument-URL) werden nur angezeigt, wenn der entsprechende Eingabedatentyp ausgewählt ist. Es gibt keine Name des binären Ausgabefelds und nein Erweiterte Optionen / Benutzerdefinierte Profile bei dieser Operation.
| Parameter | Erforderlich | Was es tut | Beispiel |
|---|---|---|---|
| Input Data Type | Yes | How the document is supplied. Binary Data reads from a previous node (default, most common). Base64 String accepts an encoded document. URL downloads the document from a public link. | Binary Data |
| Input Binary Field | Conditional | Name of the binary property on the incoming n8n item that holds the document. Required when Input Data Type is Binary Data. Defaults to data. Error reports which property was missing when the name is wrong. | data |
| Base64 Document Content | Conditional | Base64-encoded document. Required when Input Data Type is Base64 String. Data-URL style prefixes (text before the comma) are stripped automatically. | JVBERi0xLjQK... |
| Document URL | Conditional | Publicly reachable HTTPS URL to the document. Required when Input Data Type is URL. Must be a valid full URL. | https://example.com/document.pdf |
| Document Name | Yes | Filename used by PDF4me for processing. Default document.pdf. With Binary Data, the uploaded file name is used for upload but your explicit Document Name value takes precedence in the API call when set. Use a real extension (.pdf, .png, .jpg, etc.) so PDF4me handles the file correctly. | document.pdf |
| AI Analyzer Id | Yes | The saved Analyzer that controls extraction. Create Analyzers at https://dev.pdf4me.com/dashboard/#/ai-document-parser/ (+ Add), then edit schemas on https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>. Dropdown populated via GetAnalyzerId API. Sent as customisationNote. Pick Parse for one schema or Classify for many variants. | aaaa133 |
Optionen für den Eingabedatentyp
Wählen Sie aus, wie das Dokument in den Knoten gelangt. Die Folgefelder ändern sich je nach dieser Auswahl.

Eingabedatentyp. Binärdaten (Standard), Base64-Zeichenfolge oder URLDie
BinärdatenStandardwert: Datei vom vorherigen KnotenBinäres Eingabefeld zum Namen des Binärfelds (Standardwert) DatenDer Name der hochgeladenen Datei wird verwendet, sofern Sie den Dokumentnamen nicht überschreiben.Base64-ZeichenketteKodiertes Dokument inlineBase64-DokumentinhaltPräfixe im Data-URL-Stil (Text vor dem Komma) werden automatisch entfernt. Dokumentname mit der korrekten Erkennung des Erweiterungslaufwerkformats.URLVon einem öffentlichen Link herunterladenDokument-URLDie PDF4me Das Dokument wird direkt abgerufen. Der Dateiname für die Verarbeitung wird aus dem Dokument übernommen. URL Pfad, wenn möglich, oder vom Dokumentnamen.AI Dropdown-Liste für die Analysator-ID
Die Dropdown-Liste wird mit Ihren Daten gefüllt. PDF4me Konto über das GetAnalyzerId API Wenn Sie das Feld öffnen. Jede Option ist ein Analyzer, den Sie in der Datei gespeichert haben. PDF4me Dashboard. Wählen Sie das Dashboard aus, dessen Schema dem Dokumenttyp entspricht, den Sie verarbeiten.

AI Die Dropdown-Liste „Analyzer-ID“ wurde von Ihrem System geladen. PDF4me Konto.
Feldtyp: "Tabelle" für verschachtelte Zeilen und Feldmethode (Standardwert extrahieren, zum Ableiten/Normalisieren generieren).Leeres Dropdown-Menü? Der Knoten zeigt "GetAnalyzerId hat keine Analyseoptionen zurückgegeben" wenn Ihr Konto keine Analysatoren enthält oder wenn die Anmeldeinformationen nicht erreichbar sind APIÖffnen Sie die Analysatorliste und fügen Sie mindestens einen Analysator hinzu Analysatordetails Seite, dann überprüfen Sie die API Schlüssel in Ihrem n8n Berechtigungsnachweis.
Ausgabefelder
Ein erfolgreicher Lauf bringt eins zurück n8n Artikel mit JSON Nur, keine Binärdatei. Die Schlüssel der obersten Ebene entsprechen Ihrem Analyzer-Schema; ein _metadata Das Objekt wird immer angehängt.
| Feld | Typ | Was es enthält |
|---|---|---|
Top-level extracted fields | Dynamic | One key per field defined in your Analyzer schema (string, number, date, or nested table rows). Names match fieldName exactly. |
_metadata.success | Boolean | true on a successful parse. |
_metadata.message | String | "Document parsed successfully using AI Document Parser". |
_metadata.processingTimestamp | String | ISO timestamp of the parse. |
_metadata.sourceFileName | String | Document name used for processing. |
_metadata.aiAnalyzerId | String | The Analyzer Id you selected (sent as customisationNote to the API). |
_metadata.operation | String | "aiDocumentParser". |
rawContent (fallback only) | String | If the API returns plain text instead of JSON and parsing fails, the node wraps the response as { "rawContent": "<api response string>" } at the top level. |
Schnellkonfiguration
- Erstellen Sie zuerst Ihren Analysator. Öffnen Sie die Analysatorliste, klicken + HinzufügenGeben Sie eine eindeutige Analyzer-ID ein, wählen Sie Parse oder KlassifizierenSpeichern Sie die Zeile und fügen Sie dann ein Dokumentschema hinzu. Analysatordetails Seite. Siehe die Parse-Einrichtungsanleitung oder Einrichtungsleitfaden für die Klassifizierung für vollständige Schemaregeln, einschließlich
fieldType: "table"für verschachtelte Zeilen undfieldMethod(extrahieren oder generieren). - In Ihrem n8n Workflow, klicken + und suchen Sie nach PDF4me. Satz Ressource Zu Extrakt Und Extraktionsbetriebe Zu KI-DokumentenparserDie
- In Anmeldeinformationen zum Verbinden mit, wählen Sie Ihre PDF4me Anmeldeinformationen oder fügen Sie eine ein API Schlüssel.
- Satz EingabedatentypBinärdaten (Standard) werden von einem vorherigen Knoten gelesen und sind am gebräuchlichsten.
- Füllen Sie das entsprechende Eingabefeld aus (Binäres Eingabefeld, Base64-Dokumentinhalt, oder Dokument-URL).
- Dokumentname. Überschreiben Sie die Standardeinstellung
document.pdfUm den tatsächlichen Dateinamen mit der richtigen Dateiendung zu verwenden. - Wähle einen AI Analysator-ID aus dem Dropdown-Menü (geladen aus Ihrem Konto).
- Führe den Knoten aus. Das Ausgabeelement enthält die analysierten Felder auf oberster Ebene plus
_metadataWeiterleitung an Set, Code, Google Sheets, Airtable, eine Datenbank, eine E-Mail oder einen beliebigen nachgelagerten Knoten.
Typische Konfigurationen
Workflow-BeispieleCommon n8n workflow patterns using AI Document Parser.
- Der E-Mail-Trigger (IMAP) wird bei einer neuen Nachricht ausgelöst mit PDF Anhang.
- AI Der Dokumentenparser wird mit dem Eingabedatentyp Binärdaten ausgeführt, wobei der Dokumentname auf den Namen der Anhangsdatei festgelegt ist. AI Analyzer-ID auf Ihren Wert eingestellt
RechnungsparserAnalysator. - Google Tabellen Anhängen Schreibt Rechnungsnummer, Lieferantenname, Gesamtbetrag und Fälligkeitsdatum in den Kreditoren-Tracker.
- Der überwachte Ordner empfängt gemischte PDFs von Kunde ABC, Kunde XYZ und einem Long Tail.
- AI Der Dokumentenparser ist auf eine Klassifizierungsanalysator-ID eingestellt (ein Schema pro Anbieter).
- Ein Switch-Knoten verzweigt sich anhand des übereinstimmenden Klassifizierungsnamens, der in der Antwort zurückgegeben wird, und sendet jedes Ergebnis an die entsprechende nachgelagerte Tabelle.
- Webhook empfängt einen Dokumentenlink von Ihrem Portal.
- AI Der Dokumentenparser wird mit dem Eingabedatentyp ausgeführt URL und Ihre benutzerdefinierte Formular-Analyzer-ID.
- Ausgabe JSON wird einem Dataverse-/Airtable-/Postgres-Schreibvorgang zugeordnet, um einen neuen Datensatz zu erstellen.
- Die Scannerausgabe landet in einem Ordner mit breiten Rändern.
- KI-gesteuerte automatische Dokumentenzuschnittfunktion (Ressource) AI) schneidet die Ränder ab.
- AI Der Document Parser wird auf der zugeschnittenen Binärdatei mit der passenden Analyzer-ID ausgeführt.
- Analysiert JSON Der Fluss fließt flussabwärts wie gewohnt.
- AI Der Dokumentenparser gibt die strukturierten Felder zurück.
- Ein Code-Knoten prüft Pflichtfelder und wendet Geschäftsregeln an.
- Wenn gültig, ein HTTP Die Anfrage wird mit Lieferantendaten aus Ihrem CRM angereichert; falls dies nicht der Fall ist, wird eine Benachrichtigung an Slack zur manuellen Überprüfung gesendet.
Praktische Tipps
Fehlerbehebung
Wählen Sie vor dem Ausführen einen Analysator aus der Dropdown-Liste aus. Das Feld darf nicht leer bleiben.
Ausrichten Binäres Eingabefeld mit dem vorherigen Knoten (oft DatenDie Fehlermeldung gibt an, welche Eigenschaft fehlte.
Die Base64-Datei ist leer oder fehlt. Geben Sie im entsprechenden Feld „Eingabedatentyp“ Inhalte an.
Überprüfen Dokument-URL ist ein vollständiges, gültiges URL (Schema + Host + Pfad).
Es sind keine Analysatoren für das Konto vorhanden oder es liegt ein Problem mit den Anmeldeinformationen vor. Erstellen Sie einen Analysator im PDF4me Dashboard oder überprüfen Sie das API Schlüssel im n8n Berechtigungsnachweis.
Spickzettel
| Feld | Wert |
|---|---|
| Resource | Extract |
| Operation | AI Document Parser |
| Input Data Type | Binary Data |
| Input Binary Field | data |
| Document Name | form.pdf (with the real extension) |
| AI Analyzer Id | (pick from the dropdown loaded from your account) |
| Credentials | PDF4me API credential |
Häufig gestellte Fragen
Verwandte Aktionen
Dieselbe Aufgabe auf anderen Plattformen
/v2/FlowV2/AiDocumentParser für benutzerdefinierten Backend-Code oder Postman-Tests.