Zum Hauptinhalt springen

KI - Dokumentenparser in n8n

Was dieser Knoten bewirkt

PDF4me KI-Dokumentenparser extrahiert strukturierte Daten aus beliebigen Dokumenten durch Ausführen eines gespeicherten AI Analysator von Ihrem PDF4me Das Konto wird der Datei zugeordnet. Im Gegensatz zu festen Parsern (AI-Rechnungsparser, AI-Vertragsverarbeitung) wählen Sie den Parser aus. AI Analysator-ID aus einer Dropdown-Liste von Analysetools, die in der PDF4me Das Dashboard ermöglicht es, dass derselbe Knoten Rechnungen, Bestellungen, Quittungen, benutzerdefinierte Formulare, Laborberichte, interne Vorlagen und alles, was Sie in einem Schema beschreiben, verarbeitet. Verwenden Sie ein Parse Analysator für ein einzelnes Schema oder ein Klassifizieren Analysator für viele Dokumentvarianten in einem Aufruf. Gibt dynamische Werte zurück. JSON indiziert durch Ihr Schema plus ein _metadata Block, keine Binärdatei.

Verwandte Blog-Beiträge
Zu dieser Funktion gibt es noch keinen Blogbeitrag – folgt in Kürze.
Schauen Sie sich in der Zwischenzeit im PDF4me-Blog Tutorials und Arbeitsabläufe für alle Plattformen an.
Besuchen Sie den Blog

Musterrechnung für Testzwecke

Verwenden Sie diese Beispielrechnung eines Lieferanten, um die vollständige Funktionsfähigkeit des Knotens zu bestätigen, bevor Sie Ihren Workflow auf Live-Daten ausrichten. Ordnen Sie sie als Binäreingabe zu und wählen Sie sie aus. default_invoice_extraction als die AI Analysator-IDDie

Authentifizierung Ihres API Anfrage

Jeder PDF4me Knoten in n8n erfordert eine gültige Anmeldeinformationen zum Verbinden mitErstellen oder wählen Sie einen Eintrag aus, der Ihre Daten enthält. PDF4me API Schlüssel, damit der Workflow authentifiziert werden kann AI Sichere Extraktionsanfragen. Dieselbe Anmeldeinformation wird auch für die AI Analysator-ID Dropdown-Menü über GetAnalyzerId APIDie

Richten Sie zuerst Ihren Analysator ein.

Dashboard-URLs, die Sie in dieser Anleitung verwenden werden:
Erstellen Sie zunächst Ihren Analyzer (erforderlich für jede Plattform)
AI – Document Parser führt einen gespeicherten Analyzer aus dem PDF4me-Entwickler-Dashboard aus. Wählen Sie „Parse“ für ein Dokumentschema oder „Classify“, um mehrere Varianten (Kunde ABC, Kunde XYZ, allgemeine Rechnung) in einem einzigen Aufruf weiterzuleiten. Dieselbe Analyzer-ID funktioniert in Make, Zapier, Power Automate, n8n und der REST-API.

Wichtige Fakten, die Sie nicht verpassen sollten

Sie haben den Analyzer im Dashboard eingerichtet, der Knoten verweist lediglich darauf.
Schema, Felder und Eingabeaufforderungen einmalig definieren Analysatorliste Und Analysatordetails Seiten (Parsen für ein Schema, Klassifizieren für viele Varianten). Die n8n Der Knoten lädt Ihre Analysatoren in den AI Analysator-ID Das Dropdown-Menü führt die von Ihnen ausgewählte Option aus. Eine spätere Bearbeitung des Schemas erfordert keine Änderung des Workflows.
Die Ausgabe ist dynamisch. JSON, keine Binärdatei
Die Schlüssel der obersten Ebene entsprechen den Feldnamen, die Sie im Analyzer definiert haben (Zeichenfolge, Zahl, Datum oder Tabellenzeilen). _metadata Dem Objekt werden stets Erfolg, Nachricht, Zeitstempel, Quelldateiname, Analysetool-ID und Operation angehängt. Es gibt keine Name des binären AusgabefeldsDie
Die Entscheidung, ob Parsen oder Klassifizieren erfolgt, wird vom Analysator und nicht vom Knoten getroffen.
Gleicher Knoten, zwei Analysemodi. A Parse Der Analyzer gibt die Felder aus seinem einzigen Schema zurück. Klassifizieren Der Analyzer leitet das Dokument an das am besten passende Schema weiter und gibt dessen Klassifizierungsnamen zurück. Plus Die extrahierten Felder des übereinstimmenden Schemas. Das Verhalten kann durch Ändern der ID angepasst werden.
Der Knoten „AI Document Parser n8n“ zeigt „Credential Pdf4me“, „Resource Extract“, „Extract Operations AI Document Parser“, „Input Data Type Binary Data“, „Input Binary Field data“, „Document Name document.pdf“ und die Dropdown-Liste „AI Analyzer Id“ (nicht gesetzt) an (bei Bedarf hervorgehoben).

Vollständiges Knotenpanel: Extrahieren → AI Dokumentenparser mit Binärdateneingabe. Wählen Sie einen AI Analysator-ID vor dem Laufen.

Parameter

Dashboard-URLs, die Sie in dieser Anleitung verwenden werden:

Erforderlich in der n8n Benutzeroberfläche: Anmeldeinformationen für die Verbindung, Eingabedatentyp, Dokumentname, AI Die Analyse-ID. Bedingte Pflichtfelder (binäres Eingabefeld, Base64-Dokumentinhalt oder Dokument-URL) werden nur angezeigt, wenn der entsprechende Eingabedatentyp ausgewählt ist. Es gibt keine Name des binären Ausgabefelds und nein Erweiterte Optionen / Benutzerdefinierte Profile bei dieser Operation.

ParameterErforderlichWas es tutBeispiel
Input Data TypeYesHow the document is supplied. Binary Data reads from a previous node (default, most common). Base64 String accepts an encoded document. URL downloads the document from a public link.Binary Data
Input Binary FieldConditionalName of the binary property on the incoming n8n item that holds the document. Required when Input Data Type is Binary Data. Defaults to data. Error reports which property was missing when the name is wrong.data
Base64 Document ContentConditionalBase64-encoded document. Required when Input Data Type is Base64 String. Data-URL style prefixes (text before the comma) are stripped automatically.JVBERi0xLjQK...
Document URLConditionalPublicly reachable HTTPS URL to the document. Required when Input Data Type is URL. Must be a valid full URL.https://example.com/document.pdf
Document NameYesFilename used by PDF4me for processing. Default document.pdf. With Binary Data, the uploaded file name is used for upload but your explicit Document Name value takes precedence in the API call when set. Use a real extension (.pdf, .png, .jpg, etc.) so PDF4me handles the file correctly.document.pdf
AI Analyzer IdYesThe saved Analyzer that controls extraction. Create Analyzers at https://dev.pdf4me.com/dashboard/#/ai-document-parser/ (+ Add), then edit schemas on https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>. Dropdown populated via GetAnalyzerId API. Sent as customisationNote. Pick Parse for one schema or Classify for many variants.aaaa133

Optionen für den Eingabedatentyp

Wählen Sie aus, wie das Dokument in den Knoten gelangt. Die Folgefelder ändern sich je nach dieser Auswahl.

Das Dropdown-Menü „Eingabedatentyp“ im Knoten „n8n PDF4me AI Document Parser“ bietet drei Optionen: Binärdaten (hervorgehoben mit Beschreibung): Dokumentdatei aus dem vorherigen Knoten verwenden; Base64-Zeichenkette (mit Beschreibung): Dokumentinhalt als Base64-kodierte Zeichenkette bereitstellen; URL (mit Beschreibung): URL zur Dokumentdatei bereitstellen

Eingabedatentyp. Binärdaten (Standard), Base64-Zeichenfolge oder URLDie

BinärdatenStandardwert: Datei vom vorherigen Knoten
Liest das Dokument direkt von einem vorherigen Knoten, z. B. von Google Drive Download, HTTP Anfrage, Lesen einer Binärdatei oder eines E-Mail-Anhangs. Festlegen Binäres Eingabefeld zum Namen des Binärfelds (Standardwert) DatenDer Name der hochgeladenen Datei wird verwendet, sofern Sie den Dokumentnamen nicht überschreiben.
Base64-ZeichenketteKodiertes Dokument inline
Fügen Sie eine Base64-Zeichenkette ein oder ordnen Sie sie zu in Base64-DokumentinhaltPräfixe im Data-URL-Stil (Text vor dem Komma) werden automatisch entfernt. Dokumentname mit der korrekten Erkennung des Erweiterungslaufwerkformats.
URLVon einem öffentlichen Link herunterladen
Stellen Sie eine öffentliche HTTPS URL In Dokument-URLDie PDF4me Das Dokument wird direkt abgerufen. Der Dateiname für die Verarbeitung wird aus dem Dokument übernommen. URL Pfad, wenn möglich, oder vom Dokumentnamen.

AI Dropdown-Liste für die Analysator-ID

Die Dropdown-Liste wird mit Ihren Daten gefüllt. PDF4me Konto über das GetAnalyzerId API Wenn Sie das Feld öffnen. Jede Option ist ein Analyzer, den Sie in der Datei gespeichert haben. PDF4me Dashboard. Wählen Sie das Dashboard aus, dessen Schema dem Dokumenttyp entspricht, den Sie verarbeiten.

Das Dropdown-Menü „AI Analyzer Id“ ist im n8n PDF4me AI Document Parser-Knoten geöffnet und zeigt drei Beispieloptionen für den Analyzer an: aaaa133, TestTenantProject, TestTenant

AI Die Dropdown-Liste „Analyzer-ID“ wurde von Ihrem System geladen. PDF4me Konto.

Parse Analyzer
Ein Dokumentschema. Der Knoten gibt genau die in diesem Schema definierten Felder zurück. Optimal, wenn alle verarbeiteten Dokumente dasselbe Layout aufweisen. Siehe … Parse-Einrichtungsanleitung für Schemaregeln einschließlich Feldtyp: "Tabelle" für verschachtelte Zeilen und Feldmethode (Standardwert extrahieren, zum Ableiten/Normalisieren generieren).
Klassifizierungsanalysator
Viele Schemas, eines pro Dokumentvariante. AI Das eingehende Dokument wird anhand der Klassifizierungsabfrage des jeweiligen Schemas an das am besten passende Schema weitergeleitet. Anschließend wird der entsprechende Klassifizierungsname zusammen mit seinen Feldern zurückgegeben. Siehe die Einrichtungsleitfaden für die KlassifizierungDie

Leeres Dropdown-Menü? Der Knoten zeigt "GetAnalyzerId hat keine Analyseoptionen zurückgegeben" wenn Ihr Konto keine Analysatoren enthält oder wenn die Anmeldeinformationen nicht erreichbar sind APIÖffnen Sie die Analysatorliste und fügen Sie mindestens einen Analysator hinzu Analysatordetails Seite, dann überprüfen Sie die API Schlüssel in Ihrem n8n Berechtigungsnachweis.

Ausgabefelder

Ein erfolgreicher Lauf bringt eins zurück n8n Artikel mit JSON Nur, keine Binärdatei. Die Schlüssel der obersten Ebene entsprechen Ihrem Analyzer-Schema; ein _metadata Das Objekt wird immer angehängt.

FeldTypWas es enthält
Top-level extracted fieldsDynamicOne key per field defined in your Analyzer schema (string, number, date, or nested table rows). Names match fieldName exactly.
_metadata.successBooleantrue on a successful parse.
_metadata.messageString"Document parsed successfully using AI Document Parser".
_metadata.processingTimestampStringISO timestamp of the parse.
_metadata.sourceFileNameStringDocument name used for processing.
_metadata.aiAnalyzerIdStringThe Analyzer Id you selected (sent as customisationNote to the API).
_metadata.operationString"aiDocumentParser".
rawContent (fallback only)StringIf the API returns plain text instead of JSON and parsing fails, the node wraps the response as { "rawContent": "<api response string>" } at the top level.

Schnellkonfiguration

  1. Erstellen Sie zuerst Ihren Analysator. Öffnen Sie die Analysatorliste, klicken + HinzufügenGeben Sie eine eindeutige Analyzer-ID ein, wählen Sie Parse oder KlassifizierenSpeichern Sie die Zeile und fügen Sie dann ein Dokumentschema hinzu. Analysatordetails Seite. Siehe die Parse-Einrichtungsanleitung oder Einrichtungsleitfaden für die Klassifizierung für vollständige Schemaregeln, einschließlich fieldType: "table" für verschachtelte Zeilen und fieldMethod (extrahieren oder generieren).
  2. In Ihrem n8n Workflow, klicken + und suchen Sie nach PDF4me. Satz Ressource Zu Extrakt Und Extraktionsbetriebe Zu KI-DokumentenparserDie
  3. In Anmeldeinformationen zum Verbinden mit, wählen Sie Ihre PDF4me Anmeldeinformationen oder fügen Sie eine ein API Schlüssel.
  4. Satz EingabedatentypBinärdaten (Standard) werden von einem vorherigen Knoten gelesen und sind am gebräuchlichsten.
  5. Füllen Sie das entsprechende Eingabefeld aus (Binäres Eingabefeld, Base64-Dokumentinhalt, oder Dokument-URL).
  6. Dokumentname. Überschreiben Sie die Standardeinstellung document.pdf Um den tatsächlichen Dateinamen mit der richtigen Dateiendung zu verwenden.
  7. Wähle einen AI Analysator-ID aus dem Dropdown-Menü (geladen aus Ihrem Konto).
  8. Führe den Knoten aus. Das Ausgabeelement enthält die analysierten Felder auf oberster Ebene plus _metadataWeiterleitung an Set, Code, Google Sheets, Airtable, eine Datenbank, eine E-Mail oder einen beliebigen nachgelagerten Knoten.

Typische Konfigurationen

Workflow-BeispieleCommon n8n workflow patterns using AI Document Parser.
E-Mail-Anhang zu Google Sheets
  1. Der E-Mail-Trigger (IMAP) wird bei einer neuen Nachricht ausgelöst mit PDF Anhang.
  2. AI Der Dokumentenparser wird mit dem Eingabedatentyp Binärdaten ausgeführt, wobei der Dokumentname auf den Namen der Anhangsdatei festgelegt ist. AI Analyzer-ID auf Ihren Wert eingestellt Rechnungsparser Analysator.
  3. Google Tabellen Anhängen Schreibt Rechnungsnummer, Lieferantenname, Gesamtbetrag und Fälligkeitsdatum in den Kreditoren-Tracker.
Multi-Vendor-Posteingang mit Klassifizierung
  1. Der überwachte Ordner empfängt gemischte PDFs von Kunde ABC, Kunde XYZ und einem Long Tail.
  2. AI Der Dokumentenparser ist auf eine Klassifizierungsanalysator-ID eingestellt (ein Schema pro Anbieter).
  3. Ein Switch-Knoten verzweigt sich anhand des übereinstimmenden Klassifizierungsnamens, der in der Antwort zurückgegeben wird, und sendet jedes Ergebnis an die entsprechende nachgelagerte Tabelle.
Gehostetes Dokument von URL
  1. Webhook empfängt einen Dokumentenlink von Ihrem Portal.
  2. AI Der Dokumentenparser wird mit dem Eingabedatentyp ausgeführt URL und Ihre benutzerdefinierte Formular-Analyzer-ID.
  3. Ausgabe JSON wird einem Dataverse-/Airtable-/Postgres-Schreibvorgang zugeordnet, um einen neuen Datensatz zu erstellen.
Scannen, automatisch zuschneiden, dann analysieren
  1. Die Scannerausgabe landet in einem Ordner mit breiten Rändern.
  2. KI-gesteuerte automatische Dokumentenzuschnittfunktion (Ressource) AI) schneidet die Ränder ab.
  3. AI Der Document Parser wird auf der zugeschnittenen Binärdatei mit der passenden Analyzer-ID ausgeführt.
  4. Analysiert JSON Der Fluss fließt flussabwärts wie gewohnt.
Validieren und anschließend anreichern
  1. AI Der Dokumentenparser gibt die strukturierten Felder zurück.
  2. Ein Code-Knoten prüft Pflichtfelder und wendet Geschäftsregeln an.
  3. Wenn gültig, ein HTTP Die Anfrage wird mit Lieferantendaten aus Ihrem CRM angereichert; falls dies nicht der Fall ist, wird eine Benachrichtigung an Slack zur manuellen Überprüfung gesendet.

Praktische Tipps

Set up the Analyzer in PDF4me first
The node does not define extraction rules. It runs whatever your selected Analyzer specifies. Build it in the dashboard before configuring the node.
Use Document Name with the real extension
PDF4me uses the extension for format detection. Even on Binary Data, an explicit Document Name with the correct extension is safest.
No Output Binary Field Name and no Advanced Options
Unlike AI Auto Crop Document, this operation has neither. The output is JSON only; there is nothing to write back as a binary file.
Plain-text fallback wraps as rawContent
If the API returns plain text instead of JSON and parsing fails, the node wraps the response as { "rawContent": "<string>" } so the workflow does not break.
Combine with AI Auto Crop Document for scans
Scans with wide borders parse better after cropping. Chain AI Auto Crop Document (Resource AI) before this node.
Use AI-Invoice Parser / AI-Process Contract for built-in schemas
When you only need standard invoice or contract fields, the dedicated nodes are simpler. AI Document Parser shines when you have a custom schema.

Fehlerbehebung

"AI Die Analysator-ID ist erforderlich.

Wählen Sie vor dem Ausführen einen Analysator aus der Dropdown-Liste aus. Das Feld darf nicht leer bleiben.

"Es wurden keine Binärdaten in der Eigenschaft '…' gefunden."

Ausrichten Binäres Eingabefeld mit dem vorherigen Knoten (oft DatenDie Fehlermeldung gibt an, welche Eigenschaft fehlte.

"Dokumentinhalt ist erforderlich"

Die Base64-Datei ist leer oder fehlt. Geben Sie im entsprechenden Feld „Eingabedatentyp“ Inhalte an.

"Ungültig URL Format"

Überprüfen Dokument-URL ist ein vollständiges, gültiges URL (Schema + Host + Pfad).

"GetAnalyzerId hat keine Analyseoptionen zurückgegeben"

Es sind keine Analysatoren für das Konto vorhanden oder es liegt ein Problem mit den Anmeldeinformationen vor. Erstellen Sie einen Analysator im PDF4me Dashboard oder überprüfen Sie das API Schlüssel im n8n Berechtigungsnachweis.

Spickzettel

FeldWert
ResourceExtract
OperationAI Document Parser
Input Data TypeBinary Data
Input Binary Fielddata
Document Nameform.pdf (with the real extension)
AI Analyzer Id(pick from the dropdown loaded from your account)
CredentialsPDF4me API credential

Häufig gestellte Fragen

Where does the AI Analyzer Id list come from?+
The dropdown is populated from your PDF4me account via the GetAnalyzerId API. Each option is an Analyzer you created at https://dev.pdf4me.com/dashboard/#/ai-document-parser/ with schemas on https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>. The node sends the selected value as customisationNote to the AiDocumentParser API.
What does "GetAnalyzerId returned no analyzer options" mean?+
The account has no Analyzers configured, or the credentials cannot reach the GetAnalyzerId endpoint. Open https://dev.pdf4me.com/dashboard/#/ai-document-parser/ and create at least one Analyzer (Parse or Classify) on the Analyzer detail page, or verify the API key in your n8n credential.
How is this different from AI-Invoice Parser, AI-Process Contract, AI-Process Bank Cheque?+
Those nodes use fixed schemas tuned to those document types. AI Document Parser is schema-driven: it runs whatever Analyzer you select, so the same node handles invoices, purchase orders, receipts, custom forms, lab reports, anything you describe in a schema. Pick AI Document Parser whenever you need a custom layout or document type.
What shape does the output have?+
Top-level keys match the field names in your Analyzer schema (for example customerName, invoiceNumber, totalAmount, lineItems). Nested objects and table arrays follow the same shape you defined. A _metadata object is always appended with success, message, processingTimestamp, sourceFileName, aiAnalyzerId, and operation. No binary file is returned.
Does this work on scanned PDFs?+
Yes. The AI engine handles OCR internally, so scanned PDFs and image formats work the same as native PDFs. If borders are large, chain AI Auto Crop Document (Resource AI) before this node for cleaner extraction.
Can I change the Analyzer schema without rebuilding the workflow?+
Yes. The workflow only references the Analyzer Id. Edit the schema in the PDF4me dashboard and the next run picks up the new shape automatically. Output keys follow your latest schema, so any downstream Set / Code / Sheets nodes that assume specific keys may need updating after a breaking schema change.
Can I switch between Parse and Classify Analyzers without rewiring the node?+
Yes. Both Analyzer types are listed in the AI Analyzer Id dropdown. Pick a Classify Analyzer when you want one node to handle several document variants; pick a Parse Analyzer for a single fixed schema. The output shape adapts to whichever you choose.
What happens when the API returns plain text instead of JSON?+
The node tries to parse it; if parsing fails, the response is wrapped as { "rawContent": "<api response string>" } at the top level so the workflow does not break. Useful for inspecting unexpected responses during development.

Verwandte Aktionen

Dieselbe Aufgabe auf anderen Plattformen

Hilfe erhalten