Seiten extrahieren aus PDF In n8n
Seiten extrahieren aus PDF ist ein PDF4me Knotenaktion in n8n das baut ein neues PDF enthält nur die pages Sie können es verwenden, um beispielsweise eine Unterschriftenseite aus einem Vertrag zu extrahieren, ein einzelnes Kapitel aus einem Handbuch zu isolieren oder nachfolgenden Arbeitsschritten lediglich die Zusammenfassung zur Verfügung zu stellen. pages anstelle des gesamten Dokuments.
Was dieser Knoten bewirkt
PDF4me: Seiten extrahieren aus PDF nimmt ein PDF aus Binärdaten, ein Base64 Stringoder ein URL und gibt eine neue Datei zurück, die nur die pages benannt in SeitenzahlenDieses Feld umfasst die gesamte Aktion: Es akzeptiert einzelne Eingaben. pagesBindestrich-getrennte Bereiche, gemischte Listen und offene Bereiche, die sich bis zum Ende des Dokuments erstrecken, werden berücksichtigt. Da die Extraktion als Workflow-Schritt ausgeführt wird, gilt dieselbe Regel für jede Datei, die eingeht, ohne dass ein Editor geöffnet wurde.
Authentifizierung Ihres API Anfrage
Jeder PDF4me Knoten in n8n erfordert eine gültige Anmeldeinformationen zum Verbinden mitErstellen oder wählen Sie einen Eintrag aus, der Ihre Daten enthält. PDF4me API Schlüssel, damit der Workflow Extraktionsanfragen sicher authentifizieren kann.
Wichtige Fakten, die Sie nicht verpassen sollten
10- bedeutet Seite 10 bis zum Ende, sodass eine Einstellung für Dokumente unterschiedlicher Länge funktioniert.
PDF4me Seiten extrahieren aus PDF Parameterbereich in n8n
Seiten extrahieren vs. Aufteilen PDF
Beide Verfahren erzeugen kleinere Dokumente, beantworten aber unterschiedliche Fragen. Die Extraktion fragt, welches Verfahren… pages Sie möchten behalten; bei der Aufteilung geht es darum, wie das gesamte Dokument aufgeteilt werden soll.
| Frage | Seiten extrahieren aus PDF | Teilt PDF |
|---|---|---|
| How many files come back | One PDF holding the pages you listed | Several PDFs covering the whole document |
| What happens to unlisted pages | They are absent from the output | They still appear, in another output file |
| Typical use | Pull the signature page, one chapter, or a summary section | Break a bundle into per-invoice or per-section files |
| Driven by | An explicit page list you supply | A split rule such as page count, text, or barcode |
Aus welchen Parametern werden Seiten extrahiert? PDF Brauchen?
Erforderlich: Aktion, Eingabedatentyp, das Feld, das diesem Eingabetyp entspricht, Dokumentname und Seitenzahlen. Der Name des Ausgabefelds (binär) hat einen Standardwert. DatenDie erweiterten Optionen sind anfangs leer.
| Parameter | Erforderlich | Was es tut | Beispiel |
|---|---|---|---|
| Action | Required | Selects the PDF4me node action to run. Choose Extract Pages From PDF. | Extract Pages From PDF |
| Input Data Type | Required | Format of the source PDF input. Choose Binary Data (from a previous node), Base64 String, or URL. | Binary Data |
| Input Binary Field | Conditional | Name of the binary property on the incoming n8n item that holds the PDF. Required when Input Data Type is Binary Data. Defaults to data. | data |
| Base64 Document Content | Conditional | Base64-encoded content of the source PDF. Required when Input Data Type is Base64 String. | JVBERi0xLjQK... |
| File URL | Conditional | Publicly reachable HTTPS URL to the source PDF. Required when Input Data Type is URL. | https://example.com/report.pdf |
| Document Name | Required | Filename used for the document on the request, for reference and tracking. Include the .pdf extension. | output.pdf |
| Page Numbers | Required | The pages to keep. Accepts a comma-separated list, a hyphenated range, a mixed list, or an open range that runs to the end of the document. Pages are numbered from 1. | 1,3,5-8 |
| Output Binary Field Name | Optional | Name of the binary property the output item exposes. Defaults to data. | data |
| Advanced Options | Optional | A collection that starts empty, shown as No properties with an Add Option button. Leave it alone unless you have a specific option to add. | No properties |
So schreiben Sie das Seitenzahlenfeld
| Muster | Beispiel | Was kommt zurück |
|---|---|---|
| Single page | 5 | Just page 5, as a one page PDF. |
| Comma-separated list | 1,3,5 | Pages 1, 3, and 5 in one PDF, with pages 2 and 4 absent. |
| Hyphenated range | 2-5 | Pages 2, 3, 4, and 5, with both ends included. |
| Mixed list | 1,3,5-8 | Page 1, page 3, then the block from 5 to 8. |
| Open range | 10- | Page 10 through the last page, whatever the document length turns out to be. |
Ausgabefelder
Ein erfolgreicher Lauf bringt eins zurück n8n Gegenstand, der das extrahierte PDFDie
| Feld | Typ | Was es enthält |
|---|---|---|
Binary (data) | Binary | The extracted PDF, under Output Binary Field Name (default data). |
fileName | String | Generated filename of the extracted PDF. |
mimeType | String | MIME type of the output, always application/pdf. |
fileSize | Number | Size of the returned PDF in bytes. |
pagesExtracted | Number | How many pages ended up in the output. Compare it against the length of your requested list as a cheap sanity check. |
originalPageCount | Number | Page count of the source document before extraction. |
extractedPageNumbers | Array | The page numbers that were actually extracted, useful for verifying the result against what you asked for. |
success | Boolean | True when the extraction completed, false on failure. Use it to branch error handling. |
message | String | Human-readable status message, carrying success confirmation or error detail. |
Wie richte ich das Extrahieren von Seiten ein? PDF In n8n?
- Hinzufügen PDF4me zu Ihrem n8n Workflow und wählen Sie den Seiten extrahieren aus PDF Aktion.
- In Anmeldeinformationen zum Verbinden mit, wählen Sie Ihre PDF4me Anmeldeinformationen oder klicken Neue Anmeldeinformationen erstellen und fügen Sie Ihren ein API Schlüssel.
- Satz Eingabedatentyp Zu Binärdaten (Standard), Base64 String, oder URL und die passende Quelle bereitstellen PDF Feld.
- Satz Dokumentname für die Quelldatei, einschließlich der
.pdfVerlängerung. - Eingeben Seitenzahlen unter Verwendung einer Liste, eines Bereichs, einer gemischten Liste oder eines offenen Bereichs.
- Verlassen Name des Binärfelds der Ausgabe als
dataes sei denn, ein späterer Knoten erwartet eine andere Eigenschaft. - Führe den Knoten aus und leite die zurückgegebenen Daten weiter. PDF zum nächsten Schritt, wie z. B. Speicherung, E-Mail oder einer Überprüfungswarteschlange.
Typische Konfigurationen
Workflow-BeispieleCommon n8n workflow patterns using Extract Pages From PDF.
- Der unterzeichnete Vertrag wird als E-Mail-Anhang zugestellt.
- Seiten extrahieren aus PDF nimmt die letzte Seite unter Verwendung eines offenen Bereichs.
- Die einzelne Seite wird zur schnellen Orientierung im Kundendatensatz abgelegt.
- Es wird regelmäßig ein ausführlicher Bericht erstellt.
- Seiten extrahieren aus PDF behält die ersten paar pages mit einer Bandbreite wie
1-3Die - Die Gutachter erhalten die Zusammenfassung, der vollständige Bericht wird archiviert.
- Eine Supportanfrage bezieht sich auf einen Abschnitt des Produkthandbuchs.
- Seiten extrahieren aus PDF zieht dieses Kapitel mit einem Bindestrichbereich.
- Der Kunde erhält die relevanten Informationen. pages anstelle eines großen Anbauteils.
- Mehrere Quelldokumente enthalten jeweils eine Seite, die es wert ist, aufbewahrt zu werden.
- Seiten extrahieren aus PDF Für jedes Dokument wird ein Vorgang ausgeführt, um die jeweilige Seite abzurufen.
- Mehrere zusammenführen PDFs Die Ergebnisse werden zu einem einzigen Digest zusammengefasst.
Praktische Tipps
Spickzettel
| Feld | Wert |
|---|---|
| Action | Extract Pages From PDF |
| Input Data Type | Binary Data |
| Input Binary Field | data |
| Document Name | output.pdf |
| Page Numbers | 1,3,5-8 |
| Output Binary Field Name | data |
| Advanced Options | No properties |
| Credentials | PDF4me API credential |