Zum Hauptinhalt springen

Seiten extrahieren aus PDF In n8n

Seiten extrahieren aus PDF ist ein PDF4me Knotenaktion in n8n das baut ein neues PDF enthält nur die pages Sie können es verwenden, um beispielsweise eine Unterschriftenseite aus einem Vertrag zu extrahieren, ein einzelnes Kapitel aus einem Handbuch zu isolieren oder nachfolgenden Arbeitsschritten lediglich die Zusammenfassung zur Verfügung zu stellen. pages anstelle des gesamten Dokuments.

Was dieser Knoten bewirkt

PDF4me: Seiten extrahieren aus PDF nimmt ein PDF aus Binärdaten, ein Base64 Stringoder ein URL und gibt eine neue Datei zurück, die nur die pages benannt in SeitenzahlenDieses Feld umfasst die gesamte Aktion: Es akzeptiert einzelne Eingaben. pagesBindestrich-getrennte Bereiche, gemischte Listen und offene Bereiche, die sich bis zum Ende des Dokuments erstrecken, werden berücksichtigt. Da die Extraktion als Workflow-Schritt ausgeführt wird, gilt dieselbe Regel für jede Datei, die eingeht, ohne dass ein Editor geöffnet wurde.

Verwandte Blog-Beiträge
Zu dieser Funktion gibt es noch keinen Blogbeitrag – folgt in Kürze.
Schauen Sie sich in der Zwischenzeit im PDF4me-Blog Tutorials und Arbeitsabläufe für alle Plattformen an.
Besuchen Sie den Blog

Authentifizierung Ihres API Anfrage

Jeder PDF4me Knoten in n8n erfordert eine gültige Anmeldeinformationen zum Verbinden mitErstellen oder wählen Sie einen Eintrag aus, der Ihre Daten enthält. PDF4me API Schlüssel, damit der Workflow Extraktionsanfragen sicher authentifizieren kann.

Wichtige Fakten, die Sie nicht verpassen sollten

Seitenzahlen sind das einzige relevante Feld.
Es ist erforderlich und wird validiert. Lassen Sie es leer und n8n Das Feld wird markiert, bevor der Knoten ausgeführt wird.
Offene Bereiche verarbeiten variable Seitenzahlen
Schreiben 10- bedeutet Seite 10 bis zum Ende, sodass eine Einstellung für Dokumente unterschiedlicher Länge funktioniert.
Die Seiten sind ab 1 nummeriert.
Die erste Seite ist 1, nicht 0. Achten Sie darauf, wenn ein vorheriger Code-Knoten die Seitenliste programmatisch generiert.
Der PDF4me-Knoten in n8n ist wie folgt konfiguriert: Aktion „Seiten aus PDF extrahieren“, Eingabedatentyp „Binärdaten“, Eingabe-Binärfeld „data“, Dokumentname „output.pdf“, ein leeres Pflichtfeld für Seitenzahlen und Ausgabe-Binärfeldname „data“.

PDF4me Seiten extrahieren aus PDF Parameterbereich in n8n

Seiten extrahieren vs. Aufteilen PDF

Beide Verfahren erzeugen kleinere Dokumente, beantworten aber unterschiedliche Fragen. Die Extraktion fragt, welches Verfahren… pages Sie möchten behalten; bei der Aufteilung geht es darum, wie das gesamte Dokument aufgeteilt werden soll.

FrageSeiten extrahieren aus PDFTeilt PDF
How many files come backOne PDF holding the pages you listedSeveral PDFs covering the whole document
What happens to unlisted pagesThey are absent from the outputThey still appear, in another output file
Typical usePull the signature page, one chapter, or a summary sectionBreak a bundle into per-invoice or per-section files
Driven byAn explicit page list you supplyA split rule such as page count, text, or barcode

Aus welchen Parametern werden Seiten extrahiert? PDF Brauchen?

Erforderlich: Aktion, Eingabedatentyp, das Feld, das diesem Eingabetyp entspricht, Dokumentname und Seitenzahlen. Der Name des Ausgabefelds (binär) hat einen Standardwert. DatenDie erweiterten Optionen sind anfangs leer.

ParameterErforderlichWas es tutBeispiel
ActionRequiredSelects the PDF4me node action to run. Choose Extract Pages From PDF.Extract Pages From PDF
Input Data TypeRequiredFormat of the source PDF input. Choose Binary Data (from a previous node), Base64 String, or URL.Binary Data
Input Binary FieldConditionalName of the binary property on the incoming n8n item that holds the PDF. Required when Input Data Type is Binary Data. Defaults to data.data
Base64 Document ContentConditionalBase64-encoded content of the source PDF. Required when Input Data Type is Base64 String.JVBERi0xLjQK...
File URLConditionalPublicly reachable HTTPS URL to the source PDF. Required when Input Data Type is URL.https://example.com/report.pdf
Document NameRequiredFilename used for the document on the request, for reference and tracking. Include the .pdf extension.output.pdf
Page NumbersRequiredThe pages to keep. Accepts a comma-separated list, a hyphenated range, a mixed list, or an open range that runs to the end of the document. Pages are numbered from 1.1,3,5-8
Output Binary Field NameOptionalName of the binary property the output item exposes. Defaults to data.data
Advanced OptionsOptionalA collection that starts empty, shown as No properties with an Add Option button. Leave it alone unless you have a specific option to add.No properties

So schreiben Sie das Seitenzahlenfeld

MusterBeispielWas kommt zurück
Single page5Just page 5, as a one page PDF.
Comma-separated list1,3,5Pages 1, 3, and 5 in one PDF, with pages 2 and 4 absent.
Hyphenated range2-5Pages 2, 3, 4, and 5, with both ends included.
Mixed list1,3,5-8Page 1, page 3, then the block from 5 to 8.
Open range10-Page 10 through the last page, whatever the document length turns out to be.

Ausgabefelder

Ein erfolgreicher Lauf bringt eins zurück n8n Gegenstand, der das extrahierte PDFDie

FeldTypWas es enthält
Binary (data)BinaryThe extracted PDF, under Output Binary Field Name (default data).
fileNameStringGenerated filename of the extracted PDF.
mimeTypeStringMIME type of the output, always application/pdf.
fileSizeNumberSize of the returned PDF in bytes.
pagesExtractedNumberHow many pages ended up in the output. Compare it against the length of your requested list as a cheap sanity check.
originalPageCountNumberPage count of the source document before extraction.
extractedPageNumbersArrayThe page numbers that were actually extracted, useful for verifying the result against what you asked for.
successBooleanTrue when the extraction completed, false on failure. Use it to branch error handling.
messageStringHuman-readable status message, carrying success confirmation or error detail.

Wie richte ich das Extrahieren von Seiten ein? PDF In n8n?

  1. Hinzufügen PDF4me zu Ihrem n8n Workflow und wählen Sie den Seiten extrahieren aus PDF Aktion.
  2. In Anmeldeinformationen zum Verbinden mit, wählen Sie Ihre PDF4me Anmeldeinformationen oder klicken Neue Anmeldeinformationen erstellen und fügen Sie Ihren ein API Schlüssel.
  3. Satz Eingabedatentyp Zu Binärdaten (Standard), Base64 String, oder URL und die passende Quelle bereitstellen PDF Feld.
  4. Satz Dokumentname für die Quelldatei, einschließlich der .pdf Verlängerung.
  5. Eingeben Seitenzahlen unter Verwendung einer Liste, eines Bereichs, einer gemischten Liste oder eines offenen Bereichs.
  6. Verlassen Name des Binärfelds der Ausgabe als data es sei denn, ein späterer Knoten erwartet eine andere Eigenschaft.
  7. Führe den Knoten aus und leite die zurückgegebenen Daten weiter. PDF zum nächsten Schritt, wie z. B. Speicherung, E-Mail oder einer Überprüfungswarteschlange.

Typische Konfigurationen

Workflow-BeispieleCommon n8n workflow patterns using Extract Pages From PDF.
Ziehen Sie die Unterschriftenseite aus einem Vertrag heraus.
  1. Der unterzeichnete Vertrag wird als E-Mail-Anhang zugestellt.
  2. Seiten extrahieren aus PDF nimmt die letzte Seite unter Verwendung eines offenen Bereichs.
  3. Die einzelne Seite wird zur schnellen Orientierung im Kundendatensatz abgelegt.
Senden Sie den Gutachtern bitte nur die Zusammenfassung.
  1. Es wird regelmäßig ein ausführlicher Bericht erstellt.
  2. Seiten extrahieren aus PDF behält die ersten paar pages mit einer Bandbreite wie 1-3Die
  3. Die Gutachter erhalten die Zusammenfassung, der vollständige Bericht wird archiviert.
Isolieren Sie ein Kapitel aus einem Handbuch
  1. Eine Supportanfrage bezieht sich auf einen Abschnitt des Produkthandbuchs.
  2. Seiten extrahieren aus PDF zieht dieses Kapitel mit einem Bindestrichbereich.
  3. Der Kunde erhält die relevanten Informationen. pages anstelle eines großen Anbauteils.
Anschließend extrahieren und zu einem Digest zusammenführen
  1. Mehrere Quelldokumente enthalten jeweils eine Seite, die es wert ist, aufbewahrt zu werden.
  2. Seiten extrahieren aus PDF Für jedes Dokument wird ein Vorgang ausgeführt, um die jeweilige Seite abzurufen.
  3. Mehrere zusammenführen PDFs Die Ergebnisse werden zu einem einzigen Digest zusammengefasst.

Praktische Tipps

Use an open range for variable documents
When the page count differs between files, 10- keeps everything from page 10 onward without knowing the total.
Check pagesExtracted against your request
Comparing the returned count with the number of pages you asked for catches a malformed page list before it reaches the customer.
Remember pages start at 1
A code node that builds the list from a zero-based array will be off by one on every document. Add one when generating the string.
Extract before you merge
Pulling the wanted pages from each source first keeps the merge step small and the final document free of filler.
Branch on the success field
Test the returned success boolean before sending the file onward so a failed extraction raises an alert instead of forwarding an empty result.
Reuse one source for several subsets
The original is untouched, so the same PDF can feed two extraction nodes to produce an internal copy and a customer copy in one run.

Spickzettel

FeldWert
ActionExtract Pages From PDF
Input Data TypeBinary Data
Input Binary Fielddata
Document Nameoutput.pdf
Page Numbers1,3,5-8
Output Binary Field Namedata
Advanced OptionsNo properties
CredentialsPDF4me API credential

Häufig gestellte Fragen

How do I write the Page Numbers field to extract a range?+
Page Numbers accepts four shapes. A comma-separated list such as 1,3,5 pulls individual pages. A hyphenated range such as 2-5 pulls everything between and including those pages. A mixed list such as 1,3,5-8 combines both. An open range such as 10- runs from page 10 to the end of the document, which is useful when the page count varies between files.
Is extracting pages the same as splitting a PDF?+
No. Extract Pages From PDF returns one new PDF containing only the pages you listed, and the pages you did not list are simply absent. Splitting divides a document into multiple output files covering the whole document. Choose extraction when you want a specific subset, and choose Split PDF when you want every page distributed across several files.
Does extracting pages change the original PDF?+
No. The node reads the source PDF you supply and returns a new file. The original document is untouched, so the same source can be run through several extractions in one workflow to produce different subsets.
What happens if I ask for a page number that does not exist?+
Page Numbers is a required field and is validated when the node runs. Requesting a page beyond the end of the document is an error case rather than a silent skip, so branch on the returned success field before passing the result downstream, especially when the page list is built dynamically from earlier workflow data.
Are the page numbers counted from one or from zero?+
Page numbers start at 1, matching what a reader sees in a PDF viewer. The first page of the document is 1, not 0. This matters most when the page list is generated by an earlier node in n8n code, where zero-based indexing is a common source of off-by-one output.

Verwandte Aktionen

Dieselbe Aufgabe auf anderen Plattformen

Hilfe erhalten