Aller au contenu principal

Extraire des pages de PDF dans n8n

Extraire des pages de PDF est un PDF4me action de nœud dans n8n qui construit un nouveau PDF ne contenant que le pages Vous pouvez l'utiliser pour extraire une page de signature d'un contrat, isoler un chapitre d'un manuel ou fournir aux étapes suivantes uniquement le résumé. pages au lieu du document entier.

Que fait ce nœud ?

PDF4me: Extraire des pages de PDF prend un PDF à partir de données binaires, un Base64 String, ou un URL et renvoie un nouveau fichier contenant uniquement le pages nommé dans Numéros de pageCe champ représente l'intégralité de l'action : il accepte une seule valeur. pagesLes plages de cellules avec césure, les listes mixtes et les plages ouvertes s'étendant jusqu'à la fin du document sont traitées. Comme cette opération s'effectue dans le cadre d'un flux de travail, la même règle d'extraction s'applique à tous les fichiers reçus sans qu'aucun éditeur ne soit ouvert.

Articles de blog connexes
Il n'y a pas encore d'article de blog consacré à cette fonctionnalité — à venir prochainement.
En attendant, n'hésitez pas à consulter le blog de PDF4me pour découvrir des tutoriels et des procédures de travail adaptés à toutes les plateformes.
Consultez le blog

Authentification de votre API Demande

Chaque PDF4me nœud dans n8n nécessite un numéro valide Identifiant pour se connecter avecCréez ou sélectionnez-en un qui contient votre PDF4me API clé permettant au flux de travail d'authentifier les demandes d'extraction de manière sécurisée.

Informations importantes à ne pas manquer

Le champ « Numéros de page » est le seul qui compte.
Ce champ est obligatoire et validé. Laissez-le vide et n8n signale le champ avant l'exécution du nœud.
Les plages ouvertes gèrent les nombres de pages variables.
En écrivant 10- Cela signifie de la page 10 à la fin, donc un seul paramètre fonctionne pour des documents de longueurs différentes.
Les pages sont numérotées à partir de 1
La première page est 1, et non 0. Observez ceci lorsqu'un nœud de code précédent génère la liste des pages par programmation.
Le nœud PDF4me dans n8n est configuré sur l'action « Extraire les pages du PDF », le type de données d'entrée est « Données binaires », le champ binaire d'entrée est « data », le nom du document est « output.pdf », le champ « Numéros de page » (obligatoire) est vide et le nom du champ binaire de sortie est « data ».

PDF4me Extraire des pages de PDF panneau des paramètres dans n8n

Extraire les pages ou les diviser PDF

Les deux méthodes produisent des documents plus courts, mais elles répondent à des questions différentes. L'extraction demande laquelle pages vous souhaitez conserver ; la fonction de fractionnement demande comment le document entier doit être divisé.

QuestionExtraire des pages de PDFDiviser PDF
How many files come backOne PDF holding the pages you listedSeveral PDFs covering the whole document
What happens to unlisted pagesThey are absent from the outputThey still appear, in another output file
Typical usePull the signature page, one chapter, or a summary sectionBreak a bundle into per-invoice or per-section files
Driven byAn explicit page list you supplyA split rule such as page count, text, or barcode

Quels paramètres permettent d'extraire des pages ? PDF Besoin?

Requis: Action, type de données d'entrée, champ correspondant à ce type d'entrée, nom du document et numéros de page. Le nom du champ binaire de sortie a une valeur par défaut fonctionnelle de donnéeset les options avancées sont initialement vides.

ParamètreRequisCe que cela faitExemple
ActionRequiredSelects the PDF4me node action to run. Choose Extract Pages From PDF.Extract Pages From PDF
Input Data TypeRequiredFormat of the source PDF input. Choose Binary Data (from a previous node), Base64 String, or URL.Binary Data
Input Binary FieldConditionalName of the binary property on the incoming n8n item that holds the PDF. Required when Input Data Type is Binary Data. Defaults to data.data
Base64 Document ContentConditionalBase64-encoded content of the source PDF. Required when Input Data Type is Base64 String.JVBERi0xLjQK...
File URLConditionalPublicly reachable HTTPS URL to the source PDF. Required when Input Data Type is URL.https://example.com/report.pdf
Document NameRequiredFilename used for the document on the request, for reference and tracking. Include the .pdf extension.output.pdf
Page NumbersRequiredThe pages to keep. Accepts a comma-separated list, a hyphenated range, a mixed list, or an open range that runs to the end of the document. Pages are numbered from 1.1,3,5-8
Output Binary Field NameOptionalName of the binary property the output item exposes. Defaults to data.data
Advanced OptionsOptionalA collection that starts empty, shown as No properties with an Add Option button. Leave it alone unless you have a specific option to add.No properties

Comment remplir le champ des numéros de page

ModèleExempleCe qui revient
Single page5Just page 5, as a one page PDF.
Comma-separated list1,3,5Pages 1, 3, and 5 in one PDF, with pages 2 and 4 absent.
Hyphenated range2-5Pages 2, 3, 4, and 5, with both ends included.
Mixed list1,3,5-8Page 1, page 3, then the block from 5 to 8.
Open range10-Page 10 through the last page, whatever the document length turns out to be.

Champs de sortie

Une course réussie rapporte un n8n objet contenant l'extrait PDF.

ChampTaperCe qu'il contient
Binary (data)BinaryThe extracted PDF, under Output Binary Field Name (default data).
fileNameStringGenerated filename of the extracted PDF.
mimeTypeStringMIME type of the output, always application/pdf.
fileSizeNumberSize of the returned PDF in bytes.
pagesExtractedNumberHow many pages ended up in the output. Compare it against the length of your requested list as a cheap sanity check.
originalPageCountNumberPage count of the source document before extraction.
extractedPageNumbersArrayThe page numbers that were actually extracted, useful for verifying the result against what you asked for.
successBooleanTrue when the extraction completed, false on failure. Use it to branch error handling.
messageStringHuman-readable status message, carrying success confirmation or error detail.

Comment configurer l'extraction de pages à partir de PDF dans n8n?

  1. Ajouter PDF4me à votre n8n flux de travail et choisissez le Extraire des pages de PDF action.
  2. Dans Identifiant pour se connecter avec, sélectionnez votre PDF4me identifiant ou cliquez Créer un nouveau compte et collez votre API clé.
  3. Ensemble Type de données d'entrée à Données binaires (défaut), Base64 String, ou URL et fournir la source correspondante PDF champ.
  4. Ensemble Nom du document pour le fichier source, y compris le .pdf extension.
  5. Entrer Numéros de page en utilisant une liste, une plage, une liste mixte ou une plage ouverte.
  6. Partir Nom du champ binaire de sortie comme data à moins qu'un nœud ultérieur n'attende une propriété différente.
  7. Exécutez le nœud et acheminez le flux de retour. PDF à l'étape suivante, comme le stockage, l'envoi par e-mail ou une file d'attente pour la révision.

Configurations typiques

Exemples de flux de travailCommon n8n workflow patterns using Extract Pages From PDF.
Extraire la page de signature d'un contrat
  1. Le contrat signé arrive en pièce jointe d'un courriel.
  2. Extraire des pages de PDF prend la dernière page en utilisant une plage ouverte.
  3. Ce document unique est classé dans le dossier client pour consultation rapide.
N'envoyez que le résumé aux relecteurs
  1. Un rapport détaillé est généré automatiquement.
  2. Extraire des pages de PDF conserve les premiers pages avec une gamme telle que 1-3.
  3. Les relecteurs reçoivent le résumé tandis que le rapport complet est archivé.
Isoler un chapitre d'un manuel
  1. Une demande d'assistance fait référence à une section du manuel du produit.
  2. Extraire des pages de PDF extrait ce chapitre avec une plage de titres séparée par un trait d'union.
  3. Le client reçoit les informations pertinentes pages au lieu d'un accessoire volumineux.
Extraire puis fusionner dans un digest
  1. Plusieurs documents sources contiennent chacun une page qu'il convient de conserver.
  2. Extraire des pages de PDF Exécution par document pour extraire cette page.
  3. Fusionner plusieurs PDFs combine les résultats en un seul résumé.

Conseils pratiques

Use an open range for variable documents
When the page count differs between files, 10- keeps everything from page 10 onward without knowing the total.
Check pagesExtracted against your request
Comparing the returned count with the number of pages you asked for catches a malformed page list before it reaches the customer.
Remember pages start at 1
A code node that builds the list from a zero-based array will be off by one on every document. Add one when generating the string.
Extract before you merge
Pulling the wanted pages from each source first keeps the merge step small and the final document free of filler.
Branch on the success field
Test the returned success boolean before sending the file onward so a failed extraction raises an alert instead of forwarding an empty result.
Reuse one source for several subsets
The original is untouched, so the same PDF can feed two extraction nodes to produce an internal copy and a customer copy in one run.

Aide-mémoire

ChampValeur
ActionExtract Pages From PDF
Input Data TypeBinary Data
Input Binary Fielddata
Document Nameoutput.pdf
Page Numbers1,3,5-8
Output Binary Field Namedata
Advanced OptionsNo properties
CredentialsPDF4me API credential

Questions fréquentes

How do I write the Page Numbers field to extract a range?+
Page Numbers accepts four shapes. A comma-separated list such as 1,3,5 pulls individual pages. A hyphenated range such as 2-5 pulls everything between and including those pages. A mixed list such as 1,3,5-8 combines both. An open range such as 10- runs from page 10 to the end of the document, which is useful when the page count varies between files.
Is extracting pages the same as splitting a PDF?+
No. Extract Pages From PDF returns one new PDF containing only the pages you listed, and the pages you did not list are simply absent. Splitting divides a document into multiple output files covering the whole document. Choose extraction when you want a specific subset, and choose Split PDF when you want every page distributed across several files.
Does extracting pages change the original PDF?+
No. The node reads the source PDF you supply and returns a new file. The original document is untouched, so the same source can be run through several extractions in one workflow to produce different subsets.
What happens if I ask for a page number that does not exist?+
Page Numbers is a required field and is validated when the node runs. Requesting a page beyond the end of the document is an error case rather than a silent skip, so branch on the returned success field before passing the result downstream, especially when the page list is built dynamically from earlier workflow data.
Are the page numbers counted from one or from zero?+
Page numbers start at 1, matching what a reader sees in a PDF viewer. The first page of the document is 1, not 0. This matters most when the page list is generated by an earlier node in n8n code, where zero-based indexing is a common source of off-by-one output.

Actions connexes

Même tâche sur d'autres plateformes

Obtenez de l'aide