Saltar al contenido principal

Extraer páginas de PDF en n8n

Extraer páginas de PDF es un PDF4me acción del nodo en n8n que construye un nuevo PDF que contiene únicamente el pages La lista que usted enumera. Úsela para extraer una página de firmas de un contrato, aislar un solo capítulo de un manual o pasar los pasos posteriores solo el resumen. pages en lugar de todo el documento.

Lo que hace este nodo

PDF4me: Extraer páginas de PDF toma una PDF a partir de datos binarios, un Base64 String, o un URL y devuelve un nuevo archivo que contiene solo el pages nombrado en Números de página. Ese campo es toda la acción: acepta un solo pages, rangos con guiones, listas mixtas y rangos abiertos que se extienden hasta el final del documento. Dado que se ejecuta como un paso del flujo de trabajo, la misma regla de extracción se aplica a todos los archivos que llegan sin que nadie abra un editor.

Entradas de blog relacionadas
Aún no hay ninguna entrada de blog sobre esta función; estará disponible próximamente.
Mientras tanto, echa un vistazo al blog de PDF4me para encontrar tutoriales y flujos de trabajo para todas las plataformas.
Visita el blog

Autenticando su API Pedido

Cada PDF4me nodo en n8n requiere un válido Credencial para conectarse con. Crea o selecciona uno que contenga tu PDF4me API clave para que el flujo de trabajo pueda autenticar las solicitudes de extracción de forma segura.

Datos importantes que no debes perderte

El único campo que importa es el de números de página.
Es obligatorio y validado. Déjelo en blanco y n8n marca el campo antes de que se ejecute el nodo.
Los rangos abiertos admiten recuentos de páginas variables.
Escribiendo 10- significa desde la página 10 hasta el final, por lo que una misma configuración funciona en documentos de diferentes longitudes.
Las páginas están numeradas del 1 al 1.
La primera página es la 1, no la 0. Presta atención a esto cuando un nodo de código anterior genere la lista de páginas mediante programación.
Nodo PDF4me en n8n configurado en Acción Extraer páginas de PDF, Tipo de datos de entrada Datos binarios, Campo de entrada de datos binarios, Nombre del documento output.pdf, un campo de Números de página obligatorio vacío y Nombre del campo de salida de datos binarios

PDF4me Extraer páginas de PDF panel de parámetros en n8n

Extraer páginas vs. Dividir PDF

Ambos producen documentos más pequeños, pero responden a preguntas diferentes. La extracción pregunta cuál pages usted quiere conservar; dividir pregunta cómo se debe dividir todo el documento.

PreguntaExtraer páginas de PDFDividir PDF
How many files come backOne PDF holding the pages you listedSeveral PDFs covering the whole document
What happens to unlisted pagesThey are absent from the outputThey still appear, in another output file
Typical usePull the signature page, one chapter, or a summary sectionBreak a bundle into per-invoice or per-section files
Driven byAn explicit page list you supplyA split rule such as page count, text, or barcode

¿De qué parámetros extrae las páginas? PDF ¿Necesidad?

Requerido: Acción, tipo de datos de entrada, el campo que coincide con ese tipo de entrada, nombre del documento y números de página. El nombre del campo binario de salida tiene un valor predeterminado de funcionamiento. datosy Opciones avanzadas comienza vacío.

ParámetroRequeridoLo que haceEjemplo
ActionRequiredSelects the PDF4me node action to run. Choose Extract Pages From PDF.Extract Pages From PDF
Input Data TypeRequiredFormat of the source PDF input. Choose Binary Data (from a previous node), Base64 String, or URL.Binary Data
Input Binary FieldConditionalName of the binary property on the incoming n8n item that holds the PDF. Required when Input Data Type is Binary Data. Defaults to data.data
Base64 Document ContentConditionalBase64-encoded content of the source PDF. Required when Input Data Type is Base64 String.JVBERi0xLjQK...
File URLConditionalPublicly reachable HTTPS URL to the source PDF. Required when Input Data Type is URL.https://example.com/report.pdf
Document NameRequiredFilename used for the document on the request, for reference and tracking. Include the .pdf extension.output.pdf
Page NumbersRequiredThe pages to keep. Accepts a comma-separated list, a hyphenated range, a mixed list, or an open range that runs to the end of the document. Pages are numbered from 1.1,3,5-8
Output Binary Field NameOptionalName of the binary property the output item exposes. Defaults to data.data
Advanced OptionsOptionalA collection that starts empty, shown as No properties with an Add Option button. Leave it alone unless you have a specific option to add.No properties

Cómo escribir el campo de números de página

PatrónEjemploLo que regresa
Single page5Just page 5, as a one page PDF.
Comma-separated list1,3,5Pages 1, 3, and 5 in one PDF, with pages 2 and 4 absent.
Hyphenated range2-5Pages 2, 3, 4, and 5, with both ends included.
Mixed list1,3,5-8Page 1, page 3, then the block from 5 to 8.
Open range10-Page 10 through the last page, whatever the document length turns out to be.

Campos de salida

Una carrera exitosa devuelve uno n8n artículo que contiene el extraído PDF.

CampoTipoLo que contiene
Binary (data)BinaryThe extracted PDF, under Output Binary Field Name (default data).
fileNameStringGenerated filename of the extracted PDF.
mimeTypeStringMIME type of the output, always application/pdf.
fileSizeNumberSize of the returned PDF in bytes.
pagesExtractedNumberHow many pages ended up in the output. Compare it against the length of your requested list as a cheap sanity check.
originalPageCountNumberPage count of the source document before extraction.
extractedPageNumbersArrayThe page numbers that were actually extracted, useful for verifying the result against what you asked for.
successBooleanTrue when the extraction completed, false on failure. Use it to branch error handling.
messageStringHuman-readable status message, carrying success confirmation or error detail.

¿Cómo configuro la extracción de páginas? PDF en n8n¿

  1. Agregar PDF4me a tu n8n flujo de trabajo y elegir el Extraer páginas de PDF acción.
  2. En Credencial para conectarse con, seleccione su PDF4me credenciales o haga clic Crear nueva credencial y pega tu API llave.
  3. Colocar Tipo de datos de entrada a Datos binarios (por defecto), Base64 String, o URL y proporcionar la fuente correspondiente PDF campo.
  4. Colocar Nombre del documento para el archivo fuente, incluyendo el .pdf extensión.
  5. Ingresar Números de página utilizando una lista, un rango, una lista mixta o un rango abierto.
  6. Dejar Nombre del campo binario de salida como data a menos que un nodo posterior espere una propiedad diferente.
  7. Ejecuta el nodo y enruta el resultado. PDF al siguiente paso, como almacenamiento, correo electrónico o una cola de revisión.

Configuraciones típicas

Ejemplos de flujo de trabajoCommon n8n workflow patterns using Extract Pages From PDF.
Extraiga la página de firmas de un contrato.
  1. El contrato firmado llega como archivo adjunto en el correo electrónico.
  2. Extraer páginas de PDF toma la última página usando un rango abierto.
  3. La página individual se archiva en el registro del cliente para una consulta rápida.
Enviar solo el resumen a los revisores.
  1. Se genera un informe extenso periódicamente.
  2. Extraer páginas de PDF conserva los primeros pages con una gama como 1-3.
  3. Los revisores reciben el resumen, mientras que el informe completo se archiva.
Aislar un capítulo de un manual
  1. Una solicitud de asistencia hace referencia a una sección del manual del producto.
  2. Extraer páginas de PDF extrae ese capítulo con un rango con guion.
  3. El cliente obtiene la información relevante. pages en lugar de un accesorio grande.
Extraer y luego combinar en un resumen
  1. Varios documentos originales contienen cada uno una página que merece la pena conservar.
  2. Extraer páginas de PDF Se ejecuta por documento para obtener esa página.
  3. Combinar varios PDFs Combina los resultados en un único resumen.

Consejos prácticos

Use an open range for variable documents
When the page count differs between files, 10- keeps everything from page 10 onward without knowing the total.
Check pagesExtracted against your request
Comparing the returned count with the number of pages you asked for catches a malformed page list before it reaches the customer.
Remember pages start at 1
A code node that builds the list from a zero-based array will be off by one on every document. Add one when generating the string.
Extract before you merge
Pulling the wanted pages from each source first keeps the merge step small and the final document free of filler.
Branch on the success field
Test the returned success boolean before sending the file onward so a failed extraction raises an alert instead of forwarding an empty result.
Reuse one source for several subsets
The original is untouched, so the same PDF can feed two extraction nodes to produce an internal copy and a customer copy in one run.

Hoja de trucos

CampoValor
ActionExtract Pages From PDF
Input Data TypeBinary Data
Input Binary Fielddata
Document Nameoutput.pdf
Page Numbers1,3,5-8
Output Binary Field Namedata
Advanced OptionsNo properties
CredentialsPDF4me API credential

Preguntas frecuentes

How do I write the Page Numbers field to extract a range?+
Page Numbers accepts four shapes. A comma-separated list such as 1,3,5 pulls individual pages. A hyphenated range such as 2-5 pulls everything between and including those pages. A mixed list such as 1,3,5-8 combines both. An open range such as 10- runs from page 10 to the end of the document, which is useful when the page count varies between files.
Is extracting pages the same as splitting a PDF?+
No. Extract Pages From PDF returns one new PDF containing only the pages you listed, and the pages you did not list are simply absent. Splitting divides a document into multiple output files covering the whole document. Choose extraction when you want a specific subset, and choose Split PDF when you want every page distributed across several files.
Does extracting pages change the original PDF?+
No. The node reads the source PDF you supply and returns a new file. The original document is untouched, so the same source can be run through several extractions in one workflow to produce different subsets.
What happens if I ask for a page number that does not exist?+
Page Numbers is a required field and is validated when the node runs. Requesting a page beyond the end of the document is an error case rather than a silent skip, so branch on the returned success field before passing the result downstream, especially when the page list is built dynamically from earlier workflow data.
Are the page numbers counted from one or from zero?+
Page numbers start at 1, matching what a reader sees in a PDF viewer. The first page of the document is 1, not 0. This matters most when the page list is generated by an earlier node in n8n code, where zero-based indexing is a common source of off-by-one output.

Acciones relacionadas

La misma tarea en otras plataformas

Obtén ayuda