Pular para o conteúdo principal

Extrair páginas de PDF em n8n

Extrair páginas de PDF é um PDF4me ação do nó em n8n que constrói um novo PDF contendo apenas o pages Você lista. Use-a para extrair uma página de assinatura de um contrato, isolar um único capítulo de um manual ou fornecer apenas o resumo para as etapas subsequentes. pages em vez do documento inteiro.

O que este nó faz

PDF4meExtrair páginas de PDF leva um PDF de Dados Binários, um Base64 Stringou um URL e retorna um novo arquivo contendo apenas o pages nomeado em Números de páginaEsse campo representa toda a ação: ele aceita um único valor. pages, intervalos hifenizados, listas mistas e intervalos abertos que se estendem até o final do documento. Como é executado como uma etapa do fluxo de trabalho, a mesma regra de extração se aplica a todos os arquivos que chegam sem que ninguém abra um editor.

Artigos relacionados no blogue
Ainda não há nenhuma publicação no blogue sobre esta funcionalidade — em breve.
Entretanto, explore o blogue da PDF4me para encontrar tutoriais e fluxos de trabalho para todas as plataformas.
Visite o blogue

Autenticando seu API Solicitar

Todo PDF4me nó em n8n requer um válido Credencial para se conectar comCrie ou selecione um que contenha o seu PDF4me API chave para que o fluxo de trabalho possa autenticar solicitações de extração com segurança.

Fatos importantes que você não deve perder

O número da página é o único campo que importa.
É obrigatório e validado. Deixe em branco e n8n Sinaliza o campo antes que o nó seja executado.
Intervalos abertos lidam com contagens de páginas variáveis.
Escrita 10- Significa da página 10 até o final, portanto, uma única configuração funciona para documentos de diferentes tamanhos.
As páginas são numeradas a partir de 1.
A primeira página é a 1, não a 0. Observe isso quando um nó de código anterior gerar a lista de páginas programaticamente.
O nó PDF4me no n8n está configurado com a ação "Extrair Páginas do PDF", o tipo de dados de entrada "Dados Binários", o campo de entrada "dados binários", o nome do documento "output.pdf", um campo obrigatório de Números de Página vazio e o nome do campo de saída "dados binários".

PDF4me Extrair páginas de PDF painel de parâmetros em n8n

Extrair páginas vs. Dividir PDF

Ambos produzem documentos menores, mas respondem a perguntas diferentes. A extração pergunta qual pages Você quer manter o que deseja; a opção de dividir pergunta como o documento inteiro deve ser dividido.

PerguntaExtrair páginas de PDFDividir PDF
How many files come backOne PDF holding the pages you listedSeveral PDFs covering the whole document
What happens to unlisted pagesThey are absent from the outputThey still appear, in another output file
Typical usePull the signature page, one chapter, or a summary sectionBreak a bundle into per-invoice or per-section files
Driven byAn explicit page list you supplyA split rule such as page count, text, or barcode

Quais parâmetros são usados para extrair páginas? PDF Precisar?

Obrigatório: Ação, Tipo de Dados de Entrada, o campo correspondente a esse tipo de entrada, Nome do Documento e Números de Página. O Nome do Campo Binário de Saída possui um valor padrão funcional de dadosE as Opções Avançadas começam vazias.

ParâmetroObrigatórioO que fazExemplo
ActionRequiredSelects the PDF4me node action to run. Choose Extract Pages From PDF.Extract Pages From PDF
Input Data TypeRequiredFormat of the source PDF input. Choose Binary Data (from a previous node), Base64 String, or URL.Binary Data
Input Binary FieldConditionalName of the binary property on the incoming n8n item that holds the PDF. Required when Input Data Type is Binary Data. Defaults to data.data
Base64 Document ContentConditionalBase64-encoded content of the source PDF. Required when Input Data Type is Base64 String.JVBERi0xLjQK...
File URLConditionalPublicly reachable HTTPS URL to the source PDF. Required when Input Data Type is URL.https://example.com/report.pdf
Document NameRequiredFilename used for the document on the request, for reference and tracking. Include the .pdf extension.output.pdf
Page NumbersRequiredThe pages to keep. Accepts a comma-separated list, a hyphenated range, a mixed list, or an open range that runs to the end of the document. Pages are numbered from 1.1,3,5-8
Output Binary Field NameOptionalName of the binary property the output item exposes. Defaults to data.data
Advanced OptionsOptionalA collection that starts empty, shown as No properties with an Add Option button. Leave it alone unless you have a specific option to add.No properties

Como preencher o campo de números de página

PadrãoExemploO que retorna
Single page5Just page 5, as a one page PDF.
Comma-separated list1,3,5Pages 1, 3, and 5 in one PDF, with pages 2 and 4 absent.
Hyphenated range2-5Pages 2, 3, 4, and 5, with both ends included.
Mixed list1,3,5-8Page 1, page 3, then the block from 5 to 8.
Open range10-Page 10 through the last page, whatever the document length turns out to be.

Campos de saída

Uma corrida bem-sucedida retorna um n8n item contendo o extraído PDF.

CampoTipoO que contém
Binary (data)BinaryThe extracted PDF, under Output Binary Field Name (default data).
fileNameStringGenerated filename of the extracted PDF.
mimeTypeStringMIME type of the output, always application/pdf.
fileSizeNumberSize of the returned PDF in bytes.
pagesExtractedNumberHow many pages ended up in the output. Compare it against the length of your requested list as a cheap sanity check.
originalPageCountNumberPage count of the source document before extraction.
extractedPageNumbersArrayThe page numbers that were actually extracted, useful for verifying the result against what you asked for.
successBooleanTrue when the extraction completed, false on failure. Use it to branch error handling.
messageStringHuman-readable status message, carrying success confirmation or error detail.

Como faço para configurar a extração de páginas de PDF em n8n?

  1. Adicionar PDF4me para o seu n8n fluxo de trabalho e escolha o Extrair páginas de PDF Ação.
  2. Em Credencial para se conectar com, selecione o seu PDF4me credencial ou clique Criar nova credencial e cole o seu API chave.
  3. Definir Tipo de dados de entrada para Dados binários (padrão), Base64 String, ou URL e forneça a fonte correspondente. PDF campo.
  4. Definir Nome do documento para o arquivo de origem, incluindo o .pdf extensão.
  5. Digitar Números de página usando uma lista, um intervalo, uma lista mista ou um intervalo aberto.
  6. Deixar Nome do campo binário de saída como data a menos que um nó posterior espere uma propriedade diferente.
  7. Execute o nó e direcione o retorno. PDF para a próxima etapa, como armazenamento, e-mail ou uma fila de revisão.

Configurações típicas

Exemplos de fluxo de trabalhoCommon n8n workflow patterns using Extract Pages From PDF.
Retire a página de assinatura de um contrato.
  1. O contrato assinado chega como anexo de e-mail.
  2. Extrair páginas de PDF Seleciona a última página usando um intervalo aberto.
  3. A página única é arquivada no registro do cliente para consulta rápida.
Enviar apenas o resumo aos revisores.
  1. Um relatório extenso é gerado de acordo com um cronograma.
  2. Extrair páginas de PDF mantém os primeiros poucos pages com uma gama como 1-3.
  3. Os revisores recebem o resumo, enquanto o relatório completo é arquivado.
Isole um capítulo de um manual.
  1. Uma solicitação de suporte faz referência a uma seção do manual do produto.
  2. Extrair páginas de PDF extrai esse capítulo com um intervalo hifenizado.
  3. O cliente recebe o que é relevante. pages em vez de um acessório grande.
Extraia e, em seguida, junte a um resumo.
  1. Diversos documentos originais contêm, cada um, uma página que vale a pena guardar.
  2. Extrair páginas de PDF executa cada documento para extrair essa página.
  3. Mesclar várias opções PDFs Combina os resultados em um único resumo.

Dicas práticas

Use an open range for variable documents
When the page count differs between files, 10- keeps everything from page 10 onward without knowing the total.
Check pagesExtracted against your request
Comparing the returned count with the number of pages you asked for catches a malformed page list before it reaches the customer.
Remember pages start at 1
A code node that builds the list from a zero-based array will be off by one on every document. Add one when generating the string.
Extract before you merge
Pulling the wanted pages from each source first keeps the merge step small and the final document free of filler.
Branch on the success field
Test the returned success boolean before sending the file onward so a failed extraction raises an alert instead of forwarding an empty result.
Reuse one source for several subsets
The original is untouched, so the same PDF can feed two extraction nodes to produce an internal copy and a customer copy in one run.

Folha de dicas

CampoValor
ActionExtract Pages From PDF
Input Data TypeBinary Data
Input Binary Fielddata
Document Nameoutput.pdf
Page Numbers1,3,5-8
Output Binary Field Namedata
Advanced OptionsNo properties
CredentialsPDF4me API credential

Perguntas frequentes

How do I write the Page Numbers field to extract a range?+
Page Numbers accepts four shapes. A comma-separated list such as 1,3,5 pulls individual pages. A hyphenated range such as 2-5 pulls everything between and including those pages. A mixed list such as 1,3,5-8 combines both. An open range such as 10- runs from page 10 to the end of the document, which is useful when the page count varies between files.
Is extracting pages the same as splitting a PDF?+
No. Extract Pages From PDF returns one new PDF containing only the pages you listed, and the pages you did not list are simply absent. Splitting divides a document into multiple output files covering the whole document. Choose extraction when you want a specific subset, and choose Split PDF when you want every page distributed across several files.
Does extracting pages change the original PDF?+
No. The node reads the source PDF you supply and returns a new file. The original document is untouched, so the same source can be run through several extractions in one workflow to produce different subsets.
What happens if I ask for a page number that does not exist?+
Page Numbers is a required field and is validated when the node runs. Requesting a page beyond the end of the document is an error case rather than a silent skip, so branch on the returned success field before passing the result downstream, especially when the page list is built dynamically from earlier workflow data.
Are the page numbers counted from one or from zero?+
Page numbers start at 1, matching what a reader sees in a PDF viewer. The first page of the document is 1, not 0. This matters most when the page list is generated by an earlier node in n8n code, where zero-based indexing is a common source of off-by-one output.

Ações relacionadas

Mesma tarefa em outras plataformas

Obtenha ajuda