Pular para o conteúdo principal

Localizar e substituir texto em PDF com n8n

O que este nó faz

PDF4me Localizar e substituir texto pesquisas um PDF para um padrão de texto e substitui cada ocorrência por um novo conteúdo, dentro do seu n8n Fluxo de trabalho otimizado, sem edição manual no Adobe Acrobat. Selecione o documento inteiro ou intervalos de páginas específicos, preserve a fonte, a cor, o tamanho e o layout circundante e encadeie várias substituições para substituições complexas. Ideal para Alterações em massa de nomes de fornecedores após aquisições, atualizações de marca em catálogos de produtos, correção de erros ortográficos, atualizações de preços em orçamentos, padronização de terminologia e personalização de documentos com base em modelos..

Artigos relacionados no blogue
Ainda não há nenhuma publicação no blogue sobre esta funcionalidade — em breve.
Entretanto, explore o blogue da PDF4me para encontrar tutoriais e fluxos de trabalho para todas as plataformas.
Visite o blogue

Autenticando seu API Solicitar

Todo PDF4me nó em n8n requer um válido Credencial para se conectar comCrie ou selecione um que contenha o seu PDF4me API chave para que o fluxo de trabalho possa autenticar solicitações de substituição de texto com segurança.

Fatos importantes que você não deve perder

Preserva a fonte, a cor e o layout.
Cada ocorrência de Texto Antigo é substituída na mesma posição do caractere, com a fonte, cor e tamanho originais preservados. O texto adjacente, as imagens, os números de página e a estrutura do documento permanecem intactos, ao contrário do que ocorre normalmente. PDF-para-Palavra-para-PDF viagens de ida e volta que frequentemente alteram o layout e quebram a formatação.
Segmentação por intervalo de páginas: atualize apenas o que precisa ser alterado.
A sequência de páginas suporta todos, páginas individuais (1,2,3), intervalos (1-5,10-15), e misto (1,2,3-7,10Atualize apenas a capa, a página de assinatura ou capítulos específicos, sem alterar o restante do documento.
Processamento assíncrono para documentos grandes
Habilite a opção Assíncrona para cenários de grande porte ou alto volume; a operação é executada em segundo plano para melhorar o desempenho do fluxo de trabalho. Recomendado para cenários corporativos que processam dezenas ou centenas de dados. PDFs por execução.
O nó "Localizar e Substituir Texto" do n8n exibe os parâmetros do PDF4me: Tipo de Dados de Entrada do PDF, Campo Binário de Entrada, Texto Antigo, Novo Texto, Sequência de Páginas e Nome do Arquivo de Saída, configurados para substituição automática de texto em PDFs.

Mapeie o PDF binário, insira o Texto Antigo e o Texto Novo, defina a Sequência de Páginas e execute, modificado PDF é retornado em um único nó.

Parâmetros

Obrigatório: Credencial para conectar-se com, PDF O tipo de dados de entrada, o texto antigo, o novo texto, a sequência de páginas, o nome do arquivo de saída e o nome da saída de dados binários devem ser fornecidos. O campo de entrada correspondente (Campo Binário de Entrada, Base64 PDF Conteúdo, ou PDF URL) é necessário com base na escolha PDF Tipo de dados de entrada.

ParâmetroObrigatórioO que fazExemplo
PDF Input Data TypeYesHow the source PDF is supplied. Binary Data reads from a previous n8n node (most common). Base64 String accepts encoded payload. URL downloads from a public link.Binary Data
Input Binary FieldConditionalBinary field holding the PDF content from the previous node. Required when PDF Input Data Type is Binary Data.{{ $binary.data }}
Base64 PDF ContentConditionalBase64-encoded PDF content. Required when PDF Input Data Type is Base64 String.JVBERi0xLjQK...
PDF URLConditionalPublic URL to the source PDF. Required when PDF Input Data Type is URL. Must not require authentication.https://example.com/contract.pdf
Old TextYesExact text pattern to find in the PDF. Case-sensitive by default. Each occurrence within the Page Sequence will be replaced.Old Vendor Inc.
New TextYesReplacement text. Inserted in place of every Old Text occurrence with preserved font, color, and size.New Vendor LLC
Page SequenceYesPages to process. Use "all" for entire document, comma-separated pages "1,2,3", ranges "1-5,10-15", or mixed "1,2,3-7,10". Default "all".1,2,3
Output File NameYesFilename for the modified PDF. Must include the .pdf extension.find_and_replace_output.pdf
Binary Data Output NameYesName of the binary field in the n8n output holding the modified PDF. Used in subsequent workflow nodes.data
AsyncNoEnable asynchronous processing. true runs the operation in background for higher throughput; recommended for large PDFs and high-volume scenarios. Default behavior varies by deployment.true

Opções avançadas

Perfis personalizados
JSON- Opções de formatação para comportamento avançado de substituição, definição de diferenciação entre maiúsculas e minúsculas, correspondência apenas de palavras inteiras ou outras regras personalizadas.

Padrões de sequência de páginas

todosDocumento completo
Padrão. Substitui todas as ocorrências em todas as páginas, para atualizações de marca global ou padronização de terminologia.
1,2,3Páginas específicas
Separado por vírgulas. Atualize apenas páginas específicas, útil para a capa, página de assinatura ou um local conhecido.
1-5,10-15Intervalos de páginas
Intervalos separados por hífen. Atualize capítulos ou blocos de seção específicos, deixando o restante do documento intacto.
1,2,3-7,10Páginas e intervalos variados
Combine páginas e intervalos individuais. Máxima flexibilidade para documentos complexos, como contratos com várias seções ou manuais técnicos.

Campos de saída

CampoTipoO que contém
successBooleanTrue when text replacement completed successfully; false on error.
messageStringHuman-readable status message confirming success or describing the error.
fileNameStringFilename of the modified PDF (e.g. find_and_replace_output.pdf).
mimeTypeStringMIME type of the output: always application/pdf.
fileSizeNumberSize of the modified PDF in bytes.
oldTextStringEcho of the Old Text searched for, for audit and verification.
newTextStringEcho of the New Text replacement applied, for audit and verification.
pageSequenceStringEcho of the page range processed (e.g. "all pages", "1,2,3").

Configuração rápida

  1. Adicionar PDF4me para o seu n8n fluxo de trabalho e seleção Localizar e substituir texto como a ação.
  2. Em Credencial para se conectar com, selecione o seu PDF4me credencial ou crie uma com a sua API chave.
  3. Definir PDF Tipo de dados de entrada para Dados binários e mapa Campo binário de entrada para a saída binária de um nó anterior (Dropbox, Google Drive, solicitação HTTP, etc.).
  4. Digitar Texto antigo: o padrão de texto exato a ser encontrado no PDF (por exemplo Old Vendor Inc.).
  5. Digitar Novo texto: o texto de substituição (por exemplo, New Vendor LLC).
  6. Definir Sequência de páginas: usar all para substituição global ou páginas/intervalos específicos como 1,2,3 ou 1-5,10-15.
  7. Definir Nome do arquivo de saída para o nome de arquivo desejado (com .pdf extensão) e Nome da saída de dados binários para data.
  8. Opcionalmente, habilite. Assíncrono Para documentos grandes ou processamento de alto volume.
  9. Execute. O pacote de saída contém o arquivo modificado. PDF Com todas as substituições aplicadas, pronto para upload, envio por e-mail ou processamento posterior.

Exemplos de fluxo de trabalho

Exemplos de fluxo de trabalhoCommon n8n workflow patterns using Find and Replace Text.
Alteração em massa do nome do fornecedor após a aquisição → atualizar todos os contratos
  1. Após uma aquisição, a equipe jurídica precisa atualizar todos os contratos vigentes. PDF para refletir o novo nome da entidade.
  2. A SharePoint O recurso "Watch Files" dispara alertas para cada contrato na pasta active-contracts.
  3. PDF4me A função Localizar e Substituir Texto substitui o nome antigo da empresa pelo novo nome da entidade em todas as páginas (Sequência de Páginas = todas). A fonte e o layout são preservados.
  4. Um nó adicional de "Localizar e Substituir Texto" atualiza o endereço registrado da antiga sede para a nova sede no mesmo documento.
  5. O contrato atualizado é salvo novamente em SharePoint Com nome de arquivo versionado. Uma notificação do Slack confirma a atualização para a equipe de operações jurídicas. Centenas de contratos atualizados em minutos, em vez de semanas de edição manual no Acrobat.
Personalização de PDFs de orçamentos → substituir marcadores de posição do cliente
  1. Um webhook do CRM Dispara quando a equipe de vendas gera uma nova cotação. PDF a partir de um modelo.
  2. PDF4me A operação Localizar e Substituir Texto é executada 4 vezes em sequência (nós encadeados), cada uma substituindo um marcador de posição: {{CUSTOMER_NAME}}, {{TOTAL_PRICE}}, {{VALID_UNTIL}}, {{ACCOUNT_MANAGER}}.
  3. O orçamento personalizado é enviado ao cliente via Gmail com um assunto e anexo dinâmicos.
  4. A Salesforce A etapa "Atualizar registro" anexa a cotação final. PDF à oportunidade.
  5. Um registro do Airtable armazena o cliente, o ID da cotação, o valor total e o carimbo de data/hora de envio para fins de relatório de vendas.
Atualização anual de preços → atualização apenas das capas do catálogo
  1. Um gatilho de agendamento é acionado em 1º de janeiro de cada ano para atualizar os catálogos de produtos com os novos preços.
  2. Uma etapa de lista do Google Drive recupera todos os catálogos. PDF na pasta de catálogos.
  3. Um Loop sobre Itens processa cada um PDF. PDF4me A função Localizar e Substituir atualiza o texto "Preços válidos até 2024" para "Preços válidos até 2025" com a Sequência de Páginas definida como 1,2 (Apenas a capa e o resumo, deixando o conteúdo intacto).
  4. Um segundo nó de Localizar e Substituir Texto atualiza o rodapé do ano de direitos autorais na Sequência de Páginas. all.
  5. O catálogo atualizado é carregado de volta para o mesmo local do Google Drive, sobrescrevendo a versão antiga. A equipe de marketing recebe um resumo no Slack listando todos os catálogos que foram atualizados.

Perguntas frequentes

Does Find and Replace Text preserve formatting and layout in the PDF?+
Yes. The replacement preserves the original font, color, size, and surrounding layout. Each occurrence of Old Text is replaced in place: the same character position, line, and text run. Surrounding text, images, page numbering, and document structure remain untouched. This is fundamentally different from converting a PDF to Word, editing, then converting back, which often shifts layout, breaks formatting, and forces manual cleanup. PDF4me modifies the PDF text stream directly without round-tripping through another format.
Can I find and replace text on specific pages only?+
Yes. The Page Sequence parameter accepts: all (entire document: the default), comma-separated page numbers like 1,2,3, page ranges like 1-5 or 10-15, or mixed combinations like 1,2,3-7,10. This is useful when you want to update only the title page, only specific chapters of a manual, only the cover and signature page of a contract, or only the pricing summary in a quote: and leave the body of the document completely untouched.
Does the find work on scanned PDFs or only on native PDFs?+
Find and Replace Text requires a selectable text layer in the source PDF. Native digital PDFs (created from Microsoft Word, Google Docs, LibreOffice, browser print, InDesign, BI tools, accounting software, etc.) work directly. Scanned or photographed PDFs must first be passed through an OCR step: the n8n node "Convert PDF to Editable PDF Using OCR" adds a searchable text layer over the scanned image, after which this node can find and replace within the text content. Chain the two nodes in sequence: OCR first, then Find and Replace.
Can I replace multiple different text patterns in one workflow run?+
Each Find and Replace Text node handles one find-and-replace pair per execution. To apply multiple substitutions, chain the node multiple times, each instance takes the output of the previous as input. For dynamic per-row substitution lists, use a SplitInBatches or Loop Over Items pattern: feed a list of {oldText, newText} pairs, loop, and call this node once per pair. The final output after the loop is the fully updated PDF with all substitutions applied in order. This pattern is the same one used by Microsoft Word and Adobe Acrobat for multi-replacement macros.
How does this compare to manually editing PDFs in Adobe Acrobat, PDFelement, or Foxit?+
Manual desktop PDF editors (Adobe Acrobat Pro, Foxit PhantomPDF, PDFelement, Nitro PDF, PDF-XChange Editor) require a human to open each file, run Find and Replace, save, and close: typically 1-3 minutes per document plus license fees per editor seat (Acrobat Pro is around $20/month/user). The PDF4me n8n node automates the same task: webhooks, schedules, or folder watches trigger the update across hundreds or thousands of PDFs without manual intervention. Use this for bulk vendor-name changes after acquisitions, branding updates across product catalogs, pricing refreshes on quote PDFs, terminology standardization across legal documents, or any standardization task across many documents. The same automation that would require an admin to spend hours in Acrobat runs end-to-end in seconds in n8n.

Ações relacionadas

Obtenha ajuda