Saltar al contenido principal

Buscar y reemplazar texto en PDF con n8n

Lo que hace este nodo

PDF4me Buscar y reemplazar texto busca una PDF para un patrón de texto y reemplaza cada ocurrencia con contenido nuevo, dentro de su n8n flujo de trabajo, sin edición manual de Adobe Acrobat. Seleccione todo el documento o rangos de páginas específicos, conserve la fuente, el color, el tamaño y el diseño circundante, y encadene múltiples reemplazos para sustituciones compuestas. Ideal para Cambios masivos de nombres de proveedores tras adquisiciones, actualización de la imagen de marca en todos los catálogos de productos, corrección de errores tipográficos, actualización de precios en los presupuestos, estandarización de la terminología y personalización de documentos mediante plantillas..

Entradas de blog relacionadas
Aún no hay ninguna entrada de blog sobre esta función; estará disponible próximamente.
Mientras tanto, echa un vistazo al blog de PDF4me para encontrar tutoriales y flujos de trabajo para todas las plataformas.
Visita el blog

Autenticando su API Pedido

Cada PDF4me nodo en n8n requiere un válido Credencial para conectarse con. Crea o selecciona uno que contenga tu PDF4me API clave para que el flujo de trabajo pueda autenticar de forma segura las solicitudes de reemplazo de texto.

Datos importantes que no debes perderte

Conserva la fuente, el color y el diseño.
Cada aparición de texto antiguo se reemplaza en la misma posición de carácter, conservando la fuente, el color y el tamaño originales. El texto circundante, las imágenes, los números de página y la estructura del documento permanecen intactos, a diferencia de PDF-a-Palabra-a-PDF viajes de ida y vuelta que a menudo alteran el diseño y rompen el formato.
Segmentación por rango de páginas, actualice solo lo que necesite cambiar.
La secuencia de páginas admite todo, páginas individuales (1,2,3), rangos (1-5,10-15), y mixto (1,2,3-7,10). Actualice únicamente la página de portada, la página de firmas o capítulos específicos sin modificar el resto del documento.
Procesamiento asíncrono para documentos grandes
Habilite la opción Async para escenarios grandes o de alto volumen; la operación se ejecuta en segundo plano para un mejor rendimiento del flujo de trabajo. Recomendado para escenarios empresariales que procesan docenas o cientos de PDFs por ejecución.
Nodo n8n de Buscar y reemplazar texto que muestra los parámetros de PDF4me: Tipo de datos de entrada de PDF, Campo binario de entrada, Texto antiguo, Texto nuevo, Secuencia de páginas, Nombre del archivo de salida configurado para el reemplazo automático de texto en PDF.

Mapa del PDF binario, ingrese el texto antiguo y el texto nuevo, establezca la secuencia de páginas y ejecute el modificado. PDF se devuelve en un nodo.

Parámetros

Requerido: Credencial para conectarse con, PDF Se deben proporcionar el tipo de datos de entrada, el texto antiguo, el texto nuevo, la secuencia de páginas, el nombre del archivo de salida y el nombre de salida de datos binarios. El campo de entrada correspondiente (campo binario de entrada, Base64 PDF Contenido o PDF URL) es necesario en función de la elección PDF Tipo de datos de entrada.

ParámetroRequeridoLo que haceEjemplo
PDF Input Data TypeYesHow the source PDF is supplied. Binary Data reads from a previous n8n node (most common). Base64 String accepts encoded payload. URL downloads from a public link.Binary Data
Input Binary FieldConditionalBinary field holding the PDF content from the previous node. Required when PDF Input Data Type is Binary Data.{{ $binary.data }}
Base64 PDF ContentConditionalBase64-encoded PDF content. Required when PDF Input Data Type is Base64 String.JVBERi0xLjQK...
PDF URLConditionalPublic URL to the source PDF. Required when PDF Input Data Type is URL. Must not require authentication.https://example.com/contract.pdf
Old TextYesExact text pattern to find in the PDF. Case-sensitive by default. Each occurrence within the Page Sequence will be replaced.Old Vendor Inc.
New TextYesReplacement text. Inserted in place of every Old Text occurrence with preserved font, color, and size.New Vendor LLC
Page SequenceYesPages to process. Use "all" for entire document, comma-separated pages "1,2,3", ranges "1-5,10-15", or mixed "1,2,3-7,10". Default "all".1,2,3
Output File NameYesFilename for the modified PDF. Must include the .pdf extension.find_and_replace_output.pdf
Binary Data Output NameYesName of the binary field in the n8n output holding the modified PDF. Used in subsequent workflow nodes.data
AsyncNoEnable asynchronous processing. true runs the operation in background for higher throughput; recommended for large PDFs and high-volume scenarios. Default behavior varies by deployment.true

Opciones avanzadas

Perfiles personalizados
JSON-Opciones de formato para el comportamiento de reemplazo avanzado, la distinción entre mayúsculas y minúsculas, la coincidencia solo de palabras completas u otras reglas personalizadas.

Patrones de secuencia de páginas

todoDocumento completo
Predeterminado. Reemplazar todas las ocurrencias en todas las páginas, para actualizaciones de marca globales o estandarización de terminología.
1,2,3Páginas específicas
Separadas por comas. Actualiza solo páginas específicas; útil para la portada, la página de firmas o una ubicación conocida.
1-5,10-15Rangos de páginas
Rangos separados por guiones. Actualice capítulos o secciones específicas sin modificar el resto del documento.
1,2,3-7,10Páginas y gamas variadas
Combine páginas individuales y rangos de páginas. Máxima flexibilidad para documentos complejos como contratos con varias secciones o manuales técnicos.

Campos de salida

CampoTipoLo que contiene
successBooleanTrue when text replacement completed successfully; false on error.
messageStringHuman-readable status message confirming success or describing the error.
fileNameStringFilename of the modified PDF (e.g. find_and_replace_output.pdf).
mimeTypeStringMIME type of the output: always application/pdf.
fileSizeNumberSize of the modified PDF in bytes.
oldTextStringEcho of the Old Text searched for, for audit and verification.
newTextStringEcho of the New Text replacement applied, for audit and verification.
pageSequenceStringEcho of the page range processed (e.g. "all pages", "1,2,3").

Configuración rápida

  1. Agregar PDF4me a tu n8n flujo de trabajo y selección Buscar y reemplazar texto como la acción.
  2. En Credencial para conectarse con, seleccione su PDF4me credencial o crea una con tu API llave.
  3. Colocar PDF Tipo de datos de entrada a Datos binarios y mapa Campo binario de entrada a la salida binaria de un nodo anterior (Dropbox, Google Drive, solicitud HTTP, etc.).
  4. Ingresar Texto antiguo: el patrón de texto exacto que se debe encontrar en el PDF (p.ej. Old Vendor Inc.).
  5. Ingresar Nuevo texto: el texto de reemplazo (p. ej. New Vendor LLC).
  6. Colocar Secuencia de páginas: usar all para reemplazo global o páginas/rangos específicos como 1,2,3 o 1-5,10-15.
  7. Colocar Nombre del archivo de salida al nombre de archivo que desee (con .pdf extensión) y Nombre de salida de datos binarios a data.
  8. Habilitar opcionalmente Asíncrono Para documentos grandes o procesamiento de alto volumen.
  9. Ejecutar. El paquete de salida contiene el modificado PDF Con todas las sustituciones aplicadas, listo para su carga, envío por correo electrónico o procesamiento posterior.

Ejemplos de flujo de trabajo

Ejemplos de flujo de trabajoCommon n8n workflow patterns using Find and Replace Text.
Cambio masivo de nombre de proveedor después de la adquisición → actualizar todos los contratos
  1. Tras una adquisición, el equipo legal debe actualizar todos los contratos vigentes. PDF para reflejar el nuevo nombre de la entidad.
  2. A SharePoint Los archivos de vigilancia activan eventos para cada contrato en la carpeta de contratos activos.
  3. PDF4me La función Buscar y reemplazar texto sustituye el nombre de la empresa anterior por el nuevo nombre de la entidad en todas las páginas (Secuencia de páginas = todas). Se conservan la fuente y el diseño.
  4. Un nodo adicional de Buscar y reemplazar texto actualiza la dirección registrada de la antigua sede a la nueva sede en el mismo documento.
  5. El contrato actualizado se guarda de nuevo en SharePoint Con nombre de archivo con control de versiones. Una notificación de Slack confirma la actualización al equipo de operaciones legales. Cientos de contratos actualizados en minutos frente a semanas de edición manual con Acrobat.
Personalización de PDF de presupuesto → reemplazar marcadores de posición de clientes
  1. Un webhook del CRM se activa cuando ventas genera una nueva cotización PDF a partir de una plantilla.
  2. PDF4me La función Buscar y reemplazar texto se ejecuta 4 veces en secuencia (nodos encadenados), reemplazando cada vez un marcador de posición: {{CUSTOMER_NAME}}, {{TOTAL_PRICE}}, {{VALID_UNTIL}}, {{ACCOUNT_MANAGER}}.
  3. El presupuesto personalizado se envía al cliente a través de Gmail con un asunto dinámico y un archivo adjunto.
  4. A Salesforce El paso de actualización del registro adjunta la cotización final. PDF a la oportunidad.
  5. Un registro de Airtable guarda información sobre el cliente, el ID de la cotización, el valor total y la marca de tiempo de envío para la elaboración de informes de ventas.
Actualización anual de precios → actualización solo de las portadas del catálogo
  1. Un activador programado se ejecuta el 1 de enero de cada año para actualizar los catálogos de productos con los nuevos precios.
  2. Un paso de lista de Google Drive recupera todos los catálogos. PDF en la carpeta de catálogos.
  3. Un bucle sobre los elementos procesa cada uno PDF. PDF4me La función Buscar y reemplazar texto actualiza "Precios válidos hasta 2024" a "Precios válidos hasta 2025" con la secuencia de página establecida en 1,2 (Solo la portada y el resumen; el cuerpo del libro permanece intacto).
  4. Un segundo nodo Buscar y reemplazar texto actualiza el pie de página del año de copyright en la secuencia de páginas. all.
  5. El catálogo actualizado se vuelve a subir a la misma ubicación de Google Drive, sobrescribiendo la versión anterior. El equipo de marketing recibe un resumen en Slack con la lista de todos los catálogos que se han actualizado.

Preguntas frecuentes

Does Find and Replace Text preserve formatting and layout in the PDF?+
Yes. The replacement preserves the original font, color, size, and surrounding layout. Each occurrence of Old Text is replaced in place: the same character position, line, and text run. Surrounding text, images, page numbering, and document structure remain untouched. This is fundamentally different from converting a PDF to Word, editing, then converting back, which often shifts layout, breaks formatting, and forces manual cleanup. PDF4me modifies the PDF text stream directly without round-tripping through another format.
Can I find and replace text on specific pages only?+
Yes. The Page Sequence parameter accepts: all (entire document: the default), comma-separated page numbers like 1,2,3, page ranges like 1-5 or 10-15, or mixed combinations like 1,2,3-7,10. This is useful when you want to update only the title page, only specific chapters of a manual, only the cover and signature page of a contract, or only the pricing summary in a quote: and leave the body of the document completely untouched.
Does the find work on scanned PDFs or only on native PDFs?+
Find and Replace Text requires a selectable text layer in the source PDF. Native digital PDFs (created from Microsoft Word, Google Docs, LibreOffice, browser print, InDesign, BI tools, accounting software, etc.) work directly. Scanned or photographed PDFs must first be passed through an OCR step: the n8n node "Convert PDF to Editable PDF Using OCR" adds a searchable text layer over the scanned image, after which this node can find and replace within the text content. Chain the two nodes in sequence: OCR first, then Find and Replace.
Can I replace multiple different text patterns in one workflow run?+
Each Find and Replace Text node handles one find-and-replace pair per execution. To apply multiple substitutions, chain the node multiple times, each instance takes the output of the previous as input. For dynamic per-row substitution lists, use a SplitInBatches or Loop Over Items pattern: feed a list of {oldText, newText} pairs, loop, and call this node once per pair. The final output after the loop is the fully updated PDF with all substitutions applied in order. This pattern is the same one used by Microsoft Word and Adobe Acrobat for multi-replacement macros.
How does this compare to manually editing PDFs in Adobe Acrobat, PDFelement, or Foxit?+
Manual desktop PDF editors (Adobe Acrobat Pro, Foxit PhantomPDF, PDFelement, Nitro PDF, PDF-XChange Editor) require a human to open each file, run Find and Replace, save, and close: typically 1-3 minutes per document plus license fees per editor seat (Acrobat Pro is around $20/month/user). The PDF4me n8n node automates the same task: webhooks, schedules, or folder watches trigger the update across hundreds or thousands of PDFs without manual intervention. Use this for bulk vendor-name changes after acquisitions, branding updates across product catalogs, pricing refreshes on quote PDFs, terminology standardization across legal documents, or any standardization task across many documents. The same automation that would require an admin to spend hours in Acrobat runs end-to-end in seconds in n8n.

Acciones relacionadas

Obtén ayuda