Saltar al contenido principal

Dividir PDF por texto usando n8n acción

PDF4me Dividir PDF por texto divide PDF documentos basados en patrones de texto y contenido detectados a través de n8n Flujos de trabajo de automatización. Proceso PDFs a través de n8n disparadores, datos binarios, cadenas base64 o público URLs Esta solución permite encontrar automáticamente cadenas de texto específicas, dividir documentos en las ubicaciones de texto y organizar archivos utilizando el contenido detectado para una nomenclatura de archivos inteligente. Es ideal para la separación de facturas, la división de contratos, el procesamiento de documentos por lotes, la organización basada en contenido, el archivo automatizado y los flujos de trabajo de clasificación de documentos basados en texto que requieren una detección precisa de texto con división inteligente de documentos e integración perfecta.

Entradas de blog relacionadas
Aún no hay ninguna entrada de blog sobre esta función; estará disponible próximamente.
Mientras tanto, echa un vistazo al blog de PDF4me para encontrar tutoriales y flujos de trabajo para todas las plataformas.
Visita el blog

Configuración

Añade el PDF4me "Dividir PDF por texto" nodo a su n8n flujo de trabajo y configure los parámetros necesarios. Para obtener instrucciones de configuración inicial, consulte nuestra n8n Guía de integración.

Requisitos previos:

  • PDF4me API credenciales
  • n8n acceso al flujo de trabajo

Configuración:

  1. Agregar PDF4me nodo a flujo de trabajo
  2. Seleccione "Dividir" PDF acción "por texto"
  3. Configure los parámetros de entrada (véase más abajo).
Dividir PDF por texto

Parámetros

Lista completa de parámetros para la función Split PDF Por acción de texto. Configure estos parámetros para controlar la acción basada en texto. PDF división.

Importante: Los parámetros marcados con un asterisco (***) son obligatorios y deben proporcionarse para que la acción funcione correctamente.

ParámetroTipoDescripciónEjemplo
Tipo de datos de entrada***StringPDF Selección del formato de entrada
• Elija el formato de su PDF entrada de datos
PDF4me admite varios tipos de entrada
• Opciones: Datos binarios, cadena Base64 o URL
Binary Data
Nombre de la propiedad binariaStringBinario PDF Entrada de archivo (Obligatorio si se trata de datos binarios)
• Referencia PDF archivo de anterior n8n carga de nodos o archivos
PDF4me procesos binarios PDF archivos con detección automática de formato
• Obligatorio cuando el tipo de datos de entrada es "Datos binarios".
data
Contenido del documento Base64StringBase64 Codificado PDF Aporte (Obligatorio si se trata de una cadena Base64)
• Proporcionar PDF datos como cadena codificada en base64
PDF4me decodifica y procesa automáticamente el PDF contenido
• Obligatorio cuando el tipo de datos de entrada es "Base64 Cadena"
UEsDBBQABgAI...
URL del archivoStringPúblico PDF URL Aporte (Obligatorio si se trata de una URL)
• Proporcionar un permiso público/abierto URL hacia PDF archivo
PDF4me descarga y procesa el archivo desde URL
• Obligatorio cuando el tipo de datos de entrada es "URL"
https://abc.com/sample.pdf
Texto para buscar***StringEspecificación de búsqueda de texto
• Especifique la cadena de texto exacta que se debe buscar dentro del texto. PDF
PDF4me utiliza este texto como punto de división para dividir el documento
• Coincidencia sensible a mayúsculas y minúsculas para una detección de texto precisa.
page 1, line 10.
Página de texto dividido***StringSelección de posición dividida
• Elige dónde dividir el PDF relativo al texto detectado
• Opciones: Después (dividir después de la página), Antes (dividir antes de la página)
PDF4me proporciona un posicionamiento dividido flexible
After
Nombres de archivo***StringConvención para nombrar los archivos de salida
• Elija cómo se genera la división PDF Los archivos deben ser nombrados
• Opciones: Nombre según el pedido (secuencial), Nombre según la página (con números de página)
• Ayuda a organizar los archivos de salida
Name As Per Order
Nombre del archivo***StringEspecificación del nombre del archivo de salida
• Especifique el nombre para la división generada. PDF archivo
• Debe incluir la extensión .pdf
PDF4me garantiza la validación de nombres y formatos únicos.
output.pdf
Nombre del campo binario de salida***StringMapeo de datos binarios
• Defina el nombre de la variable para acceder a la división generada. PDF datos
• Se utiliza en acciones de flujo de trabajo posteriores
• Esencial para el flujo de datos del flujo de trabajo
data

Opciones avanzadas

Los siguientes parámetros están disponibles en la sección Opciones avanzadas y son opcionales:

ParámetroTipoDescripciónEjemplo
Perfiles personalizadosStringPerfiles de configuración personalizados
• Configure opciones adicionales mediante perfiles personalizados.
JSONformato similar que contiene parámetros predefinidos
• Admite outputDataFormat, preserveMetadata, etc.
• Opcional para requisitos especializados
{ "outputDataFormat": "base64", "preserveMetadata": true, "optimizeForPrinting": false, "compressionLevel": "medium" }

Producción

Parámetros de salida

ParámetroTipoDescripciónEjemplo
éxitoBooleanPDF4me Indicador de estado de la operación de división de texto - Boolean bandera que indica el éxito o el fracaso de la PDF proceso de división de texto. PDF4me devoluciones true para operaciones exitosas y false para cualquier error, lo que permite un manejo de errores robusto en flujos de trabajo automatizadostrue
mensajeStringPDF4me Mensaje de estado de la operación de división de texto - Mensaje de estado legible para humanos que proporciona detalles sobre el resultado del proceso de división de texto. Incluye confirmación de éxito o detalles de error para la resolución de problemas.PDF split by text successfully
Nombre del archivoStringPDF4me división generada PDF Nombre del archivo - El nombre de archivo completo de la división generada correctamente PDF Documento con la extensión .pdf correcta. PDF4me Garantiza una nomenclatura única y valida el cumplimiento del formato de archivo para una integración perfecta con los procesos posteriores.text_split_output.pdf
tipo mimeStringPDF4me producción MIME tipo - MIME tipo del generado PDF archivo, siempre "application/pdf" para PDF documentos. Útil para la validación del tipo de contenido y el manejo adecuado de archivos en aplicaciones web.application/pdf
Tamaño del archivoNúmeroPDF4me dividir PDF Tamaño del archivo en bytes - El tamaño exacto de la división generada PDF archivo en bytes, proporcionado por PDF4me Para la planificación del almacenamiento, la optimización del ancho de banda y la monitorización de la transferencia de archivos. Imprescindible para la gestión documental empresarial y la automatización del flujo de trabajo.125430
Nombre del documentoStringPDF4me Referencia del nombre del documento - El nombre del documento dividido procesado para fines de referencia y seguimiento. Esto coincide con el fileName para lograr coherencia en los flujos de trabajo de gestión documentaltext_split_output.pdf
textSplitCompletadoBooleanPDF4me confirmación de finalización de la división de texto - Boolean bandera que confirma que la PDF La operación de división de texto se ha completado con éxito. Útil para verificar que la división basada en texto se aplicó correctamente.true
Se encontraron coincidencias de textoNúmeroPDF4me recuento de coincidencias de texto detectadas - El número de coincidencias de texto que se encontraron con éxito y se utilizaron como puntos de división en el PDF Documento. Útil para realizar un seguimiento de la eficacia de la detección de texto y la precisión de la división.3
archivos generadosNúmeroPDF4me recuento generado de archivos divididos - El número de individuos PDF Archivos generados correctamente a partir de la operación de división de texto. Útil para realizar un seguimiento de la integridad de la división y los resultados de la segmentación de documentos.4

N8N Respuesta a la acción

El PDF4me Dividir PDF por texto API Devuelve una respuesta que se puede visualizar en varios formatos. Elija la vista que mejor se adapte a sus necesidades:

JSON Formato de respuesta

El crudo JSON respuesta de la API:

[
{
"success": true,
"message": "PDF split by text successfully",
"fileName": "text_split_output.pdf",
"mimeType": "application/pdf",
"fileSize": 125430,
"docName": "text_split_output.pdf",
"textSplitCompleted": true,
"textMatchesFound": 3,
"filesGenerated": 4
}
]

Casos de uso

Procesamiento de documentos y gestión de contenido

  • Divida los documentos grandes en marcadores de texto específicos o encabezados de sección para crear archivos organizados y manejables para diferentes departamentos o procesos.
  • Procese documentos legales dividiéndolos en marcadores de cláusulas o separadores de secciones específicos para crear archivos individuales para cada sección legal.
  • Automatice la separación de informes y manuales según los títulos de los capítulos o los encabezados de las secciones para una mejor organización del contenido.

Automatización de procesos empresariales

  • Divida los lotes de facturas buscando patrones de texto específicos como "Número de factura" o "Fecha de vencimiento" para crear archivos de factura individuales para cada transacción.
  • Procese contratos y acuerdos dividiéndolos en marcadores de texto específicos como "Sección" o "Artículo" para crear archivos separados para cada sección.
  • Automatice la organización de documentos financieros dividiéndolos por patrones de texto como "Informe trimestral" o "Resumen anual" para diferentes períodos de presentación de informes.

Distribución de contenido y gestión del flujo de trabajo

  • Divida los documentos confidenciales en marcadores de texto específicos para crear archivos separados para diferentes partes interesadas según los requisitos de acceso.
  • Procesar los materiales de capacitación dividiéndolos por patrones de texto como "Módulo" o "Lección" para crear módulos de aprendizaje individuales para diferentes audiencias.
  • Automatice la organización de la documentación técnica dividiéndola en marcadores de texto como "Referencia de API" o "Guía del usuario" para diferentes tipos de usuarios.

Obtén ayuda