Dividir PDF por texto usando n8n acción
PDF4me Dividir PDF por texto divide PDF documentos basados en patrones de texto y contenido detectados a través de n8n Flujos de trabajo de automatización. Proceso PDFs a través de n8n disparadores, datos binarios, cadenas base64 o público URLs Esta solución permite encontrar automáticamente cadenas de texto específicas, dividir documentos en las ubicaciones de texto y organizar archivos utilizando el contenido detectado para una nomenclatura de archivos inteligente. Es ideal para la separación de facturas, la división de contratos, el procesamiento de documentos por lotes, la organización basada en contenido, el archivo automatizado y los flujos de trabajo de clasificación de documentos basados en texto que requieren una detección precisa de texto con división inteligente de documentos e integración perfecta.
Configuración
Añade el PDF4me "Dividir PDF por texto" nodo a su n8n flujo de trabajo y configure los parámetros necesarios. Para obtener instrucciones de configuración inicial, consulte nuestra n8n Guía de integración.
Requisitos previos:
- PDF4me API credenciales
- n8n acceso al flujo de trabajo
Configuración:
- Agregar PDF4me nodo a flujo de trabajo
- Seleccione "Dividir" PDF acción "por texto"
- Configure los parámetros de entrada (véase más abajo).

Parámetros
Lista completa de parámetros para la función Split PDF Por acción de texto. Configure estos parámetros para controlar la acción basada en texto. PDF división.
Importante: Los parámetros marcados con un asterisco (***) son obligatorios y deben proporcionarse para que la acción funcione correctamente.
| Parámetro | Tipo | Descripción | Ejemplo |
|---|---|---|---|
| Tipo de datos de entrada*** | String | PDF Selección del formato de entrada • Elija el formato de su PDF entrada de datos • PDF4me admite varios tipos de entrada • Opciones: Datos binarios, cadena Base64 o URL | Binary Data |
| Nombre de la propiedad binaria | String | Binario PDF Entrada de archivo (Obligatorio si se trata de datos binarios) • Referencia PDF archivo de anterior n8n carga de nodos o archivos • PDF4me procesos binarios PDF archivos con detección automática de formato • Obligatorio cuando el tipo de datos de entrada es "Datos binarios". | data |
| Contenido del documento Base64 | String | Base64 Codificado PDF Aporte (Obligatorio si se trata de una cadena Base64) • Proporcionar PDF datos como cadena codificada en base64 • PDF4me decodifica y procesa automáticamente el PDF contenido • Obligatorio cuando el tipo de datos de entrada es "Base64 Cadena" | UEsDBBQABgAI... |
| URL del archivo | String | Público PDF URL Aporte (Obligatorio si se trata de una URL) • Proporcionar un permiso público/abierto URL hacia PDF archivo • PDF4me descarga y procesa el archivo desde URL • Obligatorio cuando el tipo de datos de entrada es "URL" | https://abc.com/sample.pdf |
| Texto para buscar*** | String | Especificación de búsqueda de texto • Especifique la cadena de texto exacta que se debe buscar dentro del texto. PDF • PDF4me utiliza este texto como punto de división para dividir el documento • Coincidencia sensible a mayúsculas y minúsculas para una detección de texto precisa. | page 1, line 10. |
| Página de texto dividido*** | String | Selección de posición dividida • Elige dónde dividir el PDF relativo al texto detectado • Opciones: Después (dividir después de la página), Antes (dividir antes de la página) • PDF4me proporciona un posicionamiento dividido flexible | After |
| Nombres de archivo*** | String | Convención para nombrar los archivos de salida • Elija cómo se genera la división PDF Los archivos deben ser nombrados • Opciones: Nombre según el pedido (secuencial), Nombre según la página (con números de página) • Ayuda a organizar los archivos de salida | Name As Per Order |
| Nombre del archivo*** | String | Especificación del nombre del archivo de salida • Especifique el nombre para la división generada. PDF archivo • Debe incluir la extensión .pdf • PDF4me garantiza la validación de nombres y formatos únicos. | output.pdf |
| Nombre del campo binario de salida*** | String | Mapeo de datos binarios • Defina el nombre de la variable para acceder a la división generada. PDF datos • Se utiliza en acciones de flujo de trabajo posteriores • Esencial para el flujo de datos del flujo de trabajo | data |
Opciones avanzadas
Los siguientes parámetros están disponibles en la sección Opciones avanzadas y son opcionales:
| Parámetro | Tipo | Descripción | Ejemplo |
|---|---|---|---|
| Perfiles personalizados | String | Perfiles de configuración personalizados • Configure opciones adicionales mediante perfiles personalizados. • JSONformato similar que contiene parámetros predefinidos • Admite outputDataFormat, preserveMetadata, etc. • Opcional para requisitos especializados | { "outputDataFormat": "base64", "preserveMetadata": true, "optimizeForPrinting": false, "compressionLevel": "medium" } |
Producción
Parámetros de salida
| Parámetro | Tipo | Descripción | Ejemplo |
|---|---|---|---|
| éxito | Boolean | PDF4me Indicador de estado de la operación de división de texto - Boolean bandera que indica el éxito o el fracaso de la PDF proceso de división de texto. PDF4me devoluciones true para operaciones exitosas y false para cualquier error, lo que permite un manejo de errores robusto en flujos de trabajo automatizados | true |
| mensaje | String | PDF4me Mensaje de estado de la operación de división de texto - Mensaje de estado legible para humanos que proporciona detalles sobre el resultado del proceso de división de texto. Incluye confirmación de éxito o detalles de error para la resolución de problemas. | PDF split by text successfully |
| Nombre del archivo | String | PDF4me división generada PDF Nombre del archivo - El nombre de archivo completo de la división generada correctamente PDF Documento con la extensión .pdf correcta. PDF4me Garantiza una nomenclatura única y valida el cumplimiento del formato de archivo para una integración perfecta con los procesos posteriores. | text_split_output.pdf |
| tipo mime | String | PDF4me producción MIME tipo - MIME tipo del generado PDF archivo, siempre "application/pdf" para PDF documentos. Útil para la validación del tipo de contenido y el manejo adecuado de archivos en aplicaciones web. | application/pdf |
| Tamaño del archivo | Número | PDF4me dividir PDF Tamaño del archivo en bytes - El tamaño exacto de la división generada PDF archivo en bytes, proporcionado por PDF4me Para la planificación del almacenamiento, la optimización del ancho de banda y la monitorización de la transferencia de archivos. Imprescindible para la gestión documental empresarial y la automatización del flujo de trabajo. | 125430 |
| Nombre del documento | String | PDF4me Referencia del nombre del documento - El nombre del documento dividido procesado para fines de referencia y seguimiento. Esto coincide con el fileName para lograr coherencia en los flujos de trabajo de gestión documental | text_split_output.pdf |
| textSplitCompletado | Boolean | PDF4me confirmación de finalización de la división de texto - Boolean bandera que confirma que la PDF La operación de división de texto se ha completado con éxito. Útil para verificar que la división basada en texto se aplicó correctamente. | true |
| Se encontraron coincidencias de texto | Número | PDF4me recuento de coincidencias de texto detectadas - El número de coincidencias de texto que se encontraron con éxito y se utilizaron como puntos de división en el PDF Documento. Útil para realizar un seguimiento de la eficacia de la detección de texto y la precisión de la división. | 3 |
| archivos generados | Número | PDF4me recuento generado de archivos divididos - El número de individuos PDF Archivos generados correctamente a partir de la operación de división de texto. Útil para realizar un seguimiento de la integridad de la división y los resultados de la segmentación de documentos. | 4 |
N8N Respuesta a la acción
El PDF4me Dividir PDF por texto API Devuelve una respuesta que se puede visualizar en varios formatos. Elija la vista que mejor se adapte a sus necesidades:
- JSON
- Table
- Schema
- Binary
JSON Formato de respuesta
El crudo JSON respuesta de la API:
[
{
"success": true,
"message": "PDF split by text successfully",
"fileName": "text_split_output.pdf",
"mimeType": "application/pdf",
"fileSize": 125430,
"docName": "text_split_output.pdf",
"textSplitCompleted": true,
"textMatchesFound": 3,
"filesGenerated": 4
}
]
Vista de tabla
Datos de respuesta en formato de tabla estructurada:
| Parámetro | Valor |
|---|---|
| success | true |
| message | PDF split by text successfully |
| fileName | text_split_output.pdf |
| mimeType | application/pdf |
| fileSize | 125430 |
| docName | text_split_output.pdf |
| textSplitCompleted | true |
| textMatchesFound | 3 |
| filesGenerated | 4 |
Vista de esquema
Estructura de datos y tipos de respuesta:
1 item
success: ☑ true
message: AB PDF split by text successfully
fileName: AB text_split_output.pdf
mimeType: AB application/pdf
fileSize: # 125430
docName: AB text_split_output.pdf
textSplitCompleted: ☑ true
textMatchesFound: # 3
filesGenerated: # 4
Indicadores de tipo:
AB= String#= Número☑= Boolean
Vista de datos binarios
Los datos y metadatos reales del archivo PDF dividido:
data
─────────────────────────────
File Name: text_split_output.pdf
File Extension: pdf
Mime Type: application/pdf
File Size: 122.5 KB
Acceso a datos binarios:
- n8n Objeto binario:
$binary.data.data - Base64 ContenidoDisponible para uso directo
- Operaciones de archivosListo para descargar, enviar por correo electrónico o almacenar.
Casos de uso
Procesamiento de documentos y gestión de contenido
- Divida los documentos grandes en marcadores de texto específicos o encabezados de sección para crear archivos organizados y manejables para diferentes departamentos o procesos.
- Procese documentos legales dividiéndolos en marcadores de cláusulas o separadores de secciones específicos para crear archivos individuales para cada sección legal.
- Automatice la separación de informes y manuales según los títulos de los capítulos o los encabezados de las secciones para una mejor organización del contenido.
Automatización de procesos empresariales
- Divida los lotes de facturas buscando patrones de texto específicos como "Número de factura" o "Fecha de vencimiento" para crear archivos de factura individuales para cada transacción.
- Procese contratos y acuerdos dividiéndolos en marcadores de texto específicos como "Sección" o "Artículo" para crear archivos separados para cada sección.
- Automatice la organización de documentos financieros dividiéndolos por patrones de texto como "Informe trimestral" o "Resumen anual" para diferentes períodos de presentación de informes.
Distribución de contenido y gestión del flujo de trabajo
- Divida los documentos confidenciales en marcadores de texto específicos para crear archivos separados para diferentes partes interesadas según los requisitos de acceso.
- Procesar los materiales de capacitación dividiéndolos por patrones de texto como "Módulo" o "Lección" para crear módulos de aprendizaje individuales para diferentes audiencias.
- Automatice la organización de la documentación técnica dividiéndola en marcadores de texto como "Referencia de API" o "Guía del usuario" para diferentes tipos de usuarios.