Analizar documento en n8n
PDF4me Analizar documento ejecuta su plantilla de análisis guardada contra una PDF dentro de un n8n flujo de trabajo y devuelve los campos extraídos como datos estructurados. Aliméntelo con datos binarios de un nodo anterior, un Base64 cadena, o un público URL, haga referencia a la plantilla por ID de análisisy canalizar el resultado JSON, XML, o CSV directamente en Set, IF, HTTP Request o cualquier flujo descendente n8n nodo. La plantilla contiene la lógica de extracción, por lo que el mismo nodo extrae facturas, contratos, recibos y cualquier diseño personalizado que hayas configurado.
Antes de ejecutar este nodo: crear una plantilla de análisis en el PDF4me panel. Defina sus claves de captura y seleccione Expresión regular para patrones estables o JavaScript Expresión para lógica condicional. El n8n referencias de nodos que la plantilla por ID de análisis. Ver Preparar la información de análisis para el documento Para la configuración completa, ejemplos de expresiones regulares (INV-\d{6,10}, \d{2}/\d{2}/\d{4}), y dos en funcionamiento JavaScript Ejemplos de clasificadores de expresión.
Autenticando su API Pedido
El PDF4me nodo en n8n requiere PDF4me API credenciales. Cree la credencial una vez en n8n con tu API clave del panel de control, luego hacer referencia a ella desde cada PDF4me nodo en tu flujo de trabajo.
Datos importantes que no debes perderte
texto Variable para la clasificación y reglas de reserva.
Parámetros
| Parámetro | Requerido | Lo que hace | Ejemplo |
|---|---|---|---|
| Input Data Type | Yes | How the PDF reaches the node. Binary Data (from a prior node), Base64 String (inline encoded), or URL (public file URL). | Binary Data |
| Input Binary Field | Conditional | Name of the binary field on the input item containing the PDF. Required when Input Data Type is Binary Data. | data |
| Base64 PDF Content | Conditional | Base64 encoded PDF content. Required when Input Data Type is Base64 String. No data: prefix. | JVBERi0xLjQK... |
| PDF URL | Conditional | Publicly reachable URL of the PDF. Required when Input Data Type is URL. The PDF4me service downloads and processes it. | https://example.com/invoice.pdf |
| Document Name | Yes | Source filename including .pdf extension. Used for format detection and error tracing. | invoice.pdf |
| Parse ID | Yes | TemplateId GUID from the PDF4me dashboard. Identifies the parse template (capture keys + extraction rules) to apply. | 12345678-1234-1234-1234-123456789abc |
| Output Format | Yes | Shape of the returned data. JSON (default, structured object), XML (hierarchical), or CSV (flat tabular). JSON is the right choice for almost every n8n workflow. | JSON |
| Output Binary Field Name | Yes | Name of the binary field the node attaches the parsed output to on the output item. Reference it from downstream nodes. | data |
| Custom Profiles | No | Advanced JSON-style overrides for parsing behaviour (output sub-format, include metadata flag, etc). Leave empty for default behaviour. | { "outputDataFormat": "json", "includeMetadata": true } |
Tipos de expresiones en su plantilla de análisis
Las reglas de captura se encuentran en la plantilla, no en la n8n nodo. Ambos tipos de expresiones se envían con cada PDF4me cuenta.
Expresión regularPatrones establesINV-\d{6,10}), fechas (\d{2}/\d{2}/\d{4}), cantidades ($?\d{1,3}(?:,\d{3})*(?:.\d{2})?). Alrededor del 80% de las claves de producción.Expresión JavaScriptLógica condicional y clasificadorestexto; devuelve una cadena. Clasificación de múltiples marcadores, reglas de reserva, normalización de fechas. Ver Preparar la información de análisis para el documento para dos muestras de trabajo.Producción
| Campo | Tipo | Lo que contiene |
|---|---|---|
fileName | String | Generated output filename with timestamp and extension matching Output Format (.json / .xml / .csv). |
mimeType | String | MIME type of the output (application/json, application/xml, text/csv). |
fileSize | Number | Size of the parsed output in bytes. |
success | Boolean | true on a successful parse, false otherwise. Wire into an IF node for branching. |
message | String | Status message. Document parsed successfully on the happy path, or a descriptive error. |
docName | String | Original input filename, preserved for audit trails. |
Los datos de clave/valor analizados residen en el campo binario que nombró en Nombre del campo binario de salida.
Ejemplos de flujo de trabajo
Patrones de flujo de trabajo comunes de n8nTypical ways to chain Parse Document into an n8n workflow.
- El activador de Gmail se dispara con las nuevas facturas etiquetadas como "vendor-invoice".
- El filtro solo permite archivos adjuntos con extensión .pdf.
- El análisis del documento ejecuta la plantilla de factura contra el archivo adjunto binario.
- Se analizaron los mapas de nodos establecidos. invoiceNumber, totalAmount, invoiceDate.
- La instrucción INSERT de Postgres escribe la fila en la tabla accounts_payable.
- El webhook recibe un PDF desde un portal de carga de socios.
- Parse Document ejecuta una plantilla con un JavaScript Clave de expresión que devuelve el tipo de documento.
- Cambiar las rutas de los nodos según el tipo devuelto (factura / pedido / recibo) a las ramas descendentes específicas de cada tipo.
- Cada rama envía los campos analizados al sistema de destino correcto.
- El programa se activa cada 15 minutos.
- S3 List + Obtener objeto carga cada nuevo PDF en el depósito de entrada.
- El análisis del documento ejecuta la plantilla en cada elemento binario.
- La función Crear registro de Airtable escribe los campos analizados en la base de datos de seguimiento.