Analisar documento em n8n
PDF4me Analisar documento executa seu modelo de análise salvo em um PDF dentro de um n8n fluxo de trabalho e retorna os campos extraídos como dados estruturados. Alimente-o com dados binários de um nó anterior, um Base64 string, ou um público URL, faça referência ao modelo por ID de análisee canalize o resultado JSON, XML, ou CSV diretamente em Set, IF, HTTP Request ou qualquer outro método subsequente. n8n O nó contém a lógica de extração, portanto, o mesmo nó extrai faturas, contratos, recibos e qualquer layout personalizado que você tenha configurado.
Antes de executar este nó: criar um modelo de análise no PDF4me painel. Defina suas teclas de captura e selecione Expressão regular para padrões estáveis ou JavaScript Expressão para lógica condicional. O n8n nós fazem referência a esse modelo por ID de análise. Ver Preparar informações de análise para o documento Para configuração completa, exemplos de Regex (INV-\d{6,10}, \d{2}/\d{2}/\d{4}), e dois trabalhando JavaScript Exemplos de classificadores de expressão.
Autenticando seu API Solicitar
O PDF4me nó em n8n requer PDF4me API credenciaisCrie a credencial uma única vez em n8n com o seu API A chave é obtida do painel de controle e, em seguida, referencie-a em todos os locais. PDF4me nó em seu fluxo de trabalho.
Fatos importantes que você não deve perder
texto Variável para regras de classificação e de contingência.
Parâmetros
| Parâmetro | Obrigatório | O que faz | Exemplo |
|---|---|---|---|
| Input Data Type | Yes | How the PDF reaches the node. Binary Data (from a prior node), Base64 String (inline encoded), or URL (public file URL). | Binary Data |
| Input Binary Field | Conditional | Name of the binary field on the input item containing the PDF. Required when Input Data Type is Binary Data. | data |
| Base64 PDF Content | Conditional | Base64 encoded PDF content. Required when Input Data Type is Base64 String. No data: prefix. | JVBERi0xLjQK... |
| PDF URL | Conditional | Publicly reachable URL of the PDF. Required when Input Data Type is URL. The PDF4me service downloads and processes it. | https://example.com/invoice.pdf |
| Document Name | Yes | Source filename including .pdf extension. Used for format detection and error tracing. | invoice.pdf |
| Parse ID | Yes | TemplateId GUID from the PDF4me dashboard. Identifies the parse template (capture keys + extraction rules) to apply. | 12345678-1234-1234-1234-123456789abc |
| Output Format | Yes | Shape of the returned data. JSON (default, structured object), XML (hierarchical), or CSV (flat tabular). JSON is the right choice for almost every n8n workflow. | JSON |
| Output Binary Field Name | Yes | Name of the binary field the node attaches the parsed output to on the output item. Reference it from downstream nodes. | data |
| Custom Profiles | No | Advanced JSON-style overrides for parsing behaviour (output sub-format, include metadata flag, etc). Leave empty for default behaviour. | { "outputDataFormat": "json", "includeMetadata": true } |
Tipos de expressão em seu modelo de análise
As regras de captura residem no modelo, não no... n8n nó. Ambos os tipos de expressão são fornecidos com cada PDF4me conta.
Expressão regularPadrões estáveisINV-\d{6,10}), datas (\d{2}/\d{2}/\d{4}), quantidades ($?\d{1,3}(?:,\d{3})*(?:.\d{2})?Cerca de 80% das chaves de produção.Expressão JavaScriptLógica condicional e classificadorestextoRetorna uma string. Classificação com múltiplos marcadores, regras de fallback, normalização de datas. Veja Preparar informações de análise para o documento para duas amostras de trabalho.Saída
| Campo | Tipo | O que contém |
|---|---|---|
fileName | String | Generated output filename with timestamp and extension matching Output Format (.json / .xml / .csv). |
mimeType | String | MIME type of the output (application/json, application/xml, text/csv). |
fileSize | Number | Size of the parsed output in bytes. |
success | Boolean | true on a successful parse, false otherwise. Wire into an IF node for branching. |
message | String | Status message. Document parsed successfully on the happy path, or a descriptive error. |
docName | String | Original input filename, preserved for audit trails. |
Os dados de chave/valor analisados residem no campo binário que você especificou em Nome do campo binário de saída.
Exemplos de fluxo de trabalho
Padrões comuns de fluxo de trabalho n8nTypical ways to chain Parse Document into an n8n workflow.
- O gatilho do Gmail é acionado em novas faturas com a etiqueta "fatura de fornecedor".
- O filtro permite apenas anexos com extensão .pdf.
- A função "Parse Document" executa o modelo de fatura com base no anexo binário.
- Conjunto de mapas de nós analisados invoiceNumber, totalAmount, invoiceDate.
- O comando Insert do Postgres grava a linha na tabela accounts_payable.
- O webhook recebe um PDF de um portal de upload de parceiros.
- A função Parse Document executa um modelo com um JavaScript Chave de expressão que retorna o tipo de documento.
- Alterne as rotas dos nós com base no tipo retornado (fatura / pedido / recibo) para ramificações downstream específicas do tipo.
- Cada filial envia os campos analisados para o sistema de destino correto.
- Programe disparos de gatilho a cada 15 minutos.
- A lista S3 + Obter Objeto carrega cada novo PDF no bucket de entrada.
- A função Parse Document executa o modelo em cada item binário.
- A função Criar Registro do Airtable grava os campos analisados na base de rastreamento.