Analizza il documento in n8n
PDF4me Analizza il documento esegue il tuo modello di analisi salvato rispetto a PDF all'interno di un n8n flusso di lavoro e restituisce i campi estratti come dati strutturati. Forniscigli dati binari da un nodo precedente, un Base64 stringa o un pubblico URL, fare riferimento al modello tramite Analizza IDe inviare tramite pipe il risultato JSON, XML, O CSV direttamente in Set, IF, Richiesta HTTP o qualsiasi flusso successivo n8n nodo. Il modello contiene la logica di estrazione, quindi lo stesso nodo estrae fatture, contratti, ricevute e qualsiasi layout personalizzato che hai configurato.
Prima di eseguire questo nodo: creare un modello di analisi nel PDF4me dashboard. Definisci i tasti di acquisizione e scegli Espressione regolare per modelli stabili o JavaScript Espressione per la logica condizionale. Il n8n nodi fanno riferimento a quel modello tramite Analizza ID. Vedere Prepara le informazioni di analisi per il documento per la configurazione completa, esempi di Regex (INV-\d{6,10}, \d{2}/\d{2}/\d{4}), e due lavoratori JavaScript Esempi di classificatori di espressioni.
Autenticazione del tuo API Richiesta
IL PDF4me nodo in n8n requisiti PDF4me API credenziali. Crea le credenziali una volta n8n con il tuo API chiave dalla dashboard, quindi farvi riferimento da ogni PDF4me nodo nel tuo flusso di lavoro.
Informazioni importanti da non perdere
testo variabile per le regole di classificazione e di fallback.
Parametri
| Parametro | Necessario | Cosa fa | Esempio |
|---|---|---|---|
| Input Data Type | Yes | How the PDF reaches the node. Binary Data (from a prior node), Base64 String (inline encoded), or URL (public file URL). | Binary Data |
| Input Binary Field | Conditional | Name of the binary field on the input item containing the PDF. Required when Input Data Type is Binary Data. | data |
| Base64 PDF Content | Conditional | Base64 encoded PDF content. Required when Input Data Type is Base64 String. No data: prefix. | JVBERi0xLjQK... |
| PDF URL | Conditional | Publicly reachable URL of the PDF. Required when Input Data Type is URL. The PDF4me service downloads and processes it. | https://example.com/invoice.pdf |
| Document Name | Yes | Source filename including .pdf extension. Used for format detection and error tracing. | invoice.pdf |
| Parse ID | Yes | TemplateId GUID from the PDF4me dashboard. Identifies the parse template (capture keys + extraction rules) to apply. | 12345678-1234-1234-1234-123456789abc |
| Output Format | Yes | Shape of the returned data. JSON (default, structured object), XML (hierarchical), or CSV (flat tabular). JSON is the right choice for almost every n8n workflow. | JSON |
| Output Binary Field Name | Yes | Name of the binary field the node attaches the parsed output to on the output item. Reference it from downstream nodes. | data |
| Custom Profiles | No | Advanced JSON-style overrides for parsing behaviour (output sub-format, include metadata flag, etc). Leave empty for default behaviour. | { "outputDataFormat": "json", "includeMetadata": true } |
Tipi di espressione nel tuo modello di analisi
Le regole di cattura risiedono nel modello, non nel n8n nodo. Entrambi i tipi di espressione vengono forniti con ogni PDF4me account.
Espressione regolareModelli stabiliINV-\d{6,10}), date (\d{2}/\d{2}/\d{4}), importi ($?\d{1,3}(?:,\d{3})*(?:.\d{2})?Circa l'80% delle chiavi di produzione.Espressione JavaScriptLogica condizionale e classificatoritesto; restituisce una stringa. Classificazione multimarcatore, regole di fallback, normalizzazione della data. Vedi Prepara le informazioni di analisi per il documento per due campioni di lavoro.Produzione
| Campo | Tipo | Cosa contiene |
|---|---|---|
fileName | String | Generated output filename with timestamp and extension matching Output Format (.json / .xml / .csv). |
mimeType | String | MIME type of the output (application/json, application/xml, text/csv). |
fileSize | Number | Size of the parsed output in bytes. |
success | Boolean | true on a successful parse, false otherwise. Wire into an IF node for branching. |
message | String | Status message. Document parsed successfully on the happy path, or a descriptive error. |
docName | String | Original input filename, preserved for audit trails. |
I dati chiave/valore analizzati risiedono nel campo binario che hai nominato in Nome del campo binario di output.
Esempi di flusso di lavoro
Modelli di flusso di lavoro comuni di n8nTypical ways to chain Parse Document into an n8n workflow.
- Il trigger di Gmail si attiva alla comparsa di nuove fatture denominate "vendor-invoice".
- Il filtro consente il passaggio solo degli allegati con estensione .pdf.
- La funzione "Parse Document" esegue il modello di fattura sul file allegato binario.
- Imposta le mappe dei nodi analizzate invoiceNumber, totalAmount, invoiceDate.
- Postgres Insert scrive la riga nella tabella accounts_payable.
- Il webhook riceve un PDF da un portale di caricamento partner.
- Analizza documento esegue un modello con un JavaScript Chiave espressione che restituisce il tipo di documento.
- Modifica i percorsi dei nodi sul tipo restituito (fattura/ordine/ricevuta) verso i rami a valle specifici del tipo.
- Ciascun ramo invia i campi analizzati al sistema di destinazione corretto.
- Programmare l'attivazione del segnale ogni 15 minuti.
- Elenco S3 + Ottieni oggetto carica ogni nuovo PDF nel bucket in entrata.
- La funzione Parse Document esegue il modello su ciascun elemento binario.
- La funzione "Crea record" di Airtable scrive i campi analizzati nel database di tracciamento.