Analyser le document dans n8n
PDF4me Analyser le document exécute votre modèle d'analyse enregistré sur un PDF à l'intérieur d'un n8n Le flux de travail renvoie les champs extraits sous forme de données structurées. Il peut être alimenté avec des données binaires provenant d'un nœud précédent. Base64 chaîne de caractères, ou une chaîne publique URL, référencez le modèle par Analyser l'IDet acheminer le résultat JSON, XML, ou CSV directement dans Set, IF, HTTP Request ou toute fonction en aval n8n Le modèle contient la logique d'extraction ; ainsi, le même nœud extrait les factures, les contrats, les reçus et toute mise en page personnalisée que vous avez configurée.
Avant d'exécuter ce nœud : créer un modèle d'analyse dans le PDF4me tableau de bord. Définissez vos touches de capture et sélectionnez Expression régulière pour des modèles stables ou JavaScript Expression pour la logique conditionnelle. n8n références de nœuds qui modèle par Analyser l'ID. Voir Préparer les informations d'analyse pour le document pour une configuration complète, exemples d'expressions régulières (INV-\d{6,10}, \d{2}/\d{2}/\d{4}), et deux travailleurs JavaScript Exemples de classificateur d'expressions.
Authentification de votre API Demande
Le PDF4me nœud dans n8n nécessite PDF4me API informations d'identificationCréez l'identifiant une seule fois dans n8n avec votre API clé du tableau de bord, puis référencez-la depuis chaque PDF4me nœud dans votre flux de travail.
Informations importantes à ne pas manquer
texte Variable pour la classification et les règles de repli.
Paramètres
| Paramètre | Requis | Ce que cela fait | Exemple |
|---|---|---|---|
| Input Data Type | Yes | How the PDF reaches the node. Binary Data (from a prior node), Base64 String (inline encoded), or URL (public file URL). | Binary Data |
| Input Binary Field | Conditional | Name of the binary field on the input item containing the PDF. Required when Input Data Type is Binary Data. | data |
| Base64 PDF Content | Conditional | Base64 encoded PDF content. Required when Input Data Type is Base64 String. No data: prefix. | JVBERi0xLjQK... |
| PDF URL | Conditional | Publicly reachable URL of the PDF. Required when Input Data Type is URL. The PDF4me service downloads and processes it. | https://example.com/invoice.pdf |
| Document Name | Yes | Source filename including .pdf extension. Used for format detection and error tracing. | invoice.pdf |
| Parse ID | Yes | TemplateId GUID from the PDF4me dashboard. Identifies the parse template (capture keys + extraction rules) to apply. | 12345678-1234-1234-1234-123456789abc |
| Output Format | Yes | Shape of the returned data. JSON (default, structured object), XML (hierarchical), or CSV (flat tabular). JSON is the right choice for almost every n8n workflow. | JSON |
| Output Binary Field Name | Yes | Name of the binary field the node attaches the parsed output to on the output item. Reference it from downstream nodes. | data |
| Custom Profiles | No | Advanced JSON-style overrides for parsing behaviour (output sub-format, include metadata flag, etc). Leave empty for default behaviour. | { "outputDataFormat": "json", "includeMetadata": true } |
Types d'expressions dans votre modèle d'analyse
Les règles de capture se trouvent dans le modèle, et non dans le n8n Les deux types d'expressions sont fournis avec chaque nœud. PDF4me compte.
Expression régulièreModèles stablesINV-\d{6,10}), dates (\d{2}/\d{2}/\d{4}), montants ($?\d{1,3}(?:,\d{3})*(?:.\d{2})?Environ 80 % des clés de production.Expression JavaScriptLogique conditionnelle et classificateurstexte; renvoie une chaîne de caractères. Classification multi-marqueurs, règles de repli, normalisation des dates. Voir Préparer les informations d'analyse pour le document pour deux échantillons de travail.Sortir
| Champ | Taper | Ce qu'il contient |
|---|---|---|
fileName | String | Generated output filename with timestamp and extension matching Output Format (.json / .xml / .csv). |
mimeType | String | MIME type of the output (application/json, application/xml, text/csv). |
fileSize | Number | Size of the parsed output in bytes. |
success | Boolean | true on a successful parse, false otherwise. Wire into an IF node for branching. |
message | String | Status message. Document parsed successfully on the happy path, or a descriptive error. |
docName | String | Original input filename, preserved for audit trails. |
Les données clé/valeur analysées se trouvent dans le champ binaire que vous avez nommé. Nom du champ binaire de sortie.
Exemples de flux de travail
Modèles de flux de travail n8n courantsTypical ways to chain Parse Document into an n8n workflow.
- Le déclencheur Gmail s'active sur les nouvelles factures étiquetées « facture fournisseur ».
- Le filtre ne laisse passer que les pièces jointes se terminant par .pdf.
- L'outil Analyse de document applique le modèle de facture à la pièce jointe binaire.
- Ensemble des cartes de nœuds analysées invoiceNumber, totalAmount, invoiceDate.
- Postgres Insert inscrit la ligne dans la table accounts_payable.
- Le webhook reçoit un PDF depuis un portail de téléchargement partenaire.
- Analyser le document exécute un modèle avec un JavaScript Clé d'expression renvoyant le type de document.
- Basculer les routes des nœuds sur le type renvoyé (facture / commande / reçu) vers des branches en aval spécifiques au type.
- Chaque branche envoie les champs analysés au système de destination approprié.
- Programmer des déclenchements toutes les 15 minutes.
- Liste S3 + Obtenir un objet charge chaque nouvel PDF dans le compartiment des entrées.
- L'outil Analyser le document applique le modèle à chaque élément binaire.
- La fonction Créer un enregistrement d'Airtable inscrit les champs analysés dans la base de suivi.