IA - Analyseur de documents dans n8n
Que fait ce nœud ?
PDF4me Analyseur de documents IA extrait des données structurées de n'importe quel document en exécutant un script enregistré AI Analyseur de votre PDF4me compte par rapport au fichier. Contrairement aux analyseurs fixes (AI-Invoice Parser, AI-Process Contract), vous choisissez le AI Identifiant de l'analyseur à partir d'une liste déroulante d'analyseurs configurés dans le PDF4me Le tableau de bord permet ainsi au même nœud de gérer les factures, les bons de commande, les reçus, les formulaires personnalisés, les rapports de laboratoire, les modèles internes, bref, tout ce que vous décrivez dans un schéma. Utilisez un Analyser Analyseur pour un schéma unique ou un Classer Analyseur pour plusieurs variantes de documents en un seul appel. Renvoie des résultats dynamiques. JSON indexé par votre schéma plus un _métadonnées bloc, pas de fichier binaire.
Exemple de facture pour test
Utilisez cet exemple de facture fournisseur pour vérifier que le nœud fonctionne de bout en bout avant de connecter votre flux de travail à des données réelles. Configurez-le comme une entrée binaire et sélectionnez default_invoice_extraction comme le AI Identifiant de l'analyseur.
Authentification de votre API Demande
Chaque PDF4me nœud dans n8n nécessite un numéro valide Identifiant pour se connecter avecCréez ou sélectionnez-en un qui contient votre PDF4me API clé permettant au flux de travail de s'authentifier AI Les demandes d'extraction sont sécurisées. Les mêmes identifiants sont également utilisés pour… AI Identifiant de l'analyseur menu déroulant via GetAnalyzerId API.
Configurez d'abord votre analyseur.
- Liste des analyseurs (étapes 1–2):
https://dev.pdf4me.com/dashboard/#/ai-document-parser/ - Détails de l'analyseur (étapes 3–5):
https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>
Informations importantes à ne pas manquer
_métadonnées L'objet est toujours complété par le succès, le message, l'horodatage, le nom du fichier source, l'identifiant de l'analyseur et l'opération. Il n'y a pas de Nom du champ binaire de sortie.
Panneau de nœud complet : Extraire → AI Analyseur de documents avec entrée de données binaires. Choisissez un AI Identifiant de l'analyseur avant de courir.
Paramètres
- Liste des analyseurs (étapes 1–2):
https://dev.pdf4me.com/dashboard/#/ai-document-parser/ - Détails de l'analyseur (étapes 3–5):
https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>
Requis dans le n8n Interface utilisateur : Identifiants de connexion, Type de données d'entrée, Nom du document, AI L'identifiant de l'analyseur et les champs obligatoires conditionnels (champ binaire d'entrée, contenu de document Base64 ou URL du document) n'apparaissent que lorsque le type de données d'entrée correspondant est sélectionné. Il n'y a pas d'autre option. Nom du champ binaire de sortie et non Options avancées / Profils personnalisés sur cette opération.
| Paramètre | Requis | Ce que cela fait | Exemple |
|---|---|---|---|
| Input Data Type | Yes | How the document is supplied. Binary Data reads from a previous node (default, most common). Base64 String accepts an encoded document. URL downloads the document from a public link. | Binary Data |
| Input Binary Field | Conditional | Name of the binary property on the incoming n8n item that holds the document. Required when Input Data Type is Binary Data. Defaults to data. Error reports which property was missing when the name is wrong. | data |
| Base64 Document Content | Conditional | Base64-encoded document. Required when Input Data Type is Base64 String. Data-URL style prefixes (text before the comma) are stripped automatically. | JVBERi0xLjQK... |
| Document URL | Conditional | Publicly reachable HTTPS URL to the document. Required when Input Data Type is URL. Must be a valid full URL. | https://example.com/document.pdf |
| Document Name | Yes | Filename used by PDF4me for processing. Default document.pdf. With Binary Data, the uploaded file name is used for upload but your explicit Document Name value takes precedence in the API call when set. Use a real extension (.pdf, .png, .jpg, etc.) so PDF4me handles the file correctly. | document.pdf |
| AI Analyzer Id | Yes | The saved Analyzer that controls extraction. Create Analyzers at https://dev.pdf4me.com/dashboard/#/ai-document-parser/ (+ Add), then edit schemas on https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>. Dropdown populated via GetAnalyzerId API. Sent as customisationNote. Pick Parse for one schema or Classify for many variants. | aaaa133 |
Options de type de données d'entrée
Choisissez le mode d'insertion du document dans le nœud. Les champs suivants seront modifiés en fonction de ce choix.

Type de données d'entrée : Données binaires (par défaut), chaîne Base64 ou URL.
Données binairesPar défaut : fichier du nœud précédentChamp binaire d'entrée au nom du champ binaire (par défaut) donnéesLe nom du fichier téléchargé sera utilisé sauf si vous spécifiez un autre nom pour le document.Chaîne Base64Document encodé en ligneContenu du document Base64Les préfixes de style Data-URL (texte avant la virgule) sont automatiquement supprimés. Nom du document avec la détection correcte du format des disques d'extension.URLTélécharger à partir d'un lien publicURL du document. PDF4me récupère directement le document. Le nom du fichier à traiter est extrait du URL chemin lorsque cela est possible, ou à partir du nom du document.AI Liste déroulante ID de l'analyseur
Le menu déroulant est alimenté par votre PDF4me compte via le GetAnalyseurId API lorsque vous ouvrez le champ. Chaque option correspond à un analyseur que vous avez enregistré dans le PDF4me Tableau de bord. Choisissez celui dont le schéma correspond au type de document que vous traitez.

AI Liste déroulante ID de l'analyseur chargée depuis votre PDF4me compte.
type de champ : « table » pour les lignes imbriquées et méthode de terrain (extraire la valeur par défaut, générer pour dériver / normaliser).Menu déroulant vide ? Le nœud affiche "GetAnalyzerId n'a renvoyé aucune option d'analyseur" lorsque votre compte ne possède aucun analyseur ou lorsque les informations d'identification ne peuvent pas atteindre le APIOuvrez le Liste d'analyseurs et ajoutez au moins un analyseur sur le Détails de l'analyseur page, puis vérifiez la API saisissez votre clé n8n titre de compétence.
Champs de sortie
Une course réussie rapporte un n8n article avec JSON uniquement, aucun fichier binaire. Les clés de niveau supérieur correspondent à votre schéma Analyzer ; un _metadata L'objet est toujours ajouté.
| Champ | Taper | Ce qu'il contient |
|---|---|---|
Top-level extracted fields | Dynamic | One key per field defined in your Analyzer schema (string, number, date, or nested table rows). Names match fieldName exactly. |
_metadata.success | Boolean | true on a successful parse. |
_metadata.message | String | "Document parsed successfully using AI Document Parser". |
_metadata.processingTimestamp | String | ISO timestamp of the parse. |
_metadata.sourceFileName | String | Document name used for processing. |
_metadata.aiAnalyzerId | String | The Analyzer Id you selected (sent as customisationNote to the API). |
_metadata.operation | String | "aiDocumentParser". |
rawContent (fallback only) | String | If the API returns plain text instead of JSON and parsing fails, the node wraps the response as { "rawContent": "<api response string>" } at the top level. |
Configuration rapide
- Commencez par créer votre analyseur. Ouvrez le Liste d'analyseurs, cliquez + Ajouter, saisissez un ID d'analyseur clair, sélectionnez Analyser ou Classer, enregistrez la ligne, puis ajoutez un schéma de document sur le Détails de l'analyseur Voir la page. Guide d'installation de Parse ou Guide d'installation de la classification pour les règles de schéma complètes, y compris
fieldType: "table"pour les lignes imbriquées etfieldMethod(extraire ou générer). - Dans votre n8n flux de travail, cliquez + et rechercher PDF4me. Ensemble Ressource à Extrait et Opérations d'extraction à Analyseur de documents IA.
- Dans Identifiant pour se connecter avec, sélectionnez votre PDF4me identifiant ou coller un API clé.
- Ensemble Type de données d'entrée. Les données binaires (par défaut) sont lues à partir d'un nœud précédent et sont les plus courantes.
- Remplissez le champ de saisie correspondant (Champ binaire d'entrée, Contenu du document Base64, ou URL du document).
- Nom du documentRemplacer la valeur par défaut
document.pdfutiliser le nom de fichier réel avec la bonne extension. - Choisissez un AI Identifiant de l'analyseur du menu déroulant (chargé depuis votre compte).
- Exécutez le nœud. L'élément de sortie contient les champs analysés au niveau supérieur, plus
_metadata. Intégrer dans un ensemble de données, du code, Google Sheets, Airtable, une base de données, un e-mail ou tout autre nœud en aval.
Configurations typiques
Exemples de flux de travailCommon n8n workflow patterns using AI Document Parser.
- Le déclencheur de courriel (IMAP) s'active lors de l'ouverture d'un nouveau message contenant PDF pièce jointe.
- AI L'analyseur de documents s'exécute avec le type de données d'entrée « Données binaires », le nom du document étant défini sur le nom du fichier joint. AI Identifiant de l'analyseur défini sur votre
analyseur de facturesAnalyseur. - Google Sheets Ajouter inscrit invoiceNumber, vendorName, totalAmount, dueDate dans le suivi des comptes fournisseurs.
- Le dossier surveillé reçoit des données mixtes PDFs Du client ABC, du client XYZ et d'une longue traîne.
- AI L'analyseur de documents est configuré sur un ID d'analyseur de classification (un schéma par fournisseur).
- Un nœud Switch se branche sur le nom de classification correspondant renvoyé dans la réponse, envoyant chaque résultat à la table en aval correspondante.
- Le webhook reçoit un lien vers un document depuis votre portail.
- AI L'analyseur de documents s'exécute avec le type de données d'entrée URL et l'identifiant de votre analyseur de formulaire personnalisé.
- Sortir JSON est mappé dans une écriture Dataverse / Airtable / Postgres pour créer un nouvel enregistrement.
- Les données du scanner sont enregistrées dans un dossier aux bordures larges.
- Document de recadrage automatique par IA (Ressource) AI) rogne les bordures.
- AI Document Parser s'exécute sur le fichier binaire rogné avec l'identifiant d'analyseur correspondant.
- Analyseur JSON Le débit se poursuit en aval comme d'habitude.
- AI L'analyseur de documents renvoie les champs structurés.
- Un nœud de code valide les champs obligatoires et applique les règles métier.
- Si valide, un HTTP La requête est enrichie avec les données fournisseur issues de votre CRM ; sinon, une alerte est envoyée à Slack pour une vérification manuelle.
Conseils pratiques
Dépannage
Avant d'exécuter le test, sélectionnez un analyseur dans la liste déroulante. Ce champ ne peut pas rester vide.
Align Champ binaire d'entrée avec le nœud précédent (souvent) données). Le message d'erreur indique quelle propriété était manquante.
Fichier base64 vide ou manquant. Veuillez renseigner le champ « Type de données d'entrée » correspondant.
Vérifier URL du document est un document complet et valide URL (schéma + hôte + chemin).
Aucun analyseur n'est associé au compte, ou il s'agit d'un problème d'identifiants. Créez un analyseur dans le PDF4me tableau de bord ou vérifier le API clé dans le n8n titre de compétence.
Aide-mémoire
| Champ | Valeur |
|---|---|
| Resource | Extract |
| Operation | AI Document Parser |
| Input Data Type | Binary Data |
| Input Binary Field | data |
| Document Name | form.pdf (with the real extension) |
| AI Analyzer Id | (pick from the dropdown loaded from your account) |
| Credentials | PDF4me API credential |
Foire aux questions
Actions connexes
Même tâche sur d'autres plateformes
/v2/FlowV2/AiDocumentParser pour du code backend personnalisé ou des tests Postman.