Aller au contenu principal

IA - Analyseur de documents dans n8n

Que fait ce nœud ?

PDF4me Analyseur de documents IA extrait des données structurées de n'importe quel document en exécutant un script enregistré AI Analyseur de votre PDF4me compte par rapport au fichier. Contrairement aux analyseurs fixes (AI-Invoice Parser, AI-Process Contract), vous choisissez le AI Identifiant de l'analyseur à partir d'une liste déroulante d'analyseurs configurés dans le PDF4me Le tableau de bord permet ainsi au même nœud de gérer les factures, les bons de commande, les reçus, les formulaires personnalisés, les rapports de laboratoire, les modèles internes, bref, tout ce que vous décrivez dans un schéma. Utilisez un Analyser Analyseur pour un schéma unique ou un Classer Analyseur pour plusieurs variantes de documents en un seul appel. Renvoie des résultats dynamiques. JSON indexé par votre schéma plus un _métadonnées bloc, pas de fichier binaire.

Articles de blog connexes
Il n'y a pas encore d'article de blog consacré à cette fonctionnalité — à venir prochainement.
En attendant, n'hésitez pas à consulter le blog de PDF4me pour découvrir des tutoriels et des procédures de travail adaptés à toutes les plateformes.
Consultez le blog

Exemple de facture pour test

Utilisez cet exemple de facture fournisseur pour vérifier que le nœud fonctionne de bout en bout avant de connecter votre flux de travail à des données réelles. Configurez-le comme une entrée binaire et sélectionnez default_invoice_extraction comme le AI Identifiant de l'analyseur.

Authentification de votre API Demande

Chaque PDF4me nœud dans n8n nécessite un numéro valide Identifiant pour se connecter avecCréez ou sélectionnez-en un qui contient votre PDF4me API clé permettant au flux de travail de s'authentifier AI Les demandes d'extraction sont sécurisées. Les mêmes identifiants sont également utilisés pour… AI Identifiant de l'analyseur menu déroulant via GetAnalyzerId API.

Configurez d'abord votre analyseur.

URL du tableau de bord que vous utiliserez dans ce guide :
Commencez par créer votre Analyzer (obligatoire pour toutes les plateformes)
AI - Document Parser exécute un analyseur enregistré depuis le tableau de bord développeur de PDF4me. Choisissez « Parse » pour un schéma de document unique, ou « Classify » pour acheminer plusieurs variantes (client ABC, client XYZ, facture générique) en un seul appel. Le même identifiant d'analyseur fonctionne dans Make, Zapier, Power Automate, n8n et l'API REST.

Informations importantes à ne pas manquer

Vous configurez l'analyseur dans le tableau de bord ; le nœud ne fait que le référencer.
Définissez le schéma, les champs et les invites une fois dans le Liste d'analyseurs et Détails de l'analyseur pages (Analyse pour un schéma, Classification pour plusieurs variantes). n8n Le nœud charge vos analyseurs dans le AI Identifiant de l'analyseur Le menu déroulant permet d'exécuter l'action sélectionnée. La modification ultérieure du schéma ne nécessite aucune intervention sur le flux de travail.
La sortie est dynamique JSON, aucun fichier binaire
Les clés de niveau supérieur correspondent aux noms de champs que vous avez définis dans l'analyseur (chaîne de caractères, nombre, date ou lignes de tableau). _métadonnées L'objet est toujours complété par le succès, le message, l'horodatage, le nom du fichier source, l'identifiant de l'analyseur et l'opération. Il n'y a pas de Nom du champ binaire de sortie.
Le choix entre Parse et Classify est déterminé par l'analyseur, et non par le nœud.
Même nœud, deux modes d'analyse. A Analyser L'analyseur renvoie les champs de son schéma unique. Classer L'analyseur achemine le document vers le schéma le plus approprié et renvoie son nom de classification. plus Les champs extraits du schéma correspondant. Modifier le comportement en changeant l'identifiant.
Nœud n8n de l'analyseur de documents IA affichant les informations d'identification Pdf4me, l'extraction de ressources, les opérations d'extraction de l'analyseur de documents IA, le type de données d'entrée « Données binaires », le champ binaire d'entrée « data », le nom du document « document.pdf » et la liste déroulante « ID de l'analyseur IA » non définie (surlignée comme obligatoire).

Panneau de nœud complet : Extraire → AI Analyseur de documents avec entrée de données binaires. Choisissez un AI Identifiant de l'analyseur avant de courir.

Paramètres

URL du tableau de bord que vous utiliserez dans ce guide :

Requis dans le n8n Interface utilisateur : Identifiants de connexion, Type de données d'entrée, Nom du document, AI L'identifiant de l'analyseur et les champs obligatoires conditionnels (champ binaire d'entrée, contenu de document Base64 ou URL du document) n'apparaissent que lorsque le type de données d'entrée correspondant est sélectionné. Il n'y a pas d'autre option. Nom du champ binaire de sortie et non Options avancées / Profils personnalisés sur cette opération.

ParamètreRequisCe que cela faitExemple
Input Data TypeYesHow the document is supplied. Binary Data reads from a previous node (default, most common). Base64 String accepts an encoded document. URL downloads the document from a public link.Binary Data
Input Binary FieldConditionalName of the binary property on the incoming n8n item that holds the document. Required when Input Data Type is Binary Data. Defaults to data. Error reports which property was missing when the name is wrong.data
Base64 Document ContentConditionalBase64-encoded document. Required when Input Data Type is Base64 String. Data-URL style prefixes (text before the comma) are stripped automatically.JVBERi0xLjQK...
Document URLConditionalPublicly reachable HTTPS URL to the document. Required when Input Data Type is URL. Must be a valid full URL.https://example.com/document.pdf
Document NameYesFilename used by PDF4me for processing. Default document.pdf. With Binary Data, the uploaded file name is used for upload but your explicit Document Name value takes precedence in the API call when set. Use a real extension (.pdf, .png, .jpg, etc.) so PDF4me handles the file correctly.document.pdf
AI Analyzer IdYesThe saved Analyzer that controls extraction. Create Analyzers at https://dev.pdf4me.com/dashboard/#/ai-document-parser/ (+ Add), then edit schemas on https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>. Dropdown populated via GetAnalyzerId API. Sent as customisationNote. Pick Parse for one schema or Classify for many variants.aaaa133

Options de type de données d'entrée

Choisissez le mode d'insertion du document dans le nœud. Les champs suivants seront modifiés en fonction de ce choix.

Le menu déroulant « Type de données d'entrée » du nœud « Analyseur de documents IA PDF4me n8n » propose trois options : « Données binaires » (avec la description « Utiliser le fichier de document du nœud précédent »), « Chaîne Base64 » (avec la description « Fournir le contenu du document sous forme de chaîne encodée en base64 ») et « URL » (avec la description « Fournir l'URL du fichier de document »).

Type de données d'entrée : Données binaires (par défaut), chaîne Base64 ou URL.

Données binairesPar défaut : fichier du nœud précédent
Lit le document directement à partir d'un nœud précédent tel que Google Drive Download, HTTP Nœud de requête, de lecture de fichier binaire ou de pièce jointe à un courriel. Définir Champ binaire d'entrée au nom du champ binaire (par défaut) donnéesLe nom du fichier téléchargé sera utilisé sauf si vous spécifiez un autre nom pour le document.
Chaîne Base64Document encodé en ligne
Collez ou mappez une chaîne base64 dans Contenu du document Base64Les préfixes de style Data-URL (texte avant la virgule) sont automatiquement supprimés. Nom du document avec la détection correcte du format des disques d'extension.
URLTélécharger à partir d'un lien public
Fournir un public HTTPS URL dans URL du document. PDF4me récupère directement le document. Le nom du fichier à traiter est extrait du URL chemin lorsque cela est possible, ou à partir du nom du document.

AI Liste déroulante ID de l'analyseur

Le menu déroulant est alimenté par votre PDF4me compte via le GetAnalyseurId API lorsque vous ouvrez le champ. Chaque option correspond à un analyseur que vous avez enregistré dans le PDF4me Tableau de bord. Choisissez celui dont le schéma correspond au type de document que vous traitez.

La liste déroulante ID de l'analyseur IA s'ouvre dans le nœud n8n PDF4me AI Document Parser affichant trois exemples d'options d'analyse : aaaa133, TestTenantProject, TestTenant

AI Liste déroulante ID de l'analyseur chargée depuis votre PDF4me compte.

Analyseur syntaxique
Schéma d'un seul document. Le nœud renvoie exactement les champs définis dans ce schéma. Idéal lorsque tous les documents traités partagent la même famille de mise en page. Voir la Guide d'installation de Parse pour les règles de schéma, y compris type de champ : « table » pour les lignes imbriquées et méthode de terrain (extraire la valeur par défaut, générer pour dériver / normaliser).
Analyseur de classification
Plusieurs schémas, un par variante de document. AI Le système achemine le document entrant vers le schéma le plus approprié en utilisant l'invite de classification de chaque schéma, puis renvoie le nom de la classification correspondante ainsi que ses champs. Voir la Guide d'installation de la classification.

Menu déroulant vide ? Le nœud affiche "GetAnalyzerId n'a renvoyé aucune option d'analyseur" lorsque votre compte ne possède aucun analyseur ou lorsque les informations d'identification ne peuvent pas atteindre le APIOuvrez le Liste d'analyseurs et ajoutez au moins un analyseur sur le Détails de l'analyseur page, puis vérifiez la API saisissez votre clé n8n titre de compétence.

Champs de sortie

Une course réussie rapporte un n8n article avec JSON uniquement, aucun fichier binaire. Les clés de niveau supérieur correspondent à votre schéma Analyzer ; un _metadata L'objet est toujours ajouté.

ChampTaperCe qu'il contient
Top-level extracted fieldsDynamicOne key per field defined in your Analyzer schema (string, number, date, or nested table rows). Names match fieldName exactly.
_metadata.successBooleantrue on a successful parse.
_metadata.messageString"Document parsed successfully using AI Document Parser".
_metadata.processingTimestampStringISO timestamp of the parse.
_metadata.sourceFileNameStringDocument name used for processing.
_metadata.aiAnalyzerIdStringThe Analyzer Id you selected (sent as customisationNote to the API).
_metadata.operationString"aiDocumentParser".
rawContent (fallback only)StringIf the API returns plain text instead of JSON and parsing fails, the node wraps the response as { "rawContent": "<api response string>" } at the top level.

Configuration rapide

  1. Commencez par créer votre analyseur. Ouvrez le Liste d'analyseurs, cliquez + Ajouter, saisissez un ID d'analyseur clair, sélectionnez Analyser ou Classer, enregistrez la ligne, puis ajoutez un schéma de document sur le Détails de l'analyseur Voir la page. Guide d'installation de Parse ou Guide d'installation de la classification pour les règles de schéma complètes, y compris fieldType: "table" pour les lignes imbriquées et fieldMethod (extraire ou générer).
  2. Dans votre n8n flux de travail, cliquez + et rechercher PDF4me. Ensemble Ressource à Extrait et Opérations d'extraction à Analyseur de documents IA.
  3. Dans Identifiant pour se connecter avec, sélectionnez votre PDF4me identifiant ou coller un API clé.
  4. Ensemble Type de données d'entrée. Les données binaires (par défaut) sont lues à partir d'un nœud précédent et sont les plus courantes.
  5. Remplissez le champ de saisie correspondant (Champ binaire d'entrée, Contenu du document Base64, ou URL du document).
  6. Nom du documentRemplacer la valeur par défaut document.pdf utiliser le nom de fichier réel avec la bonne extension.
  7. Choisissez un AI Identifiant de l'analyseur du menu déroulant (chargé depuis votre compte).
  8. Exécutez le nœud. L'élément de sortie contient les champs analysés au niveau supérieur, plus _metadata. Intégrer dans un ensemble de données, du code, Google Sheets, Airtable, une base de données, un e-mail ou tout autre nœud en aval.

Configurations typiques

Exemples de flux de travailCommon n8n workflow patterns using AI Document Parser.
Pièce jointe à Google Sheets
  1. Le déclencheur de courriel (IMAP) s'active lors de l'ouverture d'un nouveau message contenant PDF pièce jointe.
  2. AI L'analyseur de documents s'exécute avec le type de données d'entrée « Données binaires », le nom du document étant défini sur le nom du fichier joint. AI Identifiant de l'analyseur défini sur votre analyseur de factures Analyseur.
  3. Google Sheets Ajouter inscrit invoiceNumber, vendorName, totalAmount, dueDate dans le suivi des comptes fournisseurs.
Boîte de réception multi-fournisseurs avec classification
  1. Le dossier surveillé reçoit des données mixtes PDFs Du client ABC, du client XYZ et d'une longue traîne.
  2. AI L'analyseur de documents est configuré sur un ID d'analyseur de classification (un schéma par fournisseur).
  3. Un nœud Switch se branche sur le nom de classification correspondant renvoyé dans la réponse, envoyant chaque résultat à la table en aval correspondante.
Document hébergé par URL
  1. Le webhook reçoit un lien vers un document depuis votre portail.
  2. AI L'analyseur de documents s'exécute avec le type de données d'entrée URL et l'identifiant de votre analyseur de formulaire personnalisé.
  3. Sortir JSON est mappé dans une écriture Dataverse / Airtable / Postgres pour créer un nouvel enregistrement.
Numériser, recadrer automatiquement, puis analyser
  1. Les données du scanner sont enregistrées dans un dossier aux bordures larges.
  2. Document de recadrage automatique par IA (Ressource) AI) rogne les bordures.
  3. AI Document Parser s'exécute sur le fichier binaire rogné avec l'identifiant d'analyseur correspondant.
  4. Analyseur JSON Le débit se poursuit en aval comme d'habitude.
Valider puis enrichir
  1. AI L'analyseur de documents renvoie les champs structurés.
  2. Un nœud de code valide les champs obligatoires et applique les règles métier.
  3. Si valide, un HTTP La requête est enrichie avec les données fournisseur issues de votre CRM ; sinon, une alerte est envoyée à Slack pour une vérification manuelle.

Conseils pratiques

Set up the Analyzer in PDF4me first
The node does not define extraction rules. It runs whatever your selected Analyzer specifies. Build it in the dashboard before configuring the node.
Use Document Name with the real extension
PDF4me uses the extension for format detection. Even on Binary Data, an explicit Document Name with the correct extension is safest.
No Output Binary Field Name and no Advanced Options
Unlike AI Auto Crop Document, this operation has neither. The output is JSON only; there is nothing to write back as a binary file.
Plain-text fallback wraps as rawContent
If the API returns plain text instead of JSON and parsing fails, the node wraps the response as { "rawContent": "<string>" } so the workflow does not break.
Combine with AI Auto Crop Document for scans
Scans with wide borders parse better after cropping. Chain AI Auto Crop Document (Resource AI) before this node.
Use AI-Invoice Parser / AI-Process Contract for built-in schemas
When you only need standard invoice or contract fields, the dedicated nodes are simpler. AI Document Parser shines when you have a custom schema.

Dépannage

"AI L'identifiant de l'analyseur est requis.

Avant d'exécuter le test, sélectionnez un analyseur dans la liste déroulante. Ce champ ne peut pas rester vide.

"Aucune donnée binaire trouvée dans la propriété '…'"

Align Champ binaire d'entrée avec le nœud précédent (souvent) données). Le message d'erreur indique quelle propriété était manquante.

« Le contenu du document est obligatoire »

Fichier base64 vide ou manquant. Veuillez renseigner le champ « Type de données d'entrée » correspondant.

"Invalide URL format"

Vérifier URL du document est un document complet et valide URL (schéma + hôte + chemin).

"GetAnalyzerId n'a renvoyé aucune option d'analyseur"

Aucun analyseur n'est associé au compte, ou il s'agit d'un problème d'identifiants. Créez un analyseur dans le PDF4me tableau de bord ou vérifier le API clé dans le n8n titre de compétence.

Aide-mémoire

ChampValeur
ResourceExtract
OperationAI Document Parser
Input Data TypeBinary Data
Input Binary Fielddata
Document Nameform.pdf (with the real extension)
AI Analyzer Id(pick from the dropdown loaded from your account)
CredentialsPDF4me API credential

Foire aux questions

Where does the AI Analyzer Id list come from?+
The dropdown is populated from your PDF4me account via the GetAnalyzerId API. Each option is an Analyzer you created at https://dev.pdf4me.com/dashboard/#/ai-document-parser/ with schemas on https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>. The node sends the selected value as customisationNote to the AiDocumentParser API.
What does "GetAnalyzerId returned no analyzer options" mean?+
The account has no Analyzers configured, or the credentials cannot reach the GetAnalyzerId endpoint. Open https://dev.pdf4me.com/dashboard/#/ai-document-parser/ and create at least one Analyzer (Parse or Classify) on the Analyzer detail page, or verify the API key in your n8n credential.
How is this different from AI-Invoice Parser, AI-Process Contract, AI-Process Bank Cheque?+
Those nodes use fixed schemas tuned to those document types. AI Document Parser is schema-driven: it runs whatever Analyzer you select, so the same node handles invoices, purchase orders, receipts, custom forms, lab reports, anything you describe in a schema. Pick AI Document Parser whenever you need a custom layout or document type.
What shape does the output have?+
Top-level keys match the field names in your Analyzer schema (for example customerName, invoiceNumber, totalAmount, lineItems). Nested objects and table arrays follow the same shape you defined. A _metadata object is always appended with success, message, processingTimestamp, sourceFileName, aiAnalyzerId, and operation. No binary file is returned.
Does this work on scanned PDFs?+
Yes. The AI engine handles OCR internally, so scanned PDFs and image formats work the same as native PDFs. If borders are large, chain AI Auto Crop Document (Resource AI) before this node for cleaner extraction.
Can I change the Analyzer schema without rebuilding the workflow?+
Yes. The workflow only references the Analyzer Id. Edit the schema in the PDF4me dashboard and the next run picks up the new shape automatically. Output keys follow your latest schema, so any downstream Set / Code / Sheets nodes that assume specific keys may need updating after a breaking schema change.
Can I switch between Parse and Classify Analyzers without rewiring the node?+
Yes. Both Analyzer types are listed in the AI Analyzer Id dropdown. Pick a Classify Analyzer when you want one node to handle several document variants; pick a Parse Analyzer for a single fixed schema. The output shape adapts to whichever you choose.
What happens when the API returns plain text instead of JSON?+
The node tries to parse it; if parsing fails, the response is wrapped as { "rawContent": "<api response string>" } at the top level so the workflow does not break. Useful for inspecting unexpected responses during development.

Actions connexes

Même tâche sur d'autres plateformes

Obtenez de l'aide