Aller au contenu principal

Analyseur de documents IA utilisant Parse

Ce guide couvre

Analyseur de documents IA. Analyser est la configuration du tableau de bord qui transforme un JSON Schéma du document dans Extraction de PDF structurés par IAVous créez un Analyseur, choisissez le Analyser type, et décrivez les champs que vous souhaitez comme nom_du_champ, type de champ, et description du champL'IA lit le document sémantiquement, ce qui évite d'avoir à dessiner des zones de capture ou à utiliser des expressions régulières. Une fois enregistré, le même identifiant d'analyseur est utilisé à partir de… REST API, Make, Zapier, Power Automate, et n8n.

Articles de blog connexes(4)
Extraction et renommage intelligents de PDF par IA\_: un flux de travail Dropbox en 4 modules avec PDF4me AI - Analyseur de documents
Scénario de création en quatre modules\_: extraire un PDF fournisseur depuis Dropbox, exécuter AI - Document Parser avec default_invoice_extraction, analyser le JSON pour extraire le nom du fournisseur, puis réimporter le fichier sous le nom vendorName.pdf. Captures d'écran réelles, valeurs de champs exactes, aucune saisie manuelle.
Lire l'article
Renommer les factures fournisseurs avec l'IA dans Zapier\_: un flux de travail Dropbox + PDF4me en 5 étapes
Zap en cinq étapes\_: Création d'un nouveau fichier dans un dossier Dropbox → Recherche de fichier Dropbox → Analyseur de documents PDF4me AI → Exécution de JavaScript par Zapier → Téléchargement du fichier Dropbox. Extraction du nom du client par IA et utilisation comme nom du fichier de sortie. Captures d'écran réelles, valeurs de champs exactes, aucun code autre que deux lignes d'analyse JSON.
Lire l'article
Renommer systématiquement les factures fournisseurs par nom de fournisseur dans Zapier\_: un workflow en 5 étapes avec Dropbox et PDF4me AI
Un Zap en cinq étapes pour les équipes de comptabilité fournisseurs. Dropbox surveille votre dossier de réception des factures, PDF4me AI - Document Parser extrait le nom du fournisseur de chaque PDF, Code by Zapier transforme le résultat de l'analyse en jetons exploitables, et Dropbox réimporte le fichier en l'identifiant avec le nom du fournisseur. Captures d'écran réelles, valeurs exactes des champs, le même fichier PDF (sample-vendor-invoice.pdf) utilisé dans ce tutoriel est téléchargeable.
Lire l'article

Authentification de votre configuration

Les analyseurs de documents IA sont créés dans le PDF4me Tableau de bord développeur. Connectez-vous avec votre compte, puis créez ou copiez un API clé pour l'analyseur IA API appels qui font référence à l'analyseur que vous créez ici.

URL du tableau de bord que vous utiliserez dans ce guide :

Informations importantes à ne pas manquer

Analyser les données extraites ; Classer les documents d'itinéraires
Prendre Analyser quand vous avez besoin de structure JSON Afficher une valeur par champ défini. Sélectionner Classer Lorsque vous n'avez besoin que d'une étiquette de catégorie. Les deux types d'analyseurs partagent la même fenêtre modale « Ajouter », mais produisent des formats de sortie différents.
La description du champ influence la précision
L'IA s'appuie sur description du champ Utilisez une chaîne de caractères pour trouver chaque valeur dans le document. Soyez précis et incluez les appellations alternatives (« Numéro de commande client », parfois abrégé en SO no.). Les descriptions vagues nuisent à la qualité de l'extraction.
L'identifiant de l'analyseur est la référence de production stable
La chaîne de caractères que vous saisissez dans la ligne Ajouter (par exemple analyseur de bons de commande) est ce que chaque API Utilisation des modules d'appel et d'automatisation. Choisissez une convention d'appellation claire dès le départ ; la modifier ultérieurement impliquera de refaire le câblage de tous les flux de travail qui y font référence.

Étape 1 : Ouvrez l’analyseur de documents IA dans le tableau de bord

  1. Connectez-vous à dev.pdf4me.com.
  2. Dans la barre latérale du tableau de bord, cliquez Analyseur de documents IA.
  3. La page de liste affiche tous les analyseurs existants sur trois colonnes : Identifiant de l'analyseur, Type d'analyseur (Analyser ou classer), et Actes.
  4. Cliquez sur le bleu + Ajouter bouton pour démarrer un nouvel analyseur.
Page de tableau de bord de l'analyseur de documents IA de PDF4me avec l'élément de barre latérale « Analyseur de documents IA » mis en évidence en rouge, le panneau principal intitulé « Analyseur de documents IA », un bouton « Ajouter » bleu et une liste vide avec les en-têtes de colonne « ID de l'analyseur », « Type d'analyseur » et « Actions ».

Vue liste des analyseurs de documents IA. Cliquez sur + Ajouter pour créer un nouvel analyseur.

Étape 2 : Choisissez le type d’analyseur « Parse » et nommez-le.

Une nouvelle ligne apparaît avec trois commandes :

  1. Saisie de l'identifiant de l'analyseurSaisissez un identifiant clair dont vous vous souviendrez, par exemple : purchase order parser, Invoice Parser v1, ou vendor_statement_parserIl n'y a aucune restriction quant au format des noms. snake_case, camelCase, kebab-case, mots simples avec espaces, tout fonctionne de la même manière.
  2. Menu déroulant Type d'analyseur. prendre Analyser (ce guide) ou Classer (voir le Guide de classification).
  3. Enregistrer / Annuler Boutons. Enregistrer crée l'analyseur ; Annuler supprime la ligne.
PDF4me AI Document Parser Ajouter une ligne : ouvrez le champ ID de l’analyseur rempli avec purchase_order_parser, la liste déroulante Type d’analyseur affichant les options Classer et Analyser (Analyser sélectionné), et les boutons Enregistrer et Annuler à droite.

Ajouter une ligne : saisissez un ID d’analyseur, sélectionnez Analyser, puis Enregistrer.

Conseil pour le choix du nom : inclure la famille de documents dans le nom (analyseur de factures, analyseur de bons de commande, Analyseur de notes d'expéditionL'identifiant de l'analyseur est celui utilisé par les systèmes d'automatisation en aval ; un nom clair est toujours avantageux lors de son intégration à une nouvelle plateforme. N'importe quel format de boîtier ou de séparateur convient.

Étape 3 : Ouvrez l’analyseur et ajoutez un schéma.

Cliquez sur la nouvelle ligne pour ouvrir la page de détails. Le modèle d'URL est :

https://dev.pdf4me.com/ai-document-parser/?id=<your-analyzer-guid>

Le tableau de bord attribue un GUID à chaque analyseur lors de sa première ouverture. Ajoutez cette URL à vos favoris pour accéder directement au même analyseur la prochaine fois.

La page de détails affiche :

  • Analyse des informations (à gauche) affiche l'identifiant de l'analyseur que vous avez saisi à l'étape 2. Ce panneau est en lecture seule.
  • Schémas (à droite). Vide par défaut. Cliquez sur + bouton en haut à droite pour ajouter un schéma.
  • Enregistrer les modifications (en haut à gauche). Conserve toutes les modifications que vous apportez à cette page.
  • Dos. retourne au Liste d'analyseurs.
Page de détails de l'analyseur de documents IA de PDF4me avec une bannière bleue indiquant « Analyseur de documents IA », sous-titre « Extraction automatique des données de factures grâce à l'IA : sortie rapide, précise et structurée », bouton Retour, bouton Enregistrer les modifications, panneau Informations d'analyse affichant l'ID de l'analyseur « purchase_order_parser » et une section Schémas vide avec un bouton « + » bleu pour ajouter un schéma.

Détails de l'analyseur. Cliquez sur le bouton bleu + pour ajouter un schéma de document.

Étape 4 : Définir le schéma du document JSON

Après avoir cliqué +Une carte Schema vide s'ouvre. Collez un JSON objet comportant deux clés de niveau supérieur :

  • description. Un résumé en une phrase des éléments extraits par le schéma. L'IA utilise ce résumé comme contexte général.
  • fields. tableau de définitions de champs. Chaque champ possède :
    • fieldName. nom lisible par machine (sans espaces), utilisé comme JSON clé dans la réponse.
    • fieldType. string, number, ou date. Permet l'analyse et la validation.
    • fieldDescription. Indication en langage naturel utilisée par l'IA pour trouver ce champ. Soyez précis.
La fiche « Schéma 1 de l'analyseur de documents IA PDF4me » s'ouvre sur un éditeur de schéma de document affichant du JSON avec la description « Extraction de données des bons de commande et des commandes clients » et un tableau de champs contenant : « SalesOrderNumber » (numéro de commande), « AgentName » (nom de l'agent) et « DeptCode » (partiellement visible). Sous l'éditeur se trouvent des boutons de saisie rapide pour les factures et les bons de commande.

Éditeur de schémas de documents avec boutons de remplissage rapide pour les modèles de factures et de bons de commande.

Exemple : schéma de commande

{
"description": "Extracting data from purchase orders and sales orders.",
"fields": [
{
"fieldName": "SalesOrderNumber",
"fieldType": "string",
"fieldDescription": "Sales Order Number"
},
{
"fieldName": "AgentName",
"fieldType": "string",
"fieldDescription": "Name of the agent, mostly given as Agent Name."
},
{
"fieldName": "DeptCode",
"fieldType": "string",
"fieldDescription": "Department or cost-centre code printed on the order."
},
{
"fieldName": "OrderDate",
"fieldType": "date",
"fieldDescription": "Date the order was placed. Accept formats like DD/MM/YYYY, MM-DD-YYYY, or written out as 5 June 2026."
},
{
"fieldName": "TotalAmount",
"fieldType": "number",
"fieldDescription": "Grand total of the order in the document's currency, after taxes."
}
]
}

Exemple : Schéma de facture (utilisez le bouton de remplissage rapide « Facture »)

{
"description": "Extracting data from supplier invoices.",
"fields": [
{
"fieldName": "InvoiceNumber",
"fieldType": "string",
"fieldDescription": "Unique invoice identifier, sometimes shown as Invoice No. or INV."
},
{
"fieldName": "InvoiceDate",
"fieldType": "date",
"fieldDescription": "Date the invoice was issued."
},
{
"fieldName": "DueDate",
"fieldType": "date",
"fieldDescription": "Date payment is due, sometimes shown as Payment Due or Net Due."
},
{
"fieldName": "VendorName",
"fieldType": "string",
"fieldDescription": "Company name of the supplier or vendor sending the invoice."
},
{
"fieldName": "TotalAmount",
"fieldType": "number",
"fieldDescription": "Grand total in the invoice currency, including taxes."
}
]
}

Boutons de remplissage rapide (Facture, Bon de commande) : au bas de la carte Schéma. Utilisez-les comme point de départ Il suffit de cliquer sur un schéma type pour charger celui de la famille de documents correspondante, puis de renommer, de supprimer ou d'étendre les champs pour qu'ils correspondent à vos documents. Les schémas prédéfinis ne sont que des modèles de base et non des schémas définitifs.

Schéma avec un champ de table (lignes imbriquées)

Utiliser type de champ : « table » lorsque vous devez extraire des lignes répétées, telles que les lignes de facture ou les lignes de bon de commande. Chaque champ de table contient ses propres valeurs imbriquées. champs tableau décrivant les colonnes.

{
"description": "Invoice data extractor",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4 digit year not found then consider 2 digit year at the end of extracted date.",
"fieldMethod": "generate"
},
{
"fieldName": "lineItems",
"fieldType": "table",
"fieldDescription": "All product / service rows from the invoice table. Be careful, sometimes a row can be part of the next item like when description goes over one line, but it's of a single item.",
"fields": [
{
"fieldName": "itemNumber",
"fieldType": "string",
"fieldDescription": "Product number, product id number or product code"
},
{
"fieldName": "hsnCode",
"fieldType": "string",
"fieldDescription": "HSN / SAC code (4 to 8 digit)"
}
]
}
]
}

Attributs de champ

AttributRequis?Ce que cela fait
fieldNameRequiredThe name of the field and how it will appear in the response JSON.
fieldTypeRequiredThe type of data to extract. One of string, number, date, or table.
fieldDescriptionRequiredNatural-language description of what needs to be extracted and where to find it. Include alternate labels and example formats so the AI matches correctly.
fieldMethodOptional (default extract)How the AI fills the value. extract takes the value verbatim from the document. generate tells the AI to derive or normalise it (useful for dates, computed totals, or cleaned-up IDs). Omit for default extract behaviour.
fieldsRequired when fieldType is tableNested array describing the columns of the table. Each entry takes the same attributes as a top-level field (fieldName, fieldType, fieldDescription, fieldMethod). Cannot itself be table.

référence fieldType

type de champIdéal pourExemple de description de champ
stringNames, identifiers, codes, free textCustomer name as printed on the invoice header.
numberAmounts, quantities, tax rates, countsGrand total of the order in the document currency, including taxes.
dateDates, due dates, issue dates, timestampsDate the invoice was issued, accept DD/MM/YYYY and 5 June 2026 formats.
tableRepeated rows (line items, addresses, transactions)All product / service rows from the invoice table. Carries a nested fields array describing the columns.

Étape 5 : Enregistrez les modifications et utilisez l’analyseur

Cliquez Enregistrer les modifications En haut à gauche, pour conserver le schéma. L'analyseur est désormais actif et accessible depuis n'importe quelle plateforme grâce à son identifiant.

Utilisez l'analyseur dans API ou appels d'automatisation

Une fois enregistré, le même analyseur s'exécute partout par simple référence. Il n'est pas nécessaire de recréer le schéma sur chaque plateforme.

ChampSourceBut
AnalyzerIdLa chaîne de caractères que vous avez saisie à l'étape 2Identifiant stable utilisé par l'analyseur IA pour localiser votre schéma.
docNameSource PDF nom de fichierUtilisé pour le suivi et les messages d'erreur.
docContentSource PDF encodé comme Base64Le document à partir duquel extraire des informations.
asyncfalse pour synchrone, true pour les sondagesContrôle la transmission des réponses.

Exemple REST Corps de la requête :

{
"docName": "purchase_order.pdf",
"docContent": "BASE64_ENCODED_PDF_CONTENT",
"AnalyzerId": "purchase_order_parser",
"async": false
}

La réponse contient un champ par élément que vous avez défini dans fields. Itinéraire qui JSON dans tout système en aval : Google Sheets, Airtable, une base de données, Excel, ou un webhook.

Flux de travail courants

Modèles typiques d'analyseurs d'IAHow a saved Analyzer moves from dashboard to production.
boîte de réception des bons de commande ERP
  1. Un nouveau bon de commande PDF arrive dans une boîte aux lettres surveillée ou un dossier de téléchargement.
  2. Make, Zapier, Power Automate, ou n8n appelle l'analyseur IA avec Identifiant de l'analyseur : purchase_order_parser.
  3. Le retour JSON (Numéro de commande, Nom de l'agent, Date de commande, Montant total) est mappé dans votre ERP création de commande API.
  4. Un courriel de confirmation est renvoyé au client en utilisant le numéro de commande analysé.
Boîte de réception des factures vers feuille de calcul comptable
  1. Une facture PDF arrive via webhook, dossier surveillé ou boîte de réception partagée.
  2. L'analyseur d'IA est appelé avec Identifiant de l'analyseur : analyseur de factures (Schéma de remplissage rapide des factures).
  3. La réponse structurée (Numéro de facture, Montant total, Date d'échéance) est ajouté comme une ligne dans Google Sheets ou Excel pour l'équipe comptable.
Routeur de classification puis d'analyse
  1. Un seul dossier surveillé reçoit des documents variés (factures, bons de commande, bordereaux d'expédition).
  2. Un analyseur de classification achemine chaque fichier vers l'étiquette de catégorie appropriée.
  3. En fonction de l'étiquette, le flux de travail appelle l'analyseur syntaxique correspondant (analyseur de factures, analyseur de bons de commande, analyseur de notes d'expédition) et écrit la sortie structurée à la destination appropriée.

Meilleures pratiques en matière de schémas

  • Utilisez des descriptions fieldDescription chaînes de caractères. Mentionnez les autres appellations que vous voyez dans les documents réels (« Numéro de commande client », également indiqué comme n° SO, réf. commande ou réf. PO).
  • Prendre fieldType soigneusement. date et number donner au moteur des indications d'analyse ; string est la solution de repli lorsque la forme est imprévisible.
  • Garder fieldName lisible par machine (camelCase ou PascalCase, sans espaces). Il apparaît comme un JSON clé dans la réponse.
  • Commencez par le formulaire de saisie rapide « Facture » ou « Bon de commande », puis supprimez ou ajoutez des champs. Les préréglages constituent une bonne base.
  • Effectuez des tests sur trois échantillons réels avant de diriger le trafic de production vers l'analyseur, y compris les cas limites comme les champs optionnels manquants, les documents de deuxième page et le texte issu de la reconnaissance optique de caractères (OCR).
  • Identifiants de l'analyseur de version lors de modifications de schéma incompatibles (invoice_parser_v1, invoice_parser_v2) afin que les automatisations en direct puissent migrer à leur propre rythme.

Actions connexes

Analyseur de documents IA utilisant la classification
Même tableau de bord, plusieurs schémas par analyseur. À utiliser lorsqu'un analyseur doit effectuer un routage entre différentes variantes de documents (client ABC vs client XYZ).
IA - Analyseur de documents dans Make
Utilisez votre ID d'analyseur syntaxique enregistré à partir d'un Make Scénario. Associez-le à n'importe quelle source de données et module de stockage pour exécuter l'extraction IA dans des flux de travail visuels.
IA - Analyseur de documents dans Power Automate
Exécutez le même analyseur à partir d'un Power Automate flux. Se connecte naturellement à SharePoint, Excel, Dataverse, et Outlook.
IA - Analyseur de documents dans n8n
Auto-hébergé ou cloud n8n Flux de travail. Le menu déroulant ID de l'analyseur IA charge directement vos analyseurs enregistrés depuis votre compte.
IA - Analyseur de documents dans Zapier
Déclenchez l'extraction d'IA à partir de plus de 6 000 SaaS Applications et webhooks. Saisissez l'ID de votre analyseur enregistré dans le champ Nom de l'analyseur d'IA.

Foire aux questions

What is the difference between Parse and Classify in AI Document Parser?+
Parse extracts structured field values from documents using a Document Schema. The response is a JSON object with one value per field you defined. Classify routes a document into one of several categories you defined; the response is a label string. Use Parse when you need data, Classify when you need a routing decision.
How is AI Document Parser different from the older Parse Document templates?+
The older Parse Document setup uses Regex Expression or JavaScript Expression applied to drawn capture areas on a sample PDF. AI Document Parser uses a JSON Document Schema with natural-language field descriptions; the AI engine reads the document semantically rather than by fixed positions. No sample PDF is required when defining an AI Analyzer.
What does fieldDescription do?+
It is the natural-language hint the AI uses to find each field in the document. Be specific and include alternate names ("Sales Order Number, sometimes shown as SO No."). Descriptions are the single biggest factor in extraction accuracy.
Can I add more than one Schema to the same Analyzer?+
Yes. The detail page supports multiple Schemas via the + button. Use this when one Analyzer should handle two related document families (purchase orders and sales orders) with slightly different field sets.
Does the Analyzer Id change after Save Changes?+
No. The Analyzer Id is the string you typed in the Add row in Step 2. It stays stable across edits and is the value every API call and automation module uses. Pick a clear naming convention up front.
Do I need to upload a sample PDF when setting up the Analyzer?+
No. Unlike the older Parse Document templates, the AI Analyzer does not need a sample for setup. You define a Document Schema in JSON; the AI engine applies it to whatever document you send at runtime.
How do I call the Analyzer from the REST API?+
Send docName, docContent (the PDF as Base64), AnalyzerId (the string you typed in Step 2), and async (false for immediate response, true for polling). The response contains one JSON property per field you defined in the Document Schema.
Can the AI Parser handle scanned PDFs?+
Yes, when the PDF has been OCR-processed first. Run the source file through the PDF4me OCR endpoint before sending it to the AI Parser. The schema then extracts from the OCR text layer the same way it would from a native PDF.

Obtenez de l'aide