Aller au contenu principal

Analyseur de documents IA utilisant la classification

Ce guide couvre

Analyseur de documents IA. Classification permet à un seul analyseur de traiter plusieurs variantes de documents en un seul appel. Vous définissez un Identifiant de l'analyseur, puis ajoutez-en un Diagramme par variante (Client ABC, Client XYZ, facture générique, bon de commande générique). Chaque schéma comporte un Nom de la classification, un Invite de classification en langage naturel, et un Schéma du document description des champs à extraire. Lors de l'exécution, l'IA compare les données entrantes. PDF Pour chaque invite de classification de schéma, il sélectionne la meilleure correspondance et renvoie à la fois le nom de classification correspondant et les champs extraits. Le même ID d'analyseur fonctionne à partir du REST API et toutes les plateformes d'automatisation prises en charge.

Articles de blog connexes(4)
Extraction et renommage intelligents de PDF par IA\_: un flux de travail Dropbox en 4 modules avec PDF4me AI - Analyseur de documents
Scénario de création en quatre modules\_: extraire un PDF fournisseur depuis Dropbox, exécuter AI - Document Parser avec default_invoice_extraction, analyser le JSON pour extraire le nom du fournisseur, puis réimporter le fichier sous le nom vendorName.pdf. Captures d'écran réelles, valeurs de champs exactes, aucune saisie manuelle.
Lire l'article
Renommer les factures fournisseurs avec l'IA dans Zapier\_: un flux de travail Dropbox + PDF4me en 5 étapes
Zap en cinq étapes\_: Création d'un nouveau fichier dans un dossier Dropbox → Recherche de fichier Dropbox → Analyseur de documents PDF4me AI → Exécution de JavaScript par Zapier → Téléchargement du fichier Dropbox. Extraction du nom du client par IA et utilisation comme nom du fichier de sortie. Captures d'écran réelles, valeurs de champs exactes, aucun code autre que deux lignes d'analyse JSON.
Lire l'article
Renommer systématiquement les factures fournisseurs par nom de fournisseur dans Zapier\_: un workflow en 5 étapes avec Dropbox et PDF4me AI
Un Zap en cinq étapes pour les équipes de comptabilité fournisseurs. Dropbox surveille votre dossier de réception des factures, PDF4me AI - Document Parser extrait le nom du fournisseur de chaque PDF, Code by Zapier transforme le résultat de l'analyse en jetons exploitables, et Dropbox réimporte le fichier en l'identifiant avec le nom du fournisseur. Captures d'écran réelles, valeurs exactes des champs, le même fichier PDF (sample-vendor-invoice.pdf) utilisé dans ce tutoriel est téléchargeable.
Lire l'article

Authentification de votre configuration

Les analyseurs de classification sont créés dans le PDF4me Tableau de bord développeur. Connectez-vous avec votre compte, puis créez ou copiez un API clé pour l'analyseur IA API appels qui font référence à l'analyseur que vous créez ici.

URL du tableau de bord que vous utiliserez dans ce guide :

Informations importantes à ne pas manquer

Un analyseur, plusieurs schémas (un par variante)
Classify est conçu pour s'adapter aux situations réelles où les factures du client ABC diffèrent de celles du client XYZ. Ajoutez autant de schémas que de variantes. Chaque schéma est un ensemble autonome comprenant un nom de classification, une invite et un schéma de document.
L'invite de classification est le cerveau du routage
Rédigez-le en langage clair. Mentionnez des éléments concrets comme le nom de l'entreprise en haut, l'adresse e-mail de contact, les indications de mise en page et les mots spécifiques à cette variante. Plus la consigne est claire, plus le routage sera simple.
La fonction Classify renvoie à la fois l'étiquette et les données.
Contrairement à un classificateur pur, la réponse inclut le nom de la classification correspondante. et Tous les champs du schéma de document de ce schéma. Un seul appel vous donne la décision de routage et les données extraites. JSON ensemble.

Étape 1 : Ouvrez l’analyseur de documents IA dans le tableau de bord

  1. Connectez-vous à dev.pdf4me.com.
  2. Dans la barre latérale du tableau de bord, cliquez Analyseur de documents IA.
  3. La page de liste affiche tous les analyseurs existants sur trois colonnes : Identifiant de l'analyseur, Type d'analyseur (Analyser ou classer), et Actes.
  4. Cliquez sur le bleu + Ajouter bouton pour démarrer un nouvel analyseur.
Vue de liste du tableau de bord de l'analyseur de documents IA de PDF4me, avec l'élément de barre latérale « Analyseur de documents IA » mis en évidence en rouge, un bouton « Ajouter » bleu en haut du panneau principal et un tableau vide avec les en-têtes de colonne « ID de l'analyseur », « Type d'analyseur » et « Actions ».

Vue liste de l'analyseur de documents IA. Cliquez sur + Ajouter pour démarrer un nouvel analyseur.

Étape 2 : Créer un analyseur de classification

Une nouvelle ligne apparaît avec trois commandes :

  1. Saisie de l'identifiant de l'analyseurSaisissez un identifiant clair dont vous vous souviendrez, par exemple : client_invoices, Vendor Documents, ou incoming-ordersIl n'y a aucune restriction de format de nommage. snake_case, camelCase, kebab-case, mots simples avec espaces, tout fonctionne de la même manière. L'exemple ci-dessous utilise client_invoices.
  2. Menu déroulant Type d'analyseur. prendre Classer (ce guide) ou Analyser (voir le Guide d'analyse).
  3. Enregistrer / Annuler Boutons. Enregistrer crée l'analyseur ; Annuler supprime la ligne.
PDF4me AI Document Parser Ajouter une ligne ouverte avec le champ ID de l'analyseur rempli avec client_invoices, la liste déroulante Type d'analyseur affichant Classer (au-dessus de Parse), et une valeur de Classer sélectionnée dans la ligne, avec les boutons Enregistrer et Annuler à droite

Ajouter une ligne : saisissez l’identifiant de l’analyseur (ici) factures clients), prendre Classer, puis Enregistrer.

Étape 3 : Ouvrez l’analyseur et ajoutez le premier schéma.

Cliquez sur la nouvelle ligne pour ouvrir la page de détails. Le modèle d'URL est :

https://dev.pdf4me.com/ai-document-parser/?id=<your-analyzer-guid>

Le tableau de bord attribue un GUID à chaque analyseur lors de sa première ouverture. Ajoutez cette URL à vos favoris pour accéder directement au même analyseur de classification lors de votre prochaine visite.

La page de détails affiche :

  • Classer les informations (à gauche) affiche l'identifiant de l'analyseur que vous avez saisi à l'étape 2 (ici) client_invoicesCe panneau est en lecture seule.
  • Schémas (à droite). Vide par défaut. Chaque schéma correspond à une variante de document. Cliquez sur + Cliquez sur le bouton en haut à droite pour ajouter le premier schéma.
  • Enregistrer les modifications (en haut à gauche). Conserve toutes les modifications que vous apportez à cette page.
  • Dos. retourne au Liste d'analyseurs.
Page détaillée de l'analyseur de documents IA PDF4me pour un analyseur de classification. La bannière bleue indique « Analyseur de documents IA » avec le sous-titre « Extraction automatique des données de factures grâce à l'IA : résultats rapides, précis et structurés ». En dessous se trouvent un bouton « Retour » et un bouton bleu « Enregistrer les modifications ». Le panneau « Informations sur la classification » à gauche affiche l'identifiant de l'analyseur : client_invoices. La section « Schémas » à droite est vide ; un bouton « + » bleu à l'extrême droite permet d'ajouter un nouveau schéma.

Page de détails. Classer les informations À gauche figure l'identifiant de l'analyseur. Cliquez sur le bouton bleu « + » pour ajouter un schéma.

Étape 4 : Renseignez le nom de la classification, l’invite et le schéma du document

Chaque schéma correspond à une variante de document que l'analyseur doit traiter. Chaque schéma comporte trois champs obligatoires et une ligne de saisie rapide en bas.

Champs du schéma (obligatoires)

ChampButExemple
Classification NameThe label returned by the API when this Schema matches. Use a short, business-friendly name.Client ABC
Classification PromptNatural-language description of how to recognise this variant. Mention company name, email, layout cues, distinguishing phrases. This is what the AI uses to route.The invoice has the company name ABC at the top, followed by the contact email [email protected].
Document SchemaJSON object with a description and a fields array. Each field has fieldName, fieldType, and fieldDescription, plus an optional fieldMethod such as generate for derived values.{ "description": "Extract invoice detail for ABC invoices", "fields": [ ... ] }

Exemple de schéma : Client ABC

L'éditeur de schéma de classification du parseur de documents IA PDF4me affiche le premier schéma intitulé « Client ABC ». Le panneau « Informations de classification » à gauche contient l'identifiant de l'analyseur : client_invoices. La fiche du schéma comporte une icône de corbeille rouge pour la suppression, un champ « Nom de la classification » avec la valeur « Client ABC », un champ « Invite de classification » avec le texte « Le nom de la facture en haut contiendra le nom de la société ABC, suivi de l'adresse e-mail pour les factures client sur abc.com », et un éditeur JSON de schéma de document affichant la description « Extraire les détails des factures ABC » et un tableau de champs commençant par « invoiceNumber » (chaîne de caractères) : numéro de facture, numéro de reçu, et « invoiceDate » : date à générer. Sous l'éditeur se trouvent des boutons de saisie rapide pour les factures et les bons de commande.

Premier schéma. Le nom de la classification, l'invite de classification et le schéma du document décrivent ensemble une variante de document.

Client ABC. Document Schema
{
"description": "Extract invoice detail for ABC invoices",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldMethod": "generate",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4-digit year not found then consider 2-digit year at the end of extracted date."
}
]
}

L'invite de classification pour le client ABC est l'indication en langage naturel qui guide l'IA vers ce schéma :

« La facture porte en haut le nom de l'entreprise ABC, suivi de l'adresse électronique de contact. » [email protected]."

Étape 5 : Ajouter d’autres schémas et enregistrer les modifications

Cliquez sur le bleu + Cliquez à nouveau sur le bouton pour ajouter un schéma pour la variante suivante. Chaque nouveau schéma possède son propre nom de classification, son invite de classification et son schéma de document. Les champs peuvent être totalement différents d'un schéma à l'autre. Par exemple, le client ABC peut ne pas avoir de colonne de référence client, contrairement au client XYZ.

Exemple de deuxième schéma : Client XYZ

L'analyseur de documents PDF4me AI classe la deuxième carte de schéma intitulée « Client XYZ ». Nom de la classification : Client XYZ. Description : Le document est une facture. Le nom de la société XYZ figure en en-tête, suivi de l'adresse e-mail du support (xyz.com), puis de l'adresse postale. Un éditeur JSON de schéma de document affiche la description suivante : « Extraire les données de la facture de la société XYZ à l'aide d'un tableau de champs commençant par invoiceNumber et invoiceDate. » Sous l'éditeur se trouvent des boutons de saisie rapide pour les factures et les bons de commande.

Deuxième schéma pour le même analyseur. Les deux schémas se trouvent désormais sous factures clients.

Client XYZ. Document Schema
{
"description": "Extract Invoice data from company XYZ's Invoice",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldMethod": "generate",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4-digit year not found then consider 2-digit year at the end of extracted date."
}
]
}

La liste des schémas se réduit après l'enregistrement.

Une fois les deux schémas saisis, la liste affiche chacun d'eux sous forme de fiche extensible, avec le nom de la classification à gauche et une flèche à droite permettant de la développer. Cliquez sur une fiche pour la modifier ultérieurement.

Page détaillée de l'analyseur de documents PDF4me AI pour un analyseur de classification affichant les deux schémas dans la vue liste réduite. Le panneau d'informations de classification à gauche indique l'identifiant de l'analyseur : client_invoices. La section Schémas à droite liste les clients ABC et XYZ sous forme de deux cartes accordéon réduites avec des flèches d'extension en forme de chevron. Un bouton « + » bleu situé en haut à droite permet d'ajouter d'autres schémas.

Les deux schémas sont enregistrés. Cliquez sur une carte pour la développer et la modifier ; utilisez le + pour ajouter d’autres variantes.

Cliquez Enregistrer les modifications En haut à gauche, conservez tous les schémas que vous avez ajoutés. L'analyseur est désormais opérationnel et prêt à recevoir des données. PDFs.

Options au niveau des champs dans le schéma du document

AttributRequis?Ce que cela fait
fieldNameRequiredThe name of the field and how it will appear in the response JSON.
fieldTypeRequiredThe type of data to extract. One of string, number, date, or table.
fieldDescriptionRequiredNatural-language description of what needs to be extracted and where to find it. Include alternate labels and example formats so the AI matches correctly.
fieldMethodOptional (default extract)How the AI fills the value. extract takes the value verbatim from the document. generate tells the AI to derive or normalise it (useful for dates, computed totals, or cleaned-up IDs). Omit for default extract behaviour.
fieldsRequired when fieldType is tableNested array describing the columns of the table. Each entry takes the same attributes as a top-level field (fieldName, fieldType, fieldDescription, fieldMethod). Cannot itself be table.

Schéma avec un champ de table (lignes imbriquées)

Utiliser type de champ : « table » lorsqu'un schéma doit extraire des lignes répétées, telles que les lignes de facture. Chaque champ de table contient ses propres éléments imbriqués. champs tableau décrivant les colonnes.

{
"description": "Invoice data extractor",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4 digit year not found then consider 2 digit year at the end of extracted date.",
"fieldMethod": "generate"
},
{
"fieldName": "lineItems",
"fieldType": "table",
"fieldDescription": "All product / service rows from the invoice table. Be careful, sometimes a row can be part of the next item like when description goes over one line, but it's of a single item.",
"fields": [
{
"fieldName": "itemNumber",
"fieldType": "string",
"fieldDescription": "Product number, product id number or product code"
},
{
"fieldName": "hsnCode",
"fieldType": "string",
"fieldDescription": "HSN / SAC code (4 to 8 digit)"
}
]
}
]
}

Boutons de remplissage rapide (à utiliser comme point de départ)

L'éditeur de schémas offre Facture et Bon de commande boutons prédéfinis en bas de la carte Schéma du document. Utilisez-les comme point de départ Il vous suffit de cliquer sur un élément pour générer un schéma type pour cette famille de documents, puis d'ajuster les noms, types, méthodes et descriptions des champs en fonction de la variante que vous configurez. Les préréglages servent de structure de base et ne constituent pas la structure finale.

Utilisez l'analyseur de classification dans API ou appels d'automatisation

Une fois enregistré, le même identifiant d'analyseur s'exécute partout par simple référence. Il n'est pas nécessaire de recréer les schémas sur chaque plateforme.

ChampSourceBut
AnalyzerIdLa chaîne que vous avez saisie à l'étape 2 (client_invoices)Identifiant stable pour l'analyseur de classification.
docNameSource PDF nom de fichierUtilisé pour le suivi et les messages d'erreur.
docContentSource PDF encodé comme Base64Le document à classer et à partir duquel extraire des informations.
asyncfalse pour synchrone, true pour les sondagesContrôle la transmission des réponses.

Exemple REST Corps de la requête :

{
"docName": "incoming_invoice.pdf",
"docContent": "BASE64_ENCODED_PDF_CONTENT",
"AnalyzerId": "client_invoices",
"async": false
}

La réponse contient le nom de classification correspondant ainsi que les champs définis dans le schéma de document associé. Un document reconnu comme appartenant au Client ABC renvoie les champs du Client ABC ; un document reconnu comme appartenant au Client XYZ renvoie les champs du Client XYZ. Un seul appel pour les deux décisions.

Flux de travail courants

Modèles typiques de l'analyseur de classificationHow a Classify Analyzer with multiple Schemas runs in production.
Boîte de réception AP multi-clients
  1. Les factures des fournisseurs, notamment celles du client ABC, du client XYZ et de quelques autres, arrivent dans une seule boîte aux lettres.
  2. Make, Zapier, Power Automate, ou n8n appelle l'analyseur d'IA avec Identifiant de l'analyseur : factures_clients.
  3. La réponse contient le nom de la classification (Client ABC, Client XYZ, etc.) et les champs extraits.
  4. Une étape de commutation achemine chaque résultat vers l'élément correspondant. ERP Enregistrement client utilisant le nom de classification ; les champs extraits alimentent directement l’enregistrement de la facture.
Intégration des fournisseurs sans reconstruction
  1. Un nouveau fournisseur envoie pour la première fois une facture avec une mise en page différente.
  2. Les opérations ouvrent l'existant factures clients Dans le tableau de bord, cliquez sur « Analyseur ». +.
  3. Un nouveau schéma est ajouté avec un nom de classification (le nom du fournisseur), une invite de classification décrivant la mise en page et un schéma de document pour les champs importants.
  4. Le prochain vol entrant PDF Le routage vers le nouveau schéma est automatique. Aucune reconfiguration d'automatisation n'est nécessaire.
triage de documents mixtes
  1. One Analyzer couvre les factures, les bons de commande et les avoirs.
  2. Chaque invite de classification de schéma décrit les marqueurs distinctifs (« contient ») Facturer à et un total à payer" vs. "contient un numéro de commande et une adresse de livraison").
  3. Le schéma de document par schéma extrait les champs pertinents pour ce type de document.
  4. Les branches de routage en aval se basent sur le nom de classification ; chaque branche écrit dans le système correspondant.

Meilleures pratiques de schéma pour la classification

  • Un schéma par variante de document stable. Deux fournisseurs avec des mises en page très différentes devraient avoir deux schémas distincts, et non un seul avec des règles qui se chevauchent.
  • L'invite de classification est votre règle de routage. Rédigez-la en langage clair et incluez des marqueurs concrets (nom de l'entreprise, adresse e-mail, expressions distinctives, indications de mise en page).
  • Choisissez un nom de classification court, clair et stable. Il servira de base au routage en aval.
  • Utilisez les boutons de remplissage rapide Facture et Bon de commande comme points de départ, puis affinez les descriptions des champs pour chaque variante.
  • Ajouter fieldMethod: "generate" aux dates, aux totaux calculés ou aux champs pour lesquels l'IA doit normaliser la valeur au lieu de la copier telle quelle.
  • Testez chaque schéma sur un échantillon réel avant la mise en production : une facture du client ABC doit toujours être acheminée vers le schéma du client ABC, et non vers celui du client XYZ.
  • Cliquez Enregistrer les modifications Après chaque cycle de modification, les schémas non enregistrés sont perdus lors de la navigation.

Actions connexes

Analyseur de documents IA utilisant Parse
Même tableau de bord, un seul schéma par analyseur. À utiliser lorsque tous les documents traités partagent la même famille de mise en page.
IA - Analyseur de documents dans Make
Utilisez votre ID d'analyseur de classification enregistré à partir d'un Make Scénario. Associez-le à n'importe quelle source de données et module de stockage pour déployer le routage et l'extraction dans des flux de travail visuels.
IA - Analyseur de documents dans Power Automate
Exécutez le même analyseur de classification à partir d'un Power Automate flux. Se connecte naturellement à SharePoint, Excel, Dataverse, et Outlook.
IA - Analyseur de documents dans n8n
Auto-hébergé ou cloud n8n Flux de travail. Le menu déroulant ID de l'analyseur IA charge directement vos analyseurs enregistrés depuis votre compte.
IA - Analyseur de documents dans Zapier
Déclenchez l'extraction d'IA à partir de plus de 6 000 SaaS Applications et webhooks. Saisissez l'ID de votre analyseur de classification enregistré dans le champ Nom de l'analyseur d'IA.

Foire aux questions

How is Classify different from Parse in AI Document Parser?+
Parse holds a single Document Schema and returns its extracted fields. Classify holds multiple Schemas, one per document variant, each with its own Classification Prompt and Document Schema. At runtime the AI picks the best-matching Schema and returns its fields plus the Classification Name. Use Classify when one Analyzer must handle several layouts.
What is the Classification Prompt?+
A natural-language description of the markers that identify this document variant. Mention the company name printed at the top, the contact email, layout cues, anything distinctive. The AI compares every Schema Classification Prompt against the incoming PDF to pick the best match.
Can each Schema have different fields?+
Yes. Each Schema has its own Document Schema, so Client ABC can extract invoiceNumber and invoiceDate while Client XYZ extracts invoiceNumber, customerRef, and PONumber. The response contains exactly the fields defined in the matched Schema.
What does fieldMethod: generate do?+
Inside a Document Schema, fieldMethod controls how the AI fills the value. generate tells the AI to derive or normalize the value rather than copy a substring verbatim. Useful for dates (normalize multiple formats), totals (compute or normalize), and identifiers that may need cleanup. Omit fieldMethod for straight extraction.
How many Schemas can I add to one Analyzer?+
No hard cap published. In practice, 5 to 20 well-described Schemas per Analyzer perform best. If you need dozens, group similar variants under broader Classification Names and let the Document Schema handle the small differences.
Does the Analyzer Id change after Save Changes?+
No. The Analyzer Id is the string you typed in the Add row in Step 2 (for example client_invoices). It stays stable across edits and is the value every API call and automation module uses.
Do I need to upload a sample PDF when setting up the Analyzer?+
No. The AI Analyzer does not need a sample for setup. You describe each variant in natural language via the Classification Prompt; the AI engine applies the prompts to whatever document you send at runtime.
What happens if the incoming PDF does not match any Schema confidently?+
The AI still returns its best guess. To handle ambiguous cases, add a catch-all Schema with a generic Classification Prompt and a minimal Document Schema, or route low-confidence responses to a manual review queue in your automation.

Obtenez de l'aide