Classer les documents
PDF4me Classer les documents permet de classer et d'identifier les documents en fonction de leur contenu. API processus de service PDF Le système examine et analyse les fichiers, la structure des documents, les modèles de contenu et les métadonnées afin de déterminer les types et les catégories de documents. API reçoit PDF contenu via REST API appels, utilisant Base64 Encodage pour une transmission sécurisée. Grâce à la prise en charge de l'identification du type de document et de la catégorisation automatique, cette solution est idéale pour les systèmes de gestion documentaire et les flux de travail automatisés.
Authentification de votre API Demande
Pour accéder au PDF4me REST APIChaque requête doit inclure des informations d'authentification valides. L'authentification garantit la sécurité des communications et confirme votre identité en tant qu'utilisateur autorisé. REST API.
Caractéristiques principales
- Classification des documentsIdentifier et classer les types de documents en fonction de l'analyse de contenu
- Analyse de contenuAnalyser la structure du document, les modèles de contenu et les métadonnées
- Plusieurs types de documents: Soutien à divers PDF formats de documents
- Traitement automatiséClassification simplifiée des documents sans intervention manuelle
- Simple API Intégration: RESTful API conçu pour les flux de travail automatisés de traitement de documents
REST API Point de terminaison
Le PDF4me REST API utilise la norme HTTP méthodes d'interaction avec les ressources. Toutes les opérations de classification des documents sont effectuées via un point d'accès unique :
- Méthode: POST
- Point final :
/api/v2/ClassifyDocument
REST API Paramètres
Liste complète des paramètres pour la fonction Classer un document REST APILes paramètres sont organisés par catégorie pour une meilleure compréhension et une mise en œuvre plus aisée.
Important: Les paramètres marqués d'un astérisque (*) sont obligatoires et doivent être fournis pour le API pour fonctionner correctement.
Paramètres requis
| Paramètre | Taper | Description | Exemple |
|---|---|---|---|
| docContent* | Base64 (String) | Le contenu de l'entrée PDF fichier encodé en Base64 format pour le traitement d'analyse et de classification des documents | JVBERi... |
| docName* | String | Source PDF Nom de fichier avec l'extension .pdf appropriée pour l'identification et le traitement du document | output.pdf |
Paramètres optionnels
| Paramètre | Taper | Description | Exemple |
|---|---|---|---|
| async | Boolean | Activer le traitement asynchrone. Lorsque true, le API retours 202 Accepted avec un Location en-tête pour l'interrogation du résultat | true |
Sortir
Le PDF4me Classer les documents REST API renvoie des réponses différentes selon le mode de traitement. API renvoie les données de classification sous forme de JSON réponse.
- Success Response
- Asynchronous Processing
- Error Responses
- Response Format Details
Traitement synchrone (par défaut)
Quand async est false ou non fourni, le API renvoie immédiatement les résultats de la classification.
Code d'état : 200 OK
Format de réponse :
{
"documentType": "invoice",
"category": "financial",
"confidence": 0.95,
"metadata": {
"pageCount": 1,
"createdDate": "2024-01-15T10:30:00Z"
}
}
La réponse contient des données de classification, notamment le type de document, la catégorie, le score de confiance et les métadonnées.
Traitement asynchrone
Quand async est true, le API traite le document de manière asynchrone.
Réponse initiale :
Code d'état : 202 Accepted
En-têtes de réponse :
Location: https://api.pdf4me.com/api/v2/ParseDocumentStatus/{operationId}
Corps de la réponse :
{
"traceId": "operation-trace-id"
}
Sondage pour les résultats :
Utilisez le Location en-tête URL sondage pour vérifier l'achèvement :
const response = await fetch(locationUrl, {
headers: { 'Authorization': 'Basic ' + apiKey }
});
// Continue polling until status code is 200
if (response.status === 200) {
const result = await response.json();
// Process classification results
}
Réponses d'erreur
| Code d'état | Description | Exemple de réponse |
|---|---|---|
| 400 Bad Request | Paramètres de requête invalides ou champs obligatoires manquants | {"error": "Missing required parameter: docContent"} |
| 401 Unauthorized | Invalide ou manquant API clé | {"error": "Unauthorized"} |
| 408 Délai d'attente dépassé | Délai de traitement de la requête dépassé | {"error": "Request timeout"} |
| 500 Internal Server Error | Erreur serveur lors du traitement | {"error": "Internal server error"} |
Comprendre le JSON Réponse
La réponse de classification est une JSON objet contenant des données structurées sur le document :
- type de document: Le type de document identifié (par exemple, « facture », « contrat », « rapport »)
- catégorie: La catégorie du document (par exemple, « financier », « juridique », « commercial »)
- confiance: Un score indiquant le niveau de confiance de la classification (0,0 à 1,0)
- métadonnéesInformations complémentaires sur le document, telles que le nombre de pages, la date de création, etc.
Décodage Base64 Contenu (le cas échéant) :
Si la réponse comprend Base64-contenu encodé, décodez-le à l'aide de :
// JavaScript
const decoded = atob(base64String);
# Python
import base64
decoded = base64.b64decode(base64_string).decode('utf-8')
Exemple de requête
En-tête
Content-Type: application/json
Authorization: Basic YOUR_BASE64_ENCODED_API_KEY
Note:
- Obtenez votre API clé de la PDF4me Tableau de bord
- Le API La clé doit être Base64 encodé et préfixé par « Basic » dans le Authorization en-tête
- Exemple : Si votre API La clé est
abc123, encodez-le en Base64 et utiliserAuthorization: Basic YWJjMTIz
Charge utile
Demande de base :
{
"docContent": "JVBERi0xLjQKJeLjz9MKMSAwIG9iago8PAovVHlwZSAvQ2F0YWxvZwovUGFnZXMgMiAwIFIKPj4KZW5kb2JqCjIgMCBvYmoKPDwKL1R5cGUgL1BhZ2VzCi9LaWRzIFszIDAgUl0KL0NvdW50IDEKPD4KZW5kb2JqCjMgMCBvYmoKPDwKL1R5cGUgL1BhZ2UKL1BhcmVudCAyIDAgUgovTWVkaWFCb3ggWzAgMCA2MTIgNzkyXQovUmVzb3VyY2VzIDw8Ci9Gb250IDw8Ci9GMSA0IDAgUgo+Pgo+PgovQ29udGVudHMgNSAwIFIKPj4KZW5kb2JqCjQgMCBvYmoKPDwKL1R5cGUgL0ZvbnQKL1N1YnR5cGUgL1R5cGUxCi9CYXNlRm9udCAvSGVsdmV0aWNhCj4+CmVuZG9iago1IDAgb2JqCjw8Ci9MZW5ndGggNDQKPj4Kc3RyZWFtCkJUCi9GMSAxMiBUZgoxMDAgNzAwIFRkCihIZWxsbyBXb3JsZCkgVGoKRVQKZW5kc3RyZWFtCmVuZG9iagp4cmVmCjAgNgowMDAwMDAwMDAwIDY1NTM1IGYgCjAwMDAwMDAwMDkgMDAwMDAgbiAKMDAwMDAwMDA1NCAwMDAwMCBuIAowMDAwMDAwMTAxIDAwMDAwIG4gCjAwMDAwMDAxNzAgMDAwMDAgbiAKMDAwMDAwMDI0NCAwMDAwMCBuIAp0cmFpbGVyCjw8Ci9TaXplIDYKL1Jvb3QgMSAwIFIKPj4Kc3RhcnR4cmVmCjM0MQolJUVPRg==",
"docName": "output.pdf"
}
Avec le traitement asynchrone :
{
"docContent": "JVBERi0xLjQKJeLjz9MK...",
"docName": "output.pdf",
"async": true
}
Exemples de code
Le PDF4me Classer les documents REST API propose des exemples de code dans plusieurs langages de programmation. Choisissez le langage qui convient le mieux à votre environnement de développement :
- C#
- Java
- JavaScript
- Python
- Salesforce
- n8n
- Google Script
- AWS Lambda
Java Échantillon
Java implémentation avec gestion complète des erreurs et traitement des réponses :
JavaScript Échantillon
Node.js et compatible avec les navigateurs JavaScript mise en œuvre:
Python Échantillon
Python implémentation avec la bibliothèque requests et JSON manutention:
Google Script Échantillon
Google Apps Script mise en œuvre pour Google Workspace intégration :
Caractéristiques de la classification des documents
Capacités de classification
- Détection du type de documentIdentification des types de documents basée sur l'analyse de contenu
- Catégorisation du contenuRegroupement des documents par contenu et par objectif
- Reconnaissance de modèles: Identification des modèles de documents et des formats standard
- Classification de conformitéClassification pour les exigences réglementaires et de conformité
Fonctionnalités d'entreprise
- Traitement par lotsTraiter plusieurs documents selon des normes de classification cohérentes
- Assurance qualitéGarantir l'exactitude et la fiabilité de la classification pour les applications commerciales
- Prêt pour l'intégrationIntégration transparente avec les systèmes de gestion de documents existants
- Traitement évolutifGérer de gros volumes de documents avec des performances de niveau entreprise
Cas d'utilisation et applications industrielles
- Document Management & Organization
- Compliance & Regulatory
- Business Process Automation
- Financial Services
- Healthcare & Medical
- Legal & Professional Services
Cas d'utilisation de la gestion et de l'organisation des documents
- Classement automatisé: Classer et organiser automatiquement les documents dans les systèmes de classement numérique
- Gestion de contenuCatégorisation avancée pour les systèmes de gestion et de recherche de contenu
- Organisation des archivesClassification systématique des documents et archives historiques
- Optimisation pour les moteurs de rechercheRecherche documentaire améliorée grâce à une classification et un étiquetage précis
Cas d'utilisation en matière de conformité et de réglementation
- Préparation de l'auditClassification automatique des documents à des fins de conformité et d'audit
- Déclarations réglementairesTraitement simplifié des documents pour les soumissions réglementaires
- Découverte légaleClassification efficace des documents pour la recherche de preuves et l'assistance aux litiges
- Conformité aux politiquesVérification automatisée de la conformité des documents aux politiques organisationnelles
Cas d'utilisation de l'automatisation des processus métier
- Routage du flux de travail: Routage automatique des documents en fonction des résultats de classification
- Optimisation des processusFlux de travail de traitement documentaire rationalisés avec classification avancée
- Contrôle de qualitéVérification automatisée des types de documents et de l'exactitude de leur contenu
- Allocation des ressourcesAllocation efficace des ressources de traitement en fonction des types de documents
Cas d'utilisation des services financiers
- Traitement des facturesClassification automatique des factures, des reçus et des documents financiers
- Documentation de prêtTraitement simplifié des demandes de prêt et des pièces justificatives
- Préparation des déclarations de revenusClassification automatisée des documents et formulaires fiscaux
- Soutien à l'auditOrganisation efficace des documents pour les audits et les examens financiers
Cas d'utilisation dans le domaine de la santé et du médical
- Dossiers des patientsClassification automatique des dossiers médicaux et de la documentation des patients
- Réclamations d'assuranceTraitement simplifié des demandes de remboursement d'assurance et des documents médicaux
- Documentation de conformitéClassification automatisée pour la conformité réglementaire dans le secteur de la santé
- Données de recherche: Organisation systématique des documents de recherche médicale et d'essais cliniques
Cas d'utilisation des services juridiques et professionnels
- Gestion des contratsClassification automatique des contrats et accords juridiques
- Documentation du dossierOrganisation efficace des dossiers juridiques et des pièces justificatives
- Surveillance de la conformitéClassification automatisée à des fins de conformité réglementaire et de surveillance
- Documentation clientTraitement simplifié des dossiers clients et de la documentation professionnelle