Aller au contenu principal

Extraire les données du formulaire à partir de PDF - Analyseur de champs API

PDF4me Extraire les données du formulaire PDF vous permet d'extraire toutes les données et valeurs des champs de formulaire à partir de PDF documents contenant des formulaires à remplir. API processus de service PDF extrait les fichiers et les informations, valeurs et propriétés des champs de formulaire à partir de ceux-ci. PDF formes. Les API reçoit PDF contenu via REST API appels, utilisant Base64 Encodage pour une transmission sécurisée. Grâce à la prise en charge de différents types de champs de formulaire et de la sortie de données structurées, cette solution est idéale pour les flux de travail de traitement de formulaires et les plateformes d'extraction de données.

Articles de blog connexes
Il n'y a pas encore d'article de blog consacré à cette fonctionnalité — à venir prochainement.
En attendant, n'hésitez pas à consulter le blog de PDF4me pour découvrir des tutoriels et des procédures de travail adaptés à toutes les plateformes.
Consultez le blog

Authentification de votre API Demande

Pour accéder au PDF4me REST APIChaque requête doit inclure des informations d'authentification valides. L'authentification garantit la sécurité des communications et confirme votre identité en tant qu'utilisateur autorisé. REST API.

Caractéristiques principales

  • Extraction des champs de formulaireExtraire tous les types de champs de formulaire, y compris les champs de texte, les cases à cocher, les boutons radio, les listes déroulantes et les champs de signature.
  • Sortie de données structuréesRécupérer les données du formulaire dans un format structuré JSON format pour une intégration facile
  • Propriétés du champExtraire les noms de champs, les valeurs, les types et les propriétés de validation
  • Base64 Encodage: Sécuriser la transmission du contenu des fichiers à l'aide de Base64 encodage
  • Simple API Intégration: RESTful API conçu pour les flux de travail de traitement automatisé des formulaires

REST API Point de terminaison

Le PDF4me REST API utilise la norme HTTP méthodes d'interaction avec les ressources. Toutes les opérations d'extraction de données de formulaire sont effectuées via un point de terminaison unique :

  • Méthode: POST
  • Point final : /api/v2/ExtractPdfFormData

REST API Paramètres

Liste complète des paramètres pour l'extraction des données du formulaire. PDF REST APILes paramètres sont organisés par catégorie pour une meilleure compréhension et une mise en œuvre plus aisée.

Important: Les paramètres marqués d'un astérisque (*) sont obligatoires et doivent être fournis pour le API pour fonctionner correctement.

Paramètres requis

ParamètreTaperDescriptionExemple
docName*StringSource PDF Nom de fichier avec l'extension .pdf appropriée pour l'identification du document et le traitement d'extraction des données du formulaireoutput.pdf
docContent*Base64 (String)Le contenu de l'entrée PDF fichier encodé en Base64 format pour l'analyse des champs de formulaire et le traitement d'extraction des donnéesJVBERi...

Paramètres optionnels

ParamètreTaperDescriptionExemple
asyncBooleanActiver le traitement asynchrone. Lorsque true, le API retours 202 Accepted avec un Location en-tête pour l'interrogation du résultattrue

Sortir

Le PDF4me Extraire les données du formulaire PDF REST API renvoie des réponses différentes selon le mode de traitement. API renvoie les données extraites des champs de formulaire sous forme de JSON réponse.

Traitement synchrone (par défaut)

Quand async est false ou non fourni, le API renvoie immédiatement les données extraites du formulaire.

Code d'état : 200 OK

Format de réponse :

{
"formFields": [
{
"fieldName": "Name",
"fieldValue": "John Doe",
"fieldType": "text"
},
{
"fieldName": "Email",
"fieldValue": "[email protected]",
"fieldType": "text"
},
{
"fieldName": "Date",
"fieldValue": "2024-01-15",
"fieldType": "date"
}
]
}

La réponse contient un tableau de champs de formulaire avec leurs noms, leurs valeurs et leurs types.

Exemple de requête

En-tête

Content-Type: application/json
Authorization: Basic YOUR_BASE64_ENCODED_API_KEY

Note:

  • Obtenez votre API clé de la PDF4me Tableau de bord
  • Le API La clé doit être Base64 encodé et préfixé par « Basic » dans le Authorization en-tête
  • Exemple : Si votre API La clé est abc123, encodez-le en Base64 et utiliser Authorization: Basic YWJjMTIz

Charge utile

Demande de base :

{
"docContent": "JVBERi0xLjQKJeLjz9MKMSAwIG9iago8PAovVHlwZSAvQ2F0YWxvZwovUGFnZXMgMiAwIFIKPj4KZW5kb2JqCjIgMCBvYmoKPDwKL1R5cGUgL1BhZ2VzCi9LaWRzIFszIDAgUl0KL0NvdW50IDEKPD4KZW5kb2JqCjMgMCBvYmoKPDwKL1R5cGUgL1BhZ2UKL1BhcmVudCAyIDAgUgovTWVkaWFCb3ggWzAgMCA2MTIgNzkyXQovUmVzb3VyY2VzIDw8Ci9Gb250IDw8Ci9GMSA0IDAgUgo+Pgo+PgovQ29udGVudHMgNSAwIFIKPj4KZW5kb2JqCjQgMCBvYmoKPDwKL1R5cGUgL0ZvbnQKL1N1YnR5cGUgL1R5cGUxCi9CYXNlRm9udCAvSGVsdmV0aWNhCj4+CmVuZG9iago1IDAgb2JqCjw8Ci9MZW5ndGggNDQKPj4Kc3RyZWFtCkJUCi9GMSAxMiBUZgoxMDAgNzAwIFRkCihIZWxsbyBXb3JsZCkgVGoKRVQKZW5kc3RyZWFtCmVuZG9iagp4cmVmCjAgNgowMDAwMDAwMDAwIDY1NTM1IGYgCjAwMDAwMDAwMDkgMDAwMDAgbiAKMDAwMDAwMDA1NCAwMDAwMCBuIAowMDAwMDAwMTAxIDAwMDAwIG4gCjAwMDAwMDAxNzAgMDAwMDAgbiAKMDAwMDAwMDI0NCAwMDAwMCBuIAp0cmFpbGVyCjw8Ci9TaXplIDYKL1Jvb3QgMSAwIFIKPj4Kc3RhcnR4cmVmCjM0MQolJUVPRg==",
"docName": "output.pdf"
}

Avec le traitement asynchrone :

{
"docContent": "JVBERi0xLjQKJeLjz9MK...",
"docName": "output.pdf",
"async": true
}

Exemples de code

Le PDF4me Extraire les données du formulaire PDF REST API propose des exemples de code dans plusieurs langages de programmation. Choisissez le langage qui convient le mieux à votre environnement de développement :

C# Exemple (CSharp)

Complet C# implémentation pour l'extraction de données de formulaire à partir de PDF:

Fonctionnalités d'extraction de données de formulaire

Capacités d'analyse sur le terrain

  • Détection complète sur le terrainIdentifiez tous les champs de formulaire, y compris les champs cachés et calculés.
  • Extraction de valeurExtraire les valeurs actuelles et les valeurs par défaut de tous les types de champs
  • Analyse immobilièreRécupérer les propriétés des champs, notamment leurs noms, types, positions et règles de validation.
  • Validation des donnéesVérifier l'intégrité et la conformité au format des données de terrain

Traitement des formulaires

  • PDF Analyse de la forme: Analyse approfondie de PDF structure de forme et relations de champ
  • Reconnaissance du type de champIdentification automatique des différents types de champs de formulaire
  • Traitement par lotsTraiter plusieurs formulaires et extraire des données à partir de structures de formulaires complexes.
  • Sortie structuréeGénérer des données organisées et structurées pour une intégration facile

Fonctionnalités avancées

  • Cartographie de terrainAssocier les champs du formulaire aux colonnes de la base de données ou aux champs de l'application
  • Transformation des données: Convertir les données du formulaire en différents formats de sortie (JSON, XML, CSV)
  • Règles de validationExtraire et appliquer les règles et contraintes de validation de formulaire
  • Résultats professionnelsExtraction de haute qualité adaptée aux applications d'entreprise

Cas d'utilisation et applications industrielles

Cas d'utilisation de la gestion et du traitement des documents

  • Collecte de données de formulaireExtraire les données des champs remplis PDF formulaires pour le stockage de bases de données
  • Numérisation de documentsConvertir les formulaires papier en données numériques via PDF traitement
  • Migration de donnéesExtraire les données des formulaires lors de la migration des documents et des mises à jour du système
  • Analyse de la formeAnalyser les taux de remplissage des formulaires et les modèles d'utilisation des champs

Obtenez de l'aide