Saltar al contenido principal

Extraer datos del formulario de PDF - Analizador de campos API

PDF4me Extraer datos del formulario de PDF le permite extraer todos los datos y valores de los campos del formulario. PDF documentos que contienen formularios rellenables. API procesos de servicio PDF archivos y extrae información de campos de formulario, valores y propiedades de PDF formularios. El API recibe PDF contenido a través de REST API llamadas, utilizando Base64 Codificación para una transmisión segura. Gracias a su compatibilidad con diversos tipos de campos de formulario y la salida de datos estructurados, esta solución es ideal para flujos de trabajo de procesamiento de formularios y plataformas de extracción de datos.

Entradas de blog relacionadas
Aún no hay ninguna entrada de blog sobre esta función; estará disponible próximamente.
Mientras tanto, echa un vistazo al blog de PDF4me para encontrar tutoriales y flujos de trabajo para todas las plataformas.
Visita el blog

Autenticando su API Pedido

Para acceder al PDF4me REST APICada solicitud debe incluir las credenciales de autenticación adecuadas. La autenticación garantiza una comunicación segura y valida su identidad como usuario autorizado del sistema. REST API.

Características principales

  • Extracción de campos de formularioExtrae todos los tipos de campos de formulario, incluidos campos de texto, casillas de verificación, botones de opción, menús desplegables y campos de firma.
  • Salida de datos estructurados: Recuperar datos de formulario en formato estructurado JSON formato para una fácil integración
  • Propiedades del terrenoExtraer nombres de campos, valores, tipos y propiedades de validación.
  • Base64 Codificación: Transmisión segura del contenido de los archivos mediante Base64 codificación
  • Simple API Integración: RESTful API Diseñado para flujos de trabajo de procesamiento automatizado de formularios.

REST API Punto final

El PDF4me REST API utiliza estándar HTTP métodos para interactuar con los recursos. Todas las operaciones de extracción de datos de formularios se realizan a través de un único punto final:

  • Método: POST
  • Punto final: /api/v2/ExtractPdfFormData

REST API Parámetros

Lista completa de parámetros para la función Extraer datos del formulario PDF REST APILos parámetros están organizados por categoría para una mejor comprensión e implementación.

Importante: Los parámetros marcados con un asterisco (*) son obligatorios y deben proporcionarse para la API para que funcione correctamente.

Parámetros requeridos

ParámetroTipoDescripciónEjemplo
docName*StringFuente PDF Nombre de archivo con la extensión .pdf adecuada para la identificación del documento y el procesamiento de extracción de datos del formulario.output.pdf
docContent*Base64 (String)El contenido de la entrada PDF archivo codificado en Base64 formato para el análisis de campos de formulario y el procesamiento de extracción de datosJVBERi...

Parámetros opcionales

ParámetroTipoDescripciónEjemplo
asyncBooleanHabilitar el procesamiento asíncrono. Cuando true, el API devoluciones 202 Accepted con un Location encabezado para sondear el resultadotrue

Producción

El PDF4me Extraer datos del formulario de PDF REST API devuelve diferentes respuestas según el modo de procesamiento. API devuelve los datos del campo del formulario extraídos como un JSON respuesta.

Procesamiento síncrono (predeterminado)

Cuando async es false o no proporcionado, el API Devuelve inmediatamente los datos del formulario extraídos.

Código de estado: 200 OK

Formato de respuesta:

{
"formFields": [
{
"fieldName": "Name",
"fieldValue": "John Doe",
"fieldType": "text"
},
{
"fieldName": "Email",
"fieldValue": "[email protected]",
"fieldType": "text"
},
{
"fieldName": "Date",
"fieldValue": "2024-01-15",
"fieldType": "date"
}
]
}

La respuesta contiene una matriz de campos de formulario con sus nombres, valores y tipos.

Ejemplo de solicitud

Encabezamiento

Content-Type: application/json
Authorization: Basic YOUR_BASE64_ENCODED_API_KEY

Nota:

  • Consigue tu API clave del PDF4me Panel
  • El API La clave debe ser Base64 codificado y prefijado con "Basic" en el Authorization encabezado
  • Ejemplo: Si su API La clave es abc123, codificarlo a Base64 y usar Authorization: Basic YWJjMTIz

Carga útil

Solicitud básica:

{
"docContent": "JVBERi0xLjQKJeLjz9MKMSAwIG9iago8PAovVHlwZSAvQ2F0YWxvZwovUGFnZXMgMiAwIFIKPj4KZW5kb2JqCjIgMCBvYmoKPDwKL1R5cGUgL1BhZ2VzCi9LaWRzIFszIDAgUl0KL0NvdW50IDEKPD4KZW5kb2JqCjMgMCBvYmoKPDwKL1R5cGUgL1BhZ2UKL1BhcmVudCAyIDAgUgovTWVkaWFCb3ggWzAgMCA2MTIgNzkyXQovUmVzb3VyY2VzIDw8Ci9Gb250IDw8Ci9GMSA0IDAgUgo+Pgo+PgovQ29udGVudHMgNSAwIFIKPj4KZW5kb2JqCjQgMCBvYmoKPDwKL1R5cGUgL0ZvbnQKL1N1YnR5cGUgL1R5cGUxCi9CYXNlRm9udCAvSGVsdmV0aWNhCj4+CmVuZG9iago1IDAgb2JqCjw8Ci9MZW5ndGggNDQKPj4Kc3RyZWFtCkJUCi9GMSAxMiBUZgoxMDAgNzAwIFRkCihIZWxsbyBXb3JsZCkgVGoKRVQKZW5kc3RyZWFtCmVuZG9iagp4cmVmCjAgNgowMDAwMDAwMDAwIDY1NTM1IGYgCjAwMDAwMDAwMDkgMDAwMDAgbiAKMDAwMDAwMDA1NCAwMDAwMCBuIAowMDAwMDAwMTAxIDAwMDAwIG4gCjAwMDAwMDAxNzAgMDAwMDAgbiAKMDAwMDAwMDI0NCAwMDAwMCBuIAp0cmFpbGVyCjw8Ci9TaXplIDYKL1Jvb3QgMSAwIFIKPj4Kc3RhcnR4cmVmCjM0MQolJUVPRg==",
"docName": "output.pdf"
}

Con procesamiento asíncrono:

{
"docContent": "JVBERi0xLjQKJeLjz9MK...",
"docName": "output.pdf",
"async": true
}

Ejemplos de código

El PDF4me Extraer datos del formulario de PDF REST API Proporciona ejemplos de código en varios lenguajes de programación. Elija el lenguaje que mejor se adapte a su entorno de desarrollo:

C# (CSharp) Muestra

Completo C# implementación para extraer datos de formularios de PDF:

Características de extracción de datos de formularios

Capacidades de análisis de campo

  • Detección completa del campo: Identificar todos los campos del formulario, incluidos los campos ocultos y calculados.
  • Extracción de valor: Extraer los valores actuales y los valores predeterminados de todos los tipos de campo.
  • Análisis de propiedades: Recuperar las propiedades del campo, incluyendo nombres, tipos, posiciones y reglas de validación.
  • Validación de datos: Verificar la integridad de los datos de campo y el cumplimiento del formato.

Procesamiento de formularios

  • PDF Análisis de formas: Análisis profundo de PDF estructura de la forma y relaciones de campo
  • Reconocimiento del tipo de campo: Identificación automática de varios tipos de campos de formulario
  • Procesamiento por lotes: Procesar múltiples formularios y extraer datos de estructuras de formularios complejas.
  • Salida estructuradaGenerar datos organizados y estructurados para una fácil integración.

Características avanzadas

  • Cartografía de campo: Asignar campos de formulario a columnas de base de datos o campos de aplicación.
  • Transformación de datos: Convertir datos de formulario a varios formatos de salida (JSON, XML, CSV)
  • Reglas de validación: Extraer y aplicar reglas y restricciones de validación de formularios
  • Resultados profesionalesExtracción de alta calidad adecuada para aplicaciones empresariales.

Casos de uso y aplicaciones en la industria

Casos de uso para la gestión y el procesamiento de documentos

  • Recopilación de datos de formularios: Extraer datos de los campos completados PDF formularios para el almacenamiento de bases de datos
  • Digitalización de documentos: Convertir formularios en papel a datos digitales mediante PDF procesamiento
  • Migración de datos: Extraer datos de formularios durante la migración de documentos y las actualizaciones del sistema.
  • Análisis de formasAnalizar las tasas de finalización de formularios y los patrones de uso de campos.

Obtén ayuda