Extraer datos del formulario de PDF - Analizador de campos API
PDF4me Extraer datos del formulario de PDF le permite extraer todos los datos y valores de los campos del formulario. PDF documentos que contienen formularios rellenables. API procesos de servicio PDF archivos y extrae información de campos de formulario, valores y propiedades de PDF formularios. El API recibe PDF contenido a través de REST API llamadas, utilizando Base64 Codificación para una transmisión segura. Gracias a su compatibilidad con diversos tipos de campos de formulario y la salida de datos estructurados, esta solución es ideal para flujos de trabajo de procesamiento de formularios y plataformas de extracción de datos.
Autenticando su API Pedido
Para acceder al PDF4me REST APICada solicitud debe incluir las credenciales de autenticación adecuadas. La autenticación garantiza una comunicación segura y valida su identidad como usuario autorizado del sistema. REST API.
Características principales
- Extracción de campos de formularioExtrae todos los tipos de campos de formulario, incluidos campos de texto, casillas de verificación, botones de opción, menús desplegables y campos de firma.
- Salida de datos estructurados: Recuperar datos de formulario en formato estructurado JSON formato para una fácil integración
- Propiedades del terrenoExtraer nombres de campos, valores, tipos y propiedades de validación.
- Base64 Codificación: Transmisión segura del contenido de los archivos mediante Base64 codificación
- Simple API Integración: RESTful API Diseñado para flujos de trabajo de procesamiento automatizado de formularios.
REST API Punto final
El PDF4me REST API utiliza estándar HTTP métodos para interactuar con los recursos. Todas las operaciones de extracción de datos de formularios se realizan a través de un único punto final:
- Método: POST
- Punto final:
/api/v2/ExtractPdfFormData
REST API Parámetros
Lista completa de parámetros para la función Extraer datos del formulario PDF REST APILos parámetros están organizados por categoría para una mejor comprensión e implementación.
Importante: Los parámetros marcados con un asterisco (*) son obligatorios y deben proporcionarse para la API para que funcione correctamente.
Parámetros requeridos
| Parámetro | Tipo | Descripción | Ejemplo |
|---|---|---|---|
| docName* | String | Fuente PDF Nombre de archivo con la extensión .pdf adecuada para la identificación del documento y el procesamiento de extracción de datos del formulario. | output.pdf |
| docContent* | Base64 (String) | El contenido de la entrada PDF archivo codificado en Base64 formato para el análisis de campos de formulario y el procesamiento de extracción de datos | JVBERi... |
Parámetros opcionales
| Parámetro | Tipo | Descripción | Ejemplo |
|---|---|---|---|
| async | Boolean | Habilitar el procesamiento asíncrono. Cuando true, el API devoluciones 202 Accepted con un Location encabezado para sondear el resultado | true |
Producción
El PDF4me Extraer datos del formulario de PDF REST API devuelve diferentes respuestas según el modo de procesamiento. API devuelve los datos del campo del formulario extraídos como un JSON respuesta.
- Success Response
- Asynchronous Processing
- Error Responses
- Response Format Details
Procesamiento síncrono (predeterminado)
Cuando async es false o no proporcionado, el API Devuelve inmediatamente los datos del formulario extraídos.
Código de estado: 200 OK
Formato de respuesta:
{
"formFields": [
{
"fieldName": "Name",
"fieldValue": "John Doe",
"fieldType": "text"
},
{
"fieldName": "Email",
"fieldType": "text"
},
{
"fieldName": "Date",
"fieldValue": "2024-01-15",
"fieldType": "date"
}
]
}
La respuesta contiene una matriz de campos de formulario con sus nombres, valores y tipos.
Procesamiento asíncrono
Cuando async es true, el API procesa el documento de forma asíncrona.
Respuesta inicial:
Código de estado: 202 Accepted
Encabezados de respuesta:
Location: https://api.pdf4me.com/api/v2/ExtractPdfFormDataStatus/{operationId}
Cuerpo de la respuesta:
{
"traceId": "operation-trace-id"
}
Encuesta para obtener resultados:
Utilice el Location encabezado URL para consultar la finalización:
const response = await fetch(locationUrl, {
headers: { 'Authorization': 'Basic ' + apiKey }
});
// Continue polling until status code is 200
if (response.status === 200) {
const result = await response.json();
// Process extracted form data
}
Respuestas de error
| Código de estado | Descripción | Ejemplo de respuesta |
|---|---|---|
| 400 Bad Request | Parámetros de solicitud no válidos o campos obligatorios faltantes. | {"error": "Missing required parameter: docContent"} |
| 401 Unauthorized | Inválido o faltante API llave | {"error": "Unauthorized"} |
| 408 Tiempo de espera de solicitud agotado | Tiempo de espera agotado para el procesamiento de la solicitud. | {"error": "Request timeout"} |
| 500 Internal Server Error | Error del servidor durante el procesamiento | {"error": "Internal server error"} |
Comprender el JSON Respuesta
La respuesta de extracción de datos del formulario es una JSON objeto que contiene una matriz de campos de formulario:
- campos de formulario: Array de objetos de campo de formulario
- nombre del campo: El nombre del campo del formulario
- valor del campo: El valor introducido en el campo del formulario
- tipo de campo: El tipo de campo del formulario (texto, casilla de verificación, botón de opción, fecha, etc.)
Tipos de campos:
Los tipos de campos de formulario más comunes incluyen:
textCampos de entrada de textocheckboxCampos de casilla de verificación (valores booleanos)radio: Grupos de botones de opcióndateCampos del selector de fechanumberCampos de entrada numéricosdropdown: Campos desplegables/de selecciónsignatureCampos de firma digital
Ejemplo de solicitud
Encabezamiento
Content-Type: application/json
Authorization: Basic YOUR_BASE64_ENCODED_API_KEY
Nota:
- Consigue tu API clave del PDF4me Panel
- El API La clave debe ser Base64 codificado y prefijado con "Basic" en el Authorization encabezado
- Ejemplo: Si su API La clave es
abc123, codificarlo a Base64 y usarAuthorization: Basic YWJjMTIz
Carga útil
Solicitud básica:
{
"docContent": "JVBERi0xLjQKJeLjz9MKMSAwIG9iago8PAovVHlwZSAvQ2F0YWxvZwovUGFnZXMgMiAwIFIKPj4KZW5kb2JqCjIgMCBvYmoKPDwKL1R5cGUgL1BhZ2VzCi9LaWRzIFszIDAgUl0KL0NvdW50IDEKPD4KZW5kb2JqCjMgMCBvYmoKPDwKL1R5cGUgL1BhZ2UKL1BhcmVudCAyIDAgUgovTWVkaWFCb3ggWzAgMCA2MTIgNzkyXQovUmVzb3VyY2VzIDw8Ci9Gb250IDw8Ci9GMSA0IDAgUgo+Pgo+PgovQ29udGVudHMgNSAwIFIKPj4KZW5kb2JqCjQgMCBvYmoKPDwKL1R5cGUgL0ZvbnQKL1N1YnR5cGUgL1R5cGUxCi9CYXNlRm9udCAvSGVsdmV0aWNhCj4+CmVuZG9iago1IDAgb2JqCjw8Ci9MZW5ndGggNDQKPj4Kc3RyZWFtCkJUCi9GMSAxMiBUZgoxMDAgNzAwIFRkCihIZWxsbyBXb3JsZCkgVGoKRVQKZW5kc3RyZWFtCmVuZG9iagp4cmVmCjAgNgowMDAwMDAwMDAwIDY1NTM1IGYgCjAwMDAwMDAwMDkgMDAwMDAgbiAKMDAwMDAwMDA1NCAwMDAwMCBuIAowMDAwMDAwMTAxIDAwMDAwIG4gCjAwMDAwMDAxNzAgMDAwMDAgbiAKMDAwMDAwMDI0NCAwMDAwMCBuIAp0cmFpbGVyCjw8Ci9TaXplIDYKL1Jvb3QgMSAwIFIKPj4Kc3RhcnR4cmVmCjM0MQolJUVPRg==",
"docName": "output.pdf"
}
Con procesamiento asíncrono:
{
"docContent": "JVBERi0xLjQKJeLjz9MK...",
"docName": "output.pdf",
"async": true
}
Ejemplos de código
El PDF4me Extraer datos del formulario de PDF REST API Proporciona ejemplos de código en varios lenguajes de programación. Elija el lenguaje que mejor se adapte a su entorno de desarrollo:
- C#
- Java
- JavaScript
- Python
- Salesforce
- n8n
- Google Script
- AWS Lambda
C# (CSharp) Muestra
Completo C# implementación para extraer datos de formularios de PDF:
Java Muestra
Java Implementación con manejo completo de errores y procesamiento de respuestas:
JavaScript Muestra
Node.js y compatible con navegadores JavaScript implementación:
Google Apps Script Muestra
Google Apps Script implementación para Google Workspace integración:
Características de extracción de datos de formularios
Capacidades de análisis de campo
- Detección completa del campo: Identificar todos los campos del formulario, incluidos los campos ocultos y calculados.
- Extracción de valor: Extraer los valores actuales y los valores predeterminados de todos los tipos de campo.
- Análisis de propiedades: Recuperar las propiedades del campo, incluyendo nombres, tipos, posiciones y reglas de validación.
- Validación de datos: Verificar la integridad de los datos de campo y el cumplimiento del formato.
Procesamiento de formularios
- PDF Análisis de formas: Análisis profundo de PDF estructura de la forma y relaciones de campo
- Reconocimiento del tipo de campo: Identificación automática de varios tipos de campos de formulario
- Procesamiento por lotes: Procesar múltiples formularios y extraer datos de estructuras de formularios complejas.
- Salida estructuradaGenerar datos organizados y estructurados para una fácil integración.
Características avanzadas
- Cartografía de campo: Asignar campos de formulario a columnas de base de datos o campos de aplicación.
- Transformación de datos: Convertir datos de formulario a varios formatos de salida (JSON, XML, CSV)
- Reglas de validación: Extraer y aplicar reglas y restricciones de validación de formularios
- Resultados profesionalesExtracción de alta calidad adecuada para aplicaciones empresariales.
Casos de uso y aplicaciones en la industria
- Document Management & Processing
- Business & Finance
- Legal & Compliance
- Healthcare & Medical
- Government & Public Sector
- Education & Research
Casos de uso para la gestión y el procesamiento de documentos
- Recopilación de datos de formularios: Extraer datos de los campos completados PDF formularios para el almacenamiento de bases de datos
- Digitalización de documentos: Convertir formularios en papel a datos digitales mediante PDF procesamiento
- Migración de datos: Extraer datos de formularios durante la migración de documentos y las actualizaciones del sistema.
- Análisis de formasAnalizar las tasas de finalización de formularios y los patrones de uso de campos.
Casos de uso en negocios y finanzas
- Procesamiento de facturas: Extraer datos de formularios de facturas y órdenes de compra
- Procesamiento de solicitudes: Tramitar solicitudes de préstamos, reclamaciones de seguros y formularios de registro.
- Datos de la encuestaExtraer respuestas de encuestas de clientes y formularios de comentarios.
- Formularios de cumplimiento: Tramitar formularios de cumplimiento normativo y documentos fiscales.
Casos de uso legales y de cumplimiento normativo
- Formularios legales: Extraer datos de documentos legales y formularios judiciales
- Procesamiento de contratos: Procesar formularios de contrato y datos de acuerdos
- Cumplimiento normativo: Extraer datos de formularios de cumplimiento y documentos reglamentarios
- Recopilación de pruebas: Extraer datos de formularios para pruebas y documentación legal
Casos de uso en el sector sanitario y médico
- Formularios del pacienteExtraer datos de los formularios de registro de pacientes e historial médico.
- Reclamaciones de seguros: Tramitar formularios de reclamación de seguros y documentos de facturación médica
- Ensayos clínicosExtraer datos de formularios de investigación y documentos de estudios clínicos.
- Registros médicos: Procesar formularios médicos y documentos de información del paciente.
Casos de uso en el gobierno y el sector público
- Servicios al Ciudadano: Extraer datos de formularios gubernamentales y solicitudes ciudadanas
- Procesamiento de impuestos: Tramitar formularios de impuestos y documentos de divulgación financiera
- Solicitudes de permisos: Extraer datos de los formularios de solicitud de permisos y licencias
- Registros públicos: Tramitar registros públicos y documentos oficiales del gobierno.
Casos de uso en educación e investigación
- Formularios para estudiantesExtraer datos de los formularios de inscripción y las solicitudes académicas.
- Datos de investigación: Procesar formularios de investigación y respuestas a encuestas
- Formularios de evaluaciónExtraer datos de los formularios de evaluación y valoración.
- Formularios administrativos: Tramitar formularios administrativos y documentos institucionales