Saltar al contenido principal

Extraer tabla de PDF - Analizador de datos API

PDF4me Extraer tabla de PDF le permite extraer estructuras de tablas y datos de PDF documentos. Este API procesos de servicio PDF archivos y extrae el contenido, la estructura y los datos de las tablas. PDF Los documentos. El API recibe PDF contenido a través de REST API llamadas, utilizando Base64 Codificación para una transmisión segura. Con soporte para la salida de datos estructurados y el análisis de tablas, esta solución es ideal para flujos de trabajo de procesamiento de datos y plataformas de inteligencia empresarial.

Entradas de blog relacionadas
Aún no hay ninguna entrada de blog sobre esta función; estará disponible próximamente.
Mientras tanto, echa un vistazo al blog de PDF4me para encontrar tutoriales y flujos de trabajo para todas las plataformas.
Visita el blog

Autenticando su API Pedido

Para acceder al PDF4me REST APICada solicitud debe incluir las credenciales de autenticación adecuadas. La autenticación garantiza una comunicación segura y valida su identidad como usuario autorizado del sistema. REST API.

Características principales

  • Extracción de tabla: Extraer estructuras de tablas y datos de PDF documentos
  • Salida de datos estructurados: Recuperar datos de tablas en formatos organizados y estructurados para una fácil integración.
  • Preservación de la estructura de la tablaMantener el diseño de la tabla, los encabezados, las filas y las relaciones entre columnas.
  • Base64 Codificación: Transmisión segura del contenido de los archivos mediante Base64 codificación
  • Simple API Integración: RESTful API Diseñado para flujos de trabajo automatizados de extracción de tablas.

REST API Punto final

El PDF4me REST API utiliza estándar HTTP métodos para interactuar con los recursos. Todas las operaciones de extracción de tablas se realizan a través de un único punto final:

  • Método: POST
  • Punto final: /api/v2/ExtractTableFromPdf

REST API Parámetros

Lista completa de parámetros para la función Extraer tabla de PDF REST APILos parámetros están organizados por categoría para una mejor comprensión e implementación.

Importante: Los parámetros marcados con un asterisco (*) son obligatorios y deben proporcionarse para la API para que funcione correctamente.

Parámetros requeridos

ParámetroTipoDescripciónEjemplo
docName*StringFuente PDF Nombre de archivo con la extensión .pdf adecuada para la identificación del documento y el procesamiento de extracción de tablas.output.pdf
docContent*Base64 (String)El contenido de la entrada PDF archivo codificado en Base64 formato para el análisis de tablas y el procesamiento de extracción de datosJVBERi...

Parámetros opcionales

ParámetroTipoDescripciónEjemplo
asyncBooleanHabilitar el procesamiento asíncrono. Cuando true, el API devoluciones 202 Accepted con un Location encabezado para sondear el resultadotrue

Producción

El PDF4me Extraer tabla de PDF REST API devuelve diferentes respuestas según el modo de procesamiento. API devuelve los datos de la tabla extraídos como un JSON respuesta.

Procesamiento síncrono (predeterminado)

Cuando async es false o no proporcionado, el API Devuelve inmediatamente los datos de la tabla extraída.

Código de estado: 200 OK

Formato de respuesta:

{
"tables": [
{
"rows": [
["Header 1", "Header 2", "Header 3"],
["Data 1", "Data 2", "Data 3"],
["Data 4", "Data 5", "Data 6"]
],
"columns": 3,
"rows": 3
}
]
}

La respuesta contiene una serie de tablas, cada una con filas, columnas y datos de celdas.

Ejemplo de solicitud

Encabezamiento

Content-Type: application/json
Authorization: Basic YOUR_BASE64_ENCODED_API_KEY

Nota:

  • Consigue tu API clave del PDF4me Panel
  • El API La clave debe ser Base64 codificado y prefijado con "Basic" en el Authorization encabezado
  • Ejemplo: Si su API La clave es abc123, codificarlo a Base64 y usar Authorization: Basic YWJjMTIz

Carga útil

Solicitud básica:

{
"docContent": "JVBERi0xLjQKJeLjz9MKMSAwIG9iago8PAovVHlwZSAvQ2F0YWxvZwovUGFnZXMgMiAwIFIKPj4KZW5kb2JqCjIgMCBvYmoKPDwKL1R5cGUgL1BhZ2VzCi9LaWRzIFszIDAgUl0KL0NvdW50IDEKPD4KZW5kb2JqCjMgMCBvYmoKPDwKL1R5cGUgL1BhZ2UKL1BhcmVudCAyIDAgUgovTWVkaWFCb3ggWzAgMCA2MTIgNzkyXQovUmVzb3VyY2VzIDw8Ci9Gb250IDw8Ci9GMSA0IDAgUgo+Pgo+PgovQ29udGVudHMgNSAwIFIKPj4KZW5kb2JqCjQgMCBvYmoKPDwKL1R5cGUgL0ZvbnQKL1N1YnR5cGUgL1R5cGUxCi9CYXNlRm9udCAvSGVsdmV0aWNhCj4+CmVuZG9iago1IDAgb2JqCjw8Ci9MZW5ndGggNDQKPj4Kc3RyZWFtCkJUCi9GMSAxMiBUZgoxMDAgNzAwIFRkCihIZWxsbyBXb3JsZCkgVGoKRVQKZW5kc3RyZWFtCmVuZG9iagp4cmVmCjAgNgowMDAwMDAwMDAwIDY1NTM1IGYgCjAwMDAwMDAwMDkgMDAwMDAgbiAKMDAwMDAwMDA1NCAwMDAwMCBuIAowMDAwMDAwMTAxIDAwMDAwIG4gCjAwMDAwMDAxNzAgMDAwMDAgbiAKMDAwMDAwMDI0NCAwMDAwMCBuIAp0cmFpbGVyCjw8Ci9TaXplIDYKL1Jvb3QgMSAwIFIKPj4Kc3RhcnR4cmVmCjM0MQolJUVPRg==",
"docName": "output.pdf"
}

Con procesamiento asíncrono:

{
"docContent": "JVBERi0xLjQKJeLjz9MK...",
"docName": "output.pdf",
"async": true
}

Ejemplos de código

El PDF4me Extraer tabla de PDF REST API Proporciona ejemplos de código en varios lenguajes de programación. Elija el lenguaje que mejor se adapte a su entorno de desarrollo:

C# (CSharp) Muestra

Completo C# implementación para extraer tablas de PDF:

Características de extracción de tablas

Capacidades de extracción de datos

  • Recuperación completa de la mesa: Extraer todos los datos de la tabla de PDF documentos con preservación precisa de la estructura
  • Reconocimiento de encabezado: Identificar y conservar los encabezados de tabla, los nombres de columna y las etiquetas de fila.
  • Extracción del contenido celular: Extraer el contenido de celdas individuales con los tipos de datos y el formato adecuados.
  • Análisis de la estructura de la tablaMantener el diseño de la tabla, las relaciones y la estructura jerárquica.

Procesamiento avanzado

  • Compatibilidad con múltiples mesas: Procesar varias tablas dentro de una sola PDF documento
  • Manejo complejo de tablas: Extraer tablas con celdas combinadas, filas que abarcan varias columnas y diseños complejos.
  • Preservación del formato: Mantener el formato, el estilo y la apariencia visual originales de la tabla.
  • Validación de datosGarantizar la integridad y precisión de los datos durante el proceso de extracción.

Características profesionales

  • Salida estructuradaGenerar datos organizados y estructurados para una fácil integración.
  • Procesamiento por lotes: Procesar múltiples PDFs y extraer tablas de manera eficiente
  • Seguro de calidadGarantizar la precisión y fiabilidad de la extracción para aplicaciones empresariales.
  • Integración empresarialIntegración perfecta con los sistemas de gestión de datos existentes.

Casos de uso y aplicaciones en la industria

Casos de uso de inteligencia empresarial y análisis de datos

  • Información financieraExtraer tablas financieras de informes para análisis de datos e informes.
  • Métricas de rendimiento: Tablas de KPI de proceso y paneles de rendimiento para inteligencia empresarial
  • Almacenamiento de datosExtraer datos estructurados de documentos para alimentar el almacén de datos.
  • Análisis de negocio: Convertir PDF convertir tablas en formatos de datos analizables para obtener información valiosa.

Obtén ayuda