Saltar al contenido principal

Extraer tabla de PDF usando n8n acción

PDF4me Extraer tabla de PDF identifica y extrae datos de tablas estructuradas de PDF documentos a través de n8n Flujos de trabajo de automatización. Proceso PDFs lejos n8n disparadores, datos binarios, cadenas base64 o público URLs para detectar automáticamente tablas, preservar la estructura de celdas, mantener las relaciones de datos, extraer encabezados y valores, y generar datos estructurados en JSON o en formato Excel. Esta solución es ideal para el análisis de informes financieros, la digitalización de datos, la extracción de datos estadísticos, el procesamiento de facturas, el análisis de formularios y los flujos de trabajo automatizados de extracción de tablas que requieren un reconocimiento preciso de tablas con una salida estructurada y una integración perfecta.

Entradas de blog relacionadas
Aún no hay ninguna entrada de blog sobre esta función; estará disponible próximamente.
Mientras tanto, echa un vistazo al blog de PDF4me para encontrar tutoriales y flujos de trabajo para todas las plataformas.
Visita el blog

Configuración

Añade el PDF4me "Extraer tabla de PDF" nodo a tu n8n flujo de trabajo y configure los parámetros necesarios. Para obtener instrucciones de configuración inicial, consulte nuestra n8n Guía de integración.

Requisitos previos:

  • PDF4me API credenciales
  • n8n acceso al flujo de trabajo

Configuración:

  1. Agregar PDF4me nodo a flujo de trabajo
  2. Seleccione "Extraer tabla de PDF" acción
  3. Configure los parámetros de entrada (véase más abajo).
Extraer tabla del PDF

Parámetros

Lista completa de parámetros para la función Extraer tabla de PDF acción. Configure estos parámetros para controlar la extracción de tablas.

Importante: Los parámetros marcados con un asterisco (***) son obligatorios y deben proporcionarse para que la acción funcione correctamente.

ParámetroTipoDescripciónEjemplo
Tipo de datos de entrada***StringPDF Selección del formato de entrada
• Elija el formato de su PDF entrada de datos
PDF4me admite varios tipos de entrada
• Opciones: Datos binarios, Base64 Cuerda o URL
Binary Data
Campo binario de entradaBinarioBinario PDF Entrada de archivo (Obligatorio si se trata de datos binarios)
• Referencia PDF archivo de anterior n8n carga de nodos o archivos
PDF4me procesos binarios PDF archivos con detección automática de formato
• Obligatorio cuando el tipo de datos de entrada es "Datos binarios".
{{ $binary.data }}
Contenido del documento Base64StringBase64 Codificado PDF Aporte (Obligatorio si Base64 Cadena)
• Proporcionar PDF datos como cadena codificada en base64
PDF4me decodifica y procesa automáticamente el PDF contenido
• Obligatorio cuando el tipo de datos de entrada es "Base64 Cadena"
UEsDBBQABgAI...
URL del archivoStringPúblico PDF URL Aporte (Obligatorio si URL)
• Proporcionar un permiso público/abierto URL hacia PDF archivo
PDF4me descarga y procesa el archivo desde URL
• Obligatorio cuando el tipo de datos de entrada es "URL"
https://abc.com/report.pdf
Nombre del documento***StringFuente PDF Referencia
• Especifique el nombre de la fuente PDF archivo
• Para fines de referencia y seguimiento en la extracción de tablas.
• Ayuda con el seguimiento del procesamiento
financial_report.pdf

Opciones avanzadas

Los siguientes parámetros están disponibles en la sección Opciones avanzadas y son opcionales:

ParámetroTipoDescripciónEjemplo
Perfiles personalizadosStringPerfiles de configuración personalizados
• Configure opciones adicionales mediante perfiles personalizados.
JSONformato similar que contiene parámetros predefinidos
• Permite configurar ajustes avanzados de procesamiento de tablas.
• Opcional para requisitos especializados
{ "OutputDataFormat": "json" }

Tipos de tabla compatibles

Tipo de tablaDescripciónCasos de uso comunes
Tablas financierasEstados financieros, presupuestos y datos contablesInformes financieros, facturas, balances
Tablas de datosDatos estadísticos, métricas e información analíticaInformes de investigación, análisis, datos de rendimiento
Listar tablasCatálogos de productos, directorios y listas de inventarioListados de productos, directorios de empleados, catálogos
Tablas comparativasComparación de características, tablas de precios y especificaciones.Comparación de productos, matrices de precios, especificaciones
Tablas de horariosHorarios, calendarios y documentos de planificaciónHorarios de reuniones, cronogramas de proyectos, calendarios
Tablas resumenResúmenes ejecutivos, indicadores clave y datos generalesDatos del panel de control, resúmenes de KPI, informes ejecutivos

Características de procesamiento de tablas

CaracterísticaDescripciónCaso de uso
Detección de mesasIdentificación automática de límites y estructuras de tablas.Procesamiento de documentos con varias tablas
Extracción de célulasExtracción precisa de valores y contenido de células individuales.Análisis y procesamiento de datos
Reconocimiento de encabezadoIdentificación de encabezados de tabla y etiquetas de columnaOrganización de datos estructurados
Procesamiento de filasExtracción de filas completas de la tabla con el formato adecuado.Integración y almacenamiento de bases de datos
Alineación de columnasPreservación de la estructura y alineación de la columna.Mantener las relaciones de datos
Tablas de varias páginasProcesamiento de tablas que abarcan varias páginas.Análisis de documentos complejos

Producción

Parámetros de salida

ParámetroTipoDescripciónEjemplo
Nombre del archivoStringPDF4me nombre del archivo de salida - Nombre del generado JSON archivo que contiene los datos de la tabla extraídos. El archivo contiene toda la información estructurada de la tabla en JSON formatotable_extraction_results_1756997087699.json
tipo mimeStringPDF4me archivo MIME tipo - MIME tipo del archivo de salida, siempre "application/json" para JSON formato de datos de tablaapplication/json
Tamaño del archivoNúmeroPDF4me Tamaño del archivo en bytes - Tamaño del generado JSON archivo en bytes, proporcionado para la planificación del almacenamiento y la monitorización de la transferencia.563
éxitoBooleanPDF4me indicador de estado de extracción - Indicador booleano que señala el éxito o el fracaso del proceso de extracción de la tabla. PDF4me devoluciones true para extracciones exitosas y false por cualquier errortrue
mensajeStringPDF4me mensaje de estado de extracción - Mensaje de estado legible para humanos que proporciona detalles sobre el resultado del proceso de extracción de la tabla. Incluye confirmación de éxito o detalles de error para la resolución de problemas.Table extraction completed successfully
Nombre del documentoStringPDF4me Referencia del documento fuente - Nombre de archivo original del PDF documento que fue procesado para la extracción de tablasdocument.pdf

N8N Respuesta a la acción

El PDF4me Extraer tabla de PDF API Devuelve una respuesta que se puede visualizar en varios formatos. Elija la vista que mejor se adapte a sus necesidades:

JSON Formato de respuesta

El crudo JSON respuesta de la API:

[
{
"fileName": "table_extraction_results_1756997087699.json",
"mimeType": "application/json",
"fileSize": 563,
"success": true,
"message": "Table extraction completed successfully",
"docName": "document.pdf"
}
]

Casos de uso

Procesamiento y análisis de datos

  • Importación automatizada de datos: Descargue y procese el archivo generado JSON archivo para importar automáticamente datos tabulares a bases de datos, hojas de cálculo o aplicaciones empresariales
  • Transformación de datos: Procesar el JSON Contenido del archivo para transformar los datos de la tabla en diferentes formatos para diversos sistemas empresariales.
  • Análisis estadístico: Analizar los datos tabulares extraídos de la JSON archivo para generar información, tendencias e informes estadísticos

Inteligencia empresarial e informes

  • Automatización de informes: Extrae automáticamente datos de informes financieros, facturas y documentos comerciales, y luego procesa los JSON archivo para informes automatizados
  • Integración del panel de control: Analizar el JSON Archivo y alimentación de datos de tablas extraídos a paneles de inteligencia empresarial y plataformas de análisis.
  • Validación de datos: Validar y verificar los datos tabulares extraídos de la JSON archivar contra los registros comerciales existentes

Procesamiento y gestión de documentos

  • Procesamiento de facturas: Extraer tablas de precios, partidas individuales y datos financieros de las facturas, luego procesar los datos generados. JSON archivo para procesamiento automatizado
  • Análisis de contratos: Extraiga términos, condiciones y datos estructurados de contratos y documentos legales utilizando el archivo descargable JSON archivo
  • Gestión de inventario: Procesar catálogos de productos, listas de inventario y datos de la cadena de suministro desde PDF documentos a través del JSON archivo de salida

Integración empresarial

  • Integración de sistemas: Descarga e integra el JSON archivo con sistemas empresariales existentes, incluyendo ERP, CRMy almacenes de datos
  • Automatización del flujo de trabajo: Activar flujos de trabajo automatizados basados en JSON procesamiento de archivos y datos tabulares extraídos
  • Sincronización de datos: Procesar el JSON Archivar y sincronizar los datos extraídos en múltiples sistemas y plataformas para una gestión de la información coherente.

Obtén ayuda