Extraer tabla de PDF usando n8n acción
PDF4me Extraer tabla de PDF identifica y extrae datos de tablas estructuradas de PDF documentos a través de n8n Flujos de trabajo de automatización. Proceso PDFs lejos n8n disparadores, datos binarios, cadenas base64 o público URLs para detectar automáticamente tablas, preservar la estructura de celdas, mantener las relaciones de datos, extraer encabezados y valores, y generar datos estructurados en JSON o en formato Excel. Esta solución es ideal para el análisis de informes financieros, la digitalización de datos, la extracción de datos estadísticos, el procesamiento de facturas, el análisis de formularios y los flujos de trabajo automatizados de extracción de tablas que requieren un reconocimiento preciso de tablas con una salida estructurada y una integración perfecta.
Configuración
Añade el PDF4me "Extraer tabla de PDF" nodo a tu n8n flujo de trabajo y configure los parámetros necesarios. Para obtener instrucciones de configuración inicial, consulte nuestra n8n Guía de integración.
Requisitos previos:
- PDF4me API credenciales
- n8n acceso al flujo de trabajo
Configuración:
- Agregar PDF4me nodo a flujo de trabajo
- Seleccione "Extraer tabla de PDF" acción
- Configure los parámetros de entrada (véase más abajo).

Parámetros
Lista completa de parámetros para la función Extraer tabla de PDF acción. Configure estos parámetros para controlar la extracción de tablas.
Importante: Los parámetros marcados con un asterisco (***) son obligatorios y deben proporcionarse para que la acción funcione correctamente.
| Parámetro | Tipo | Descripción | Ejemplo |
|---|---|---|---|
| Tipo de datos de entrada*** | String | PDF Selección del formato de entrada • Elija el formato de su PDF entrada de datos • PDF4me admite varios tipos de entrada • Opciones: Datos binarios, Base64 Cuerda o URL | Binary Data |
| Campo binario de entrada | Binario | Binario PDF Entrada de archivo (Obligatorio si se trata de datos binarios) • Referencia PDF archivo de anterior n8n carga de nodos o archivos • PDF4me procesos binarios PDF archivos con detección automática de formato • Obligatorio cuando el tipo de datos de entrada es "Datos binarios". | {{ $binary.data }} |
| Contenido del documento Base64 | String | Base64 Codificado PDF Aporte (Obligatorio si Base64 Cadena) • Proporcionar PDF datos como cadena codificada en base64 • PDF4me decodifica y procesa automáticamente el PDF contenido • Obligatorio cuando el tipo de datos de entrada es "Base64 Cadena" | UEsDBBQABgAI... |
| URL del archivo | String | Público PDF URL Aporte (Obligatorio si URL) • Proporcionar un permiso público/abierto URL hacia PDF archivo • PDF4me descarga y procesa el archivo desde URL • Obligatorio cuando el tipo de datos de entrada es "URL" | https://abc.com/report.pdf |
| Nombre del documento*** | String | Fuente PDF Referencia • Especifique el nombre de la fuente PDF archivo • Para fines de referencia y seguimiento en la extracción de tablas. • Ayuda con el seguimiento del procesamiento | financial_report.pdf |
Opciones avanzadas
Los siguientes parámetros están disponibles en la sección Opciones avanzadas y son opcionales:
| Parámetro | Tipo | Descripción | Ejemplo |
|---|---|---|---|
| Perfiles personalizados | String | Perfiles de configuración personalizados • Configure opciones adicionales mediante perfiles personalizados. • JSONformato similar que contiene parámetros predefinidos • Permite configurar ajustes avanzados de procesamiento de tablas. • Opcional para requisitos especializados | { "OutputDataFormat": "json" } |
Tipos de tabla compatibles
| Tipo de tabla | Descripción | Casos de uso comunes |
|---|---|---|
| Tablas financieras | Estados financieros, presupuestos y datos contables | Informes financieros, facturas, balances |
| Tablas de datos | Datos estadísticos, métricas e información analítica | Informes de investigación, análisis, datos de rendimiento |
| Listar tablas | Catálogos de productos, directorios y listas de inventario | Listados de productos, directorios de empleados, catálogos |
| Tablas comparativas | Comparación de características, tablas de precios y especificaciones. | Comparación de productos, matrices de precios, especificaciones |
| Tablas de horarios | Horarios, calendarios y documentos de planificación | Horarios de reuniones, cronogramas de proyectos, calendarios |
| Tablas resumen | Resúmenes ejecutivos, indicadores clave y datos generales | Datos del panel de control, resúmenes de KPI, informes ejecutivos |
Características de procesamiento de tablas
| Característica | Descripción | Caso de uso |
|---|---|---|
| Detección de mesas | Identificación automática de límites y estructuras de tablas. | Procesamiento de documentos con varias tablas |
| Extracción de células | Extracción precisa de valores y contenido de células individuales. | Análisis y procesamiento de datos |
| Reconocimiento de encabezado | Identificación de encabezados de tabla y etiquetas de columna | Organización de datos estructurados |
| Procesamiento de filas | Extracción de filas completas de la tabla con el formato adecuado. | Integración y almacenamiento de bases de datos |
| Alineación de columnas | Preservación de la estructura y alineación de la columna. | Mantener las relaciones de datos |
| Tablas de varias páginas | Procesamiento de tablas que abarcan varias páginas. | Análisis de documentos complejos |
Producción
Parámetros de salida
| Parámetro | Tipo | Descripción | Ejemplo |
|---|---|---|---|
| Nombre del archivo | String | PDF4me nombre del archivo de salida - Nombre del generado JSON archivo que contiene los datos de la tabla extraídos. El archivo contiene toda la información estructurada de la tabla en JSON formato | table_extraction_results_1756997087699.json |
| tipo mime | String | PDF4me archivo MIME tipo - MIME tipo del archivo de salida, siempre "application/json" para JSON formato de datos de tabla | application/json |
| Tamaño del archivo | Número | PDF4me Tamaño del archivo en bytes - Tamaño del generado JSON archivo en bytes, proporcionado para la planificación del almacenamiento y la monitorización de la transferencia. | 563 |
| éxito | Boolean | PDF4me indicador de estado de extracción - Indicador booleano que señala el éxito o el fracaso del proceso de extracción de la tabla. PDF4me devoluciones true para extracciones exitosas y false por cualquier error | true |
| mensaje | String | PDF4me mensaje de estado de extracción - Mensaje de estado legible para humanos que proporciona detalles sobre el resultado del proceso de extracción de la tabla. Incluye confirmación de éxito o detalles de error para la resolución de problemas. | Table extraction completed successfully |
| Nombre del documento | String | PDF4me Referencia del documento fuente - Nombre de archivo original del PDF documento que fue procesado para la extracción de tablas | document.pdf |
N8N Respuesta a la acción
El PDF4me Extraer tabla de PDF API Devuelve una respuesta que se puede visualizar en varios formatos. Elija la vista que mejor se adapte a sus necesidades:
- JSON
- Table
- Schema
- Binary
JSON Formato de respuesta
El crudo JSON respuesta de la API:
[
{
"fileName": "table_extraction_results_1756997087699.json",
"mimeType": "application/json",
"fileSize": 563,
"success": true,
"message": "Table extraction completed successfully",
"docName": "document.pdf"
}
]
Vista de tabla
Datos de respuesta en formato de tabla estructurada:
| Parámetro | Valor |
|---|---|
| fileName | table_extraction_results_1756997087699.json |
| mimeType | application/json |
| fileSize | 563 |
| success | true |
| message | Table extraction completed successfully |
| docName | document.pdf |
Vista de esquema
Estructura de datos y tipos de respuesta:
1 item
fileName: AB table_extraction_results_1756997087699.json
mimeType: AB application/json
fileSize: # 563
success: ☑ true
message: AB Table extraction completed successfully
docName: AB document.pdf
Indicadores de tipo:
AB= String#= Número☑= Boolean{}= Object[]= Array
Vista de datos binarios
El real JSON Datos y metadatos del archivo:
data
─────────────────────────────
File Name: table_extraction_results_1756997087699.json
File Extension: json
Mime Type: application/json
File Size: 0.55 KB
JSON Ejemplo de contenido de archivo:
{
"tableData": [
{
"headers": ["Product", "Price", "Quantity", "Total"],
"rows": [
["Laptop", "$999", "2", "$1998"],
["Mouse", "$25", "5", "$125"],
["Keyboard", "$75", "3", "$225"]
],
"columnCount": 4,
"rowCount": 3
}
]
}
Casos de uso
Procesamiento y análisis de datos
- Importación automatizada de datos: Descargue y procese el archivo generado JSON archivo para importar automáticamente datos tabulares a bases de datos, hojas de cálculo o aplicaciones empresariales
- Transformación de datos: Procesar el JSON Contenido del archivo para transformar los datos de la tabla en diferentes formatos para diversos sistemas empresariales.
- Análisis estadístico: Analizar los datos tabulares extraídos de la JSON archivo para generar información, tendencias e informes estadísticos
Inteligencia empresarial e informes
- Automatización de informes: Extrae automáticamente datos de informes financieros, facturas y documentos comerciales, y luego procesa los JSON archivo para informes automatizados
- Integración del panel de control: Analizar el JSON Archivo y alimentación de datos de tablas extraídos a paneles de inteligencia empresarial y plataformas de análisis.
- Validación de datos: Validar y verificar los datos tabulares extraídos de la JSON archivar contra los registros comerciales existentes
Procesamiento y gestión de documentos
- Procesamiento de facturas: Extraer tablas de precios, partidas individuales y datos financieros de las facturas, luego procesar los datos generados. JSON archivo para procesamiento automatizado
- Análisis de contratos: Extraiga términos, condiciones y datos estructurados de contratos y documentos legales utilizando el archivo descargable JSON archivo
- Gestión de inventario: Procesar catálogos de productos, listas de inventario y datos de la cadena de suministro desde PDF documentos a través del JSON archivo de salida
Integración empresarial
- Integración de sistemas: Descarga e integra el JSON archivo con sistemas empresariales existentes, incluyendo ERP, CRMy almacenes de datos
- Automatización del flujo de trabajo: Activar flujos de trabajo automatizados basados en JSON procesamiento de archivos y datos tabulares extraídos
- Sincronización de datos: Procesar el JSON Archivar y sincronizar los datos extraídos en múltiples sistemas y plataformas para una gestión de la información coherente.