Extrair tabela de PDF usando n8n Ação
PDF4me Extrair tabela de PDF Identifica e extrai dados estruturados de tabelas a partir de PDF documentos através de n8n Fluxos de trabalho de automação. Processo PDFs de distância n8n gatilhos, dados binários, strings base64 ou públicos URLs para detectar tabelas automaticamente, preservar a estrutura das células, manter os relacionamentos entre os dados, extrair cabeçalhos e valores e gerar dados estruturados em JSON ou em formato Excel. Essa solução é ideal para análise de relatórios financeiros, digitalização de dados, extração de dados estatísticos, processamento de faturas, análise de formulários e fluxos de trabalho automatizados de extração de tabelas que exigem reconhecimento preciso de tabelas com saída estruturada e integração perfeita.
Configurar
Adicione o PDF4me "Extrair tabela de PDF"nó para o seu n8n fluxo de trabalho e configure os parâmetros necessários. Para obter instruções de configuração inicial, consulte nosso n8n Guia de integração.
Pré-requisitos:
- PDF4me API credenciais
- n8n acesso ao fluxo de trabalho
Configuração:
- Adicionar PDF4me nó para fluxo de trabalho
- Selecione "Extrair tabela de" PDF" Ação
- Configure os parâmetros de entrada (veja abaixo)

Parâmetros
Lista completa de parâmetros para a função Extrair Tabela de PDF Ação. Configure esses parâmetros para controlar a extração da tabela.
Importante: Os parâmetros marcados com um asterisco (***) são obrigatórios e devem ser fornecidos para que a ação funcione corretamente.
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| Tipo de dados de entrada*** | String | PDF Seleção do formato de entrada • Escolha o formato do seu PDF entrada de dados • PDF4me Suporta vários tipos de entrada • Opções: Dados binários, Base64 Corda, ou URL | Binary Data |
| Campo binário de entrada | Binário | Binário PDF Entrada de arquivo (Obrigatório se os dados forem binários) • Referência PDF arquivo do anterior n8n upload de nó ou arquivo • PDF4me processos binários PDF arquivos com detecção automática de formato • Obrigatório quando o tipo de dados de entrada for "Dados binários" | {{ $binary.data }} |
| Conteúdo do documento Base64 | String | Base64 Codificado PDF Entrada (Obrigatório se) Base64 Corda) • Fornecer PDF dados como string codificada em base64 • PDF4me decodifica e processa automaticamente o PDF contente • Obrigatório quando o tipo de dados de entrada for "Base64 Corda" | UEsDBBQABgAI... |
| URL do arquivo | String | Público PDF URL Entrada (Obrigatório se) URL) • Fornecer uma permissão pública/aberta URL para o PDF arquivo • PDF4me baixa e processa o arquivo de URL • Obrigatório quando o tipo de dados de entrada for "URL" | https://abc.com/report.pdf |
| Nome do documento*** | String | Fonte PDF Referência • Especifique o nome da fonte PDF arquivo • Para fins de referência e rastreamento na extração de tabelas • Auxilia no processamento do rastreamento | financial_report.pdf |
Opções avançadas
Os seguintes parâmetros estão disponíveis na seção Opções Avançadas e são opcionais:
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| Perfis personalizados | String | Perfis de configuração personalizados • Defina opções adicionais usando perfis personalizados • JSONformato semelhante a - contendo parâmetros predefinidos • Ativa configurações avançadas de processamento de tabelas • Opcional para requisitos específicos | { "OutputDataFormat": "json" } |
Tipos de tabelas suportados
| Tipo de tabela | Descrição | Casos de uso comuns |
|---|---|---|
| Tabelas Financeiras | Demonstrações financeiras, orçamentos e dados contábeis | Relatórios financeiros, faturas, balanços patrimoniais |
| Tabelas de dados | Dados estatísticos, métricas e informações analíticas | Relatórios de pesquisa, análises, dados de desempenho |
| Listar tabelas | Catálogos de produtos, diretórios e listas de inventário | Listagens de produtos, diretórios de funcionários, catálogos |
| Tabelas de comparação | Comparação de recursos, tabelas de preços e especificações. | Comparação de produtos, tabelas de preços, especificações |
| Tabelas de horários | Horários, calendários e documentos de planejamento | Cronograma de reuniões, cronogramas de projetos, calendários |
| Tabelas de resumo | Resumos executivos, principais métricas e dados gerais | Dados do painel de controle, resumos de KPIs, relatórios executivos |
Recursos de processamento de tabelas
| Recurso | Descrição | Caso de uso |
|---|---|---|
| Detecção de tabela | Identificação automática dos limites e estruturas das tabelas. | Processamento de documentos com múltiplas tabelas |
| Extração de células | Extração precisa dos valores e do conteúdo de células individuais. | Análise e processamento de dados |
| Reconhecimento de cabeçalho | Identificação dos cabeçalhos das tabelas e dos rótulos das colunas. | Organização de dados estruturados |
| Processamento de linhas | Extração de linhas completas da tabela com formatação adequada. | Integração e armazenamento de banco de dados |
| Alinhamento de colunas | Preservação da estrutura e alinhamento das colunas | Manutenção de relações de dados |
| Tabelas com várias páginas | Processamento de tabelas que se estendem por várias páginas. | Análise complexa de documentos |
Saída
Parâmetros de saída
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| nome_do_arquivo | String | PDF4me nome do arquivo de saída - Nome do arquivo gerado JSON Arquivo contendo os dados da tabela extraídos. O arquivo contém todas as informações estruturadas da tabela em JSON formato | table_extraction_results_1756997087699.json |
| tipo mime | String | PDF4me arquivo MIME tipo - MIME tipo do arquivo de saída, sempre "application/json" para JSON formatar dados de tabela | application/json |
| tamanho do arquivo | Número | PDF4me tamanho do arquivo em bytes - Tamanho do gerado JSON Arquivo em bytes, fornecido para planejamento de armazenamento e monitoramento de transferência. | 563 |
| sucesso | Boolean | PDF4me indicador de status de extração - Indicador booleano que sinaliza o sucesso ou a falha do processo de extração da tabela. PDF4me retornos true para extrações bem-sucedidas e false para quaisquer erros | true |
| mensagem | String | PDF4me mensagem de status da extração - Mensagem de status legível por humanos, fornecendo detalhes sobre o resultado do processo de extração da tabela. Inclui confirmação de sucesso ou detalhes de erro para solução de problemas. | Table extraction completed successfully |
| nomeDoDocumento | String | PDF4me referência do documento de origem - Nome original do arquivo PDF documento que foi processado para extração de tabela | document.pdf |
N8N Resposta à ação
O PDF4me Extrair tabela de PDF API Retorna uma resposta que pode ser visualizada em vários formatos. Escolha a visualização que melhor se adapta às suas necessidades:
- JSON
- Table
- Schema
- Binary
JSON Formato de resposta
O bruto JSON resposta do API:
[
{
"fileName": "table_extraction_results_1756997087699.json",
"mimeType": "application/json",
"fileSize": 563,
"success": true,
"message": "Table extraction completed successfully",
"docName": "document.pdf"
}
]
Visualização em tabela
Dados de resposta em formato de tabela estruturada:
| Parâmetro | Valor |
|---|---|
| fileName | table_extraction_results_1756997087699.json |
| mimeType | application/json |
| fileSize | 563 |
| success | true |
| message | Table extraction completed successfully |
| docName | document.pdf |
Visão do esquema
A estrutura de dados e os tipos de resposta:
1 item
fileName: AB table_extraction_results_1756997087699.json
mimeType: AB application/json
fileSize: # 563
success: ☑ true
message: AB Table extraction completed successfully
docName: AB document.pdf
Indicadores de tipo:
AB= String#= Número☑= Boolean{}= Object[]= Array
Visualização de Dados Binários
O verdadeiro JSON Dados e metadados do arquivo:
data
─────────────────────────────
File Name: table_extraction_results_1756997087699.json
File Extension: json
Mime Type: application/json
File Size: 0.55 KB
JSON Exemplo de conteúdo de arquivo:
{
"tableData": [
{
"headers": ["Product", "Price", "Quantity", "Total"],
"rows": [
["Laptop", "$999", "2", "$1998"],
["Mouse", "$25", "5", "$125"],
["Keyboard", "$75", "3", "$225"]
],
"columnCount": 4,
"rowCount": 3
}
]
}
Casos de uso
Processamento e análise de dados
- Importação automatizada de dadosBaixe e processe o arquivo gerado. JSON Arquivo para importar automaticamente dados tabulares para bancos de dados, planilhas ou aplicativos comerciais.
- Transformação de dadosProcessar o JSON O conteúdo do arquivo é usado para transformar dados de tabelas em diferentes formatos para diversos sistemas empresariais.
- Análise EstatísticaAnalisar os dados tabulares extraídos do JSON Arquivo para gerar insights, tendências e relatórios estatísticos.
Inteligência de Negócios e Relatórios
- Automação de relatóriosExtrai automaticamente dados de relatórios financeiros, faturas e documentos comerciais e, em seguida, processa-os. JSON arquivo para relatórios automatizados
- Integração do painel de controleAnalise o JSON Arquivar e inserir dados extraídos de tabelas em painéis de Business Intelligence e plataformas de análise.
- Validação de dadosValidar e verificar os dados tabulares extraídos do JSON arquivar em relação aos registros comerciais existentes
Processamento e gerenciamento de documentos
- Processamento de faturasExtrair tabelas de preços, itens de linha e dados financeiros de faturas e, em seguida, processar os dados gerados. JSON arquivo para processamento automatizado
- Análise de ContratoExtraia termos, condições e dados estruturados de contratos e documentos jurídicos usando o arquivo para download. JSON arquivo
- Gestão de estoqueProcessar catálogos de produtos, listas de estoque e dados da cadeia de suprimentos de PDF documentos via o JSON arquivo de saída
Integração Empresarial
- Integração de SistemasBaixe e integre o JSON arquivo com sistemas empresariais existentes, incluindo ERP, CRMe armazéns de dados
- Automação de fluxo de trabalhoAcione fluxos de trabalho automatizados com base em JSON processamento de arquivos e dados tabulares extraídos
- Sincronização de dadosProcessar o JSON Arquivar e sincronizar dados extraídos em vários sistemas e plataformas para uma gestão consistente da informação.