Pular para o conteúdo principal

Extrair recursos de PDF usando n8n Ação

PDF4me Extrair recursos Extrai conteúdo de texto e imagens incorporadas de PDF documentos através de n8n Fluxos de trabalho de automação. Processo PDFs de distância n8n gatilhos, dados binários, strings base64 ou públicos URLPermite extrair automaticamente texto, imagens, gráficos e elementos visuais com segmentação específica da página, opções de extração seletiva (somente texto, somente imagens ou ambos) e formatação de saída estruturada. Essa solução é ideal para reutilização de conteúdo, extração de imagens, análise de texto, digitalização de documentos, migração de conteúdo e fluxos de trabalho de recuperação de recursos que exigem extração de conteúdo precisa com segmentação flexível e integração perfeita.

Artigos relacionados no blogue
Ainda não há nenhuma publicação no blogue sobre esta funcionalidade — em breve.
Entretanto, explore o blogue da PDF4me para encontrar tutoriais e fluxos de trabalho para todas as plataformas.
Visite o blogue

Configurar

Adicione o PDF4me nó "Extrair Recursos" para o seu n8n fluxo de trabalho e configure os parâmetros necessários. Para obter instruções de configuração inicial, consulte nosso n8n Guia de integração.

Pré-requisitos:

  • PDF4me API credenciais
  • n8n acesso ao fluxo de trabalho

Configuração:

  1. Adicionar PDF4me nó para fluxo de trabalho
  2. Selecione a ação "Extrair Recursos".
  3. Configure os parâmetros de entrada (veja abaixo)
Configuração de Extração de Recursos

Parâmetros

Lista completa de parâmetros para a ação Extrair Recursos. Configure esses parâmetros para controlar a extração de recursos.

Importante: Os parâmetros marcados com um asterisco (***) são obrigatórios e devem ser fornecidos para que a ação funcione corretamente.

ParâmetroTipoDescriçãoExemplo
Tipo de dados de entrada***StringPDF Seleção do formato de entrada
• Escolha o formato do seu PDF entrada de dados
PDF4me Suporta vários tipos de entrada
• Opções: Dados binários, Base64 Corda, ou URL
Binary Data
Campo binário de entradaBinárioBinário PDF Entrada de arquivo (Obrigatório se os dados forem binários)
• Referência PDF arquivo do anterior n8n upload de nó ou arquivo
PDF4me processos binários PDF arquivos com detecção automática de formato
• Obrigatório quando o tipo de dados de entrada for "Dados Binários"
{{ $binary.data }}
Conteúdo do PDF em Base64StringBase64 Codificado PDF Entrada (Obrigatório se) Base64 Corda)
• Fornecer PDF conteúdo como string codificada em base64
PDF4me decodifica e processa automaticamente o PDF contente
• Obrigatório quando o tipo de dados de entrada for "Base64 Corda"
JVBERi0x...
URL do PDFStringPúblico PDF URL Entrada (Obrigatório se) URL)
• Fornecer uma permissão pública/aberta URL para o PDF arquivo
PDF4me baixa e processa o arquivo de URL
• Obrigatório quando o tipo de dados de entrada for "URL"
https://abc.com/xyz.pdf
Nome do documento***StringNome do arquivo de entrada
• Especifique o nome da entrada PDF arquivo
• Utilizado para detecção de formato e otimização de processamento
• Deve incluir a extensão .pdf
document.pdf
Texto extraídoBooleanAlternar extração de texto
• Ativar ou desativar a extração de conteúdo de texto
• Quando ativado, extrai todo o conteúdo de texto legível.
• Preserva as informações de formatação
true
Extrair imagensBooleanAlternar Extração de Imagem
• Ativar ou desativar a extração de imagens
• Quando ativada, extrai todas as imagens e gráficos incorporados.
• Elementos visuais salvos como arquivos separados
true

Opções avançadas

Os seguintes parâmetros estão disponíveis na seção Opções Avançadas e são opcionais:

ParâmetroTipoDescriçãoExemplo
PáginasStringEspecificação de intervalo de páginas
• Defina quais páginas processar para extração de recursos.
• Use "todos" para o documento inteiro, números específicos ou intervalos.
• Exemplos: "1,3,5" (páginas específicas), "1-5,10-15" (intervalos)
all
Perfis personalizadosStringPerfis de configuração personalizados
• Defina opções adicionais usando perfis personalizados
JSONformato semelhante a - contendo parâmetros predefinidos
• Permite configurações avançadas de processamento de extração.
• Opcional para requisitos específicos
{ "outputDataFormat": "json" }

Saída

Parâmetros de saída

ParâmetroTipoDescriçãoExemplo
nome_do_arquivoStringPDF4me nome do arquivo gerado - O nome completo do arquivo do documento processado com sucesso, incluindo a extensão e o carimbo de data/hora corretos. PDF4me Garante nomes exclusivos e valida a conformidade do formato do arquivo para uma integração perfeita com os processos subsequentes.extracted_resources_1756999816629.json
tipo mimeStringPDF4me MIME identificador de tipo - O padronizado MIME tipo para o arquivo de conteúdo extraído, normalmente application/json para dados estruturados ou application/zip para vários arquivos. Isso garante o manuseio e reconhecimento adequados dos arquivos em todos os sistemas e aplicativos.application/json
tamanho do arquivoNúmeroPDF4me tamanho do arquivo em bytes - O tamanho exato do arquivo de conteúdo extraído em bytes, fornecido para planejamento de armazenamento, otimização de largura de banda e monitoramento de transferência de arquivos. Essencial para gerenciamento de documentos corporativos e automação de fluxo de trabalho.1945
sucessoBooleanPDF4me indicador de status de extração - Indicador booleano que sinaliza o sucesso ou a falha do processo de extração de recursos. Retorna true para extrações bem-sucedidas e false para quaisquer erros, permitindo um tratamento robusto de erros em fluxos de trabalho automatizados.true
mensagemStringPDF4me mensagem de status da extração - Mensagem descritiva indicando o resultado do processo de extração de recursos. Fornece mensagens de status claras para extrações bem-sucedidas e informações detalhadas sobre erros para fins de solução de problemas.Resource extraction completed successfully
nomeDoDocumentoStringPDF4me referência ao nome do documento original - O nome original do arquivo de entrada PDF Arquivo que foi processado. Essa referência é mantida para fins de auditoria, depuração e rastreamento da origem do conteúdo extraído em fluxos de trabalho corporativos.document.pdf

N8N Resposta à ação

O PDF4me Extrair recursos API Retorna uma resposta que pode ser visualizada em vários formatos. Escolha a visualização que melhor se adapta às suas necessidades:

JSON Formato de resposta

O bruto JSON resposta do API:

{
"fileName": "extracted_resources_1756999816629.json",
"mimeType": "application/json",
"fileSize": 1945,
"success": true,
"message": "Resource extraction completed successfully",
"docName": "document.pdf"
}

Casos de uso

Sistemas de gerenciamento de conteúdoExtrair texto e imagens de PDF Documentos para repositórios de conteúdo centralizados, permitindo bancos de dados pesquisáveis de conteúdo de documentos.

Pipelines de Processamento de DadosExtrair automaticamente dados estruturados de PDF Relatórios, faturas e formulários para integração com ferramentas de inteligência de negócios e plataformas de análise.

Análise de DocumentosProcessar grandes volumes de PDF Documentos para extrair informações específicas para monitoramento de conformidade, pesquisa e geração de relatórios automatizados.

Digitalização de ArquivosConverter legado PDF Transformar arquivos em dados estruturados e pesquisáveis para sistemas modernos de gerenciamento de conteúdo e descoberta de conhecimento.

Obtenha ajuda