Extrair recursos de PDF usando n8n Ação
PDF4me Extrair recursos Extrai conteúdo de texto e imagens incorporadas de PDF documentos através de n8n Fluxos de trabalho de automação. Processo PDFs de distância n8n gatilhos, dados binários, strings base64 ou públicos URLPermite extrair automaticamente texto, imagens, gráficos e elementos visuais com segmentação específica da página, opções de extração seletiva (somente texto, somente imagens ou ambos) e formatação de saída estruturada. Essa solução é ideal para reutilização de conteúdo, extração de imagens, análise de texto, digitalização de documentos, migração de conteúdo e fluxos de trabalho de recuperação de recursos que exigem extração de conteúdo precisa com segmentação flexível e integração perfeita.
Configurar
Adicione o PDF4me nó "Extrair Recursos" para o seu n8n fluxo de trabalho e configure os parâmetros necessários. Para obter instruções de configuração inicial, consulte nosso n8n Guia de integração.
Pré-requisitos:
- PDF4me API credenciais
- n8n acesso ao fluxo de trabalho
Configuração:
- Adicionar PDF4me nó para fluxo de trabalho
- Selecione a ação "Extrair Recursos".
- Configure os parâmetros de entrada (veja abaixo)

Parâmetros
Lista completa de parâmetros para a ação Extrair Recursos. Configure esses parâmetros para controlar a extração de recursos.
Importante: Os parâmetros marcados com um asterisco (***) são obrigatórios e devem ser fornecidos para que a ação funcione corretamente.
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| Tipo de dados de entrada*** | String | PDF Seleção do formato de entrada • Escolha o formato do seu PDF entrada de dados • PDF4me Suporta vários tipos de entrada • Opções: Dados binários, Base64 Corda, ou URL | Binary Data |
| Campo binário de entrada | Binário | Binário PDF Entrada de arquivo (Obrigatório se os dados forem binários) • Referência PDF arquivo do anterior n8n upload de nó ou arquivo • PDF4me processos binários PDF arquivos com detecção automática de formato • Obrigatório quando o tipo de dados de entrada for "Dados Binários" | {{ $binary.data }} |
| Conteúdo do PDF em Base64 | String | Base64 Codificado PDF Entrada (Obrigatório se) Base64 Corda) • Fornecer PDF conteúdo como string codificada em base64 • PDF4me decodifica e processa automaticamente o PDF contente • Obrigatório quando o tipo de dados de entrada for "Base64 Corda" | JVBERi0x... |
| URL do PDF | String | Público PDF URL Entrada (Obrigatório se) URL) • Fornecer uma permissão pública/aberta URL para o PDF arquivo • PDF4me baixa e processa o arquivo de URL • Obrigatório quando o tipo de dados de entrada for "URL" | https://abc.com/xyz.pdf |
| Nome do documento*** | String | Nome do arquivo de entrada • Especifique o nome da entrada PDF arquivo • Utilizado para detecção de formato e otimização de processamento • Deve incluir a extensão .pdf | document.pdf |
| Texto extraído | Boolean | Alternar extração de texto • Ativar ou desativar a extração de conteúdo de texto • Quando ativado, extrai todo o conteúdo de texto legível. • Preserva as informações de formatação | true |
| Extrair imagens | Boolean | Alternar Extração de Imagem • Ativar ou desativar a extração de imagens • Quando ativada, extrai todas as imagens e gráficos incorporados. • Elementos visuais salvos como arquivos separados | true |
Opções avançadas
Os seguintes parâmetros estão disponíveis na seção Opções Avançadas e são opcionais:
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| Páginas | String | Especificação de intervalo de páginas • Defina quais páginas processar para extração de recursos. • Use "todos" para o documento inteiro, números específicos ou intervalos. • Exemplos: "1,3,5" (páginas específicas), "1-5,10-15" (intervalos) | all |
| Perfis personalizados | String | Perfis de configuração personalizados • Defina opções adicionais usando perfis personalizados • JSONformato semelhante a - contendo parâmetros predefinidos • Permite configurações avançadas de processamento de extração. • Opcional para requisitos específicos | { "outputDataFormat": "json" } |
Saída
Parâmetros de saída
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| nome_do_arquivo | String | PDF4me nome do arquivo gerado - O nome completo do arquivo do documento processado com sucesso, incluindo a extensão e o carimbo de data/hora corretos. PDF4me Garante nomes exclusivos e valida a conformidade do formato do arquivo para uma integração perfeita com os processos subsequentes. | extracted_resources_1756999816629.json |
| tipo mime | String | PDF4me MIME identificador de tipo - O padronizado MIME tipo para o arquivo de conteúdo extraído, normalmente application/json para dados estruturados ou application/zip para vários arquivos. Isso garante o manuseio e reconhecimento adequados dos arquivos em todos os sistemas e aplicativos. | application/json |
| tamanho do arquivo | Número | PDF4me tamanho do arquivo em bytes - O tamanho exato do arquivo de conteúdo extraído em bytes, fornecido para planejamento de armazenamento, otimização de largura de banda e monitoramento de transferência de arquivos. Essencial para gerenciamento de documentos corporativos e automação de fluxo de trabalho. | 1945 |
| sucesso | Boolean | PDF4me indicador de status de extração - Indicador booleano que sinaliza o sucesso ou a falha do processo de extração de recursos. Retorna true para extrações bem-sucedidas e false para quaisquer erros, permitindo um tratamento robusto de erros em fluxos de trabalho automatizados. | true |
| mensagem | String | PDF4me mensagem de status da extração - Mensagem descritiva indicando o resultado do processo de extração de recursos. Fornece mensagens de status claras para extrações bem-sucedidas e informações detalhadas sobre erros para fins de solução de problemas. | Resource extraction completed successfully |
| nomeDoDocumento | String | PDF4me referência ao nome do documento original - O nome original do arquivo de entrada PDF Arquivo que foi processado. Essa referência é mantida para fins de auditoria, depuração e rastreamento da origem do conteúdo extraído em fluxos de trabalho corporativos. | document.pdf |
N8N Resposta à ação
O PDF4me Extrair recursos API Retorna uma resposta que pode ser visualizada em vários formatos. Escolha a visualização que melhor se adapta às suas necessidades:
- JSON
- Table
- Schema
- Binary
JSON Formato de resposta
O bruto JSON resposta do API:
{
"fileName": "extracted_resources_1756999816629.json",
"mimeType": "application/json",
"fileSize": 1945,
"success": true,
"message": "Resource extraction completed successfully",
"docName": "document.pdf"
}
Visualização em tabela
Dados de resposta em formato de tabela estruturada:
| Parâmetro | Valor |
|---|---|
| fileName | extracted_resources_1756999816629.json |
| mimeType | application/json |
| fileSize | 1945 |
| success | true |
| docName | document.pdf |
| message | Resource extraction completed successfully |
Visão do esquema
A estrutura de dados e os tipos de resposta:
fileName: AB extracted_resources_1756999816629.json
mimeType: AB application/json
fileSize: # 1945
success: ✓ true
docName: AB document.pdf
message: AB Resource extraction completed successfully
Indicadores de tipo:
AB= String#= Número✓= Boolean
Visualização de Dados Binários
Os dados de conteúdo extraídos e os metadados propriamente ditos:
data
─────────────────────────────────────────
File Name: extracted_resources_1756999816629.json
File Extension: json
Mime Type: application/json
File Size: 1.9 KB
Casos de uso
Sistemas de gerenciamento de conteúdoExtrair texto e imagens de PDF Documentos para repositórios de conteúdo centralizados, permitindo bancos de dados pesquisáveis de conteúdo de documentos.
Pipelines de Processamento de DadosExtrair automaticamente dados estruturados de PDF Relatórios, faturas e formulários para integração com ferramentas de inteligência de negócios e plataformas de análise.
Análise de DocumentosProcessar grandes volumes de PDF Documentos para extrair informações específicas para monitoramento de conformidade, pesquisa e geração de relatórios automatizados.
Digitalização de ArquivosConverter legado PDF Transformar arquivos em dados estruturados e pesquisáveis para sistemas modernos de gerenciamento de conteúdo e descoberta de conhecimento.