Pular para o conteúdo principal

Extrair anexo de PDF usando n8n Ação

PDF4me Extrair anexo de PDF Extrai arquivos incorporados de PDF documentos através de n8n Fluxos de trabalho de automação. Processo PDFs de distância n8n gatilhos, dados binários, strings base64 ou públicos URLs para detectar e extrair automaticamente documentos anexados, imagens, planilhas, arquivos de dados e outros conteúdos incorporados, preservando a integridade dos arquivos, retendo metadados e oferecendo suporte a múltiplos formatos (PDF, DOC, XLS, imagens, etc.). Esta solução é ideal para análise de documentos, recuperação de arquivos, extração de evidências, gerenciamento de anexos, fluxos de trabalho de extração de dados e processamento abrangente de documentos que exigem extração confiável de arquivos incorporados com integração perfeita.

Artigos relacionados no blogue
Ainda não há nenhuma publicação no blogue sobre esta funcionalidade — em breve.
Entretanto, explore o blogue da PDF4me para encontrar tutoriais e fluxos de trabalho para todas as plataformas.
Visite o blogue

Configurar

Adicione o PDF4me "Extrair anexo de PDF"nó para o seu n8n fluxo de trabalho e configure os parâmetros necessários. Para obter instruções de configuração inicial, consulte nosso n8n Guia de integração.

Pré-requisitos:

  • PDF4me API credenciais
  • n8n acesso ao fluxo de trabalho

Configuração:

  1. Adicionar PDF4me nó para fluxo de trabalho
  2. Selecione "Extrair anexo de" PDF" Ação
  3. Configure os parâmetros de entrada (veja abaixo)
Extrair anexo de um PDF

Parâmetros

Lista completa de parâmetros para a função Extrair Anexo de PDF Ação. Configure esses parâmetros para controlar a extração de anexos.

Importante: Os parâmetros marcados com um asterisco (***) são obrigatórios e devem ser fornecidos para que a ação funcione corretamente.

ParâmetroTipoDescriçãoExemplo
Tipo de dados de entrada***StringPDF Seleção do formato de entrada
• Escolha o formato do seu PDF entrada de dados
PDF4me Suporta vários tipos de entrada
• Opções: Dados binários, Base64 Corda, ou URL
Binary Data
Campo binário de entradaBinárioBinário PDF Entrada de arquivo (Obrigatório se os dados forem binários)
• Referência PDF arquivo do anterior n8n upload de nó ou arquivo
PDF4me processos binários PDF arquivos com detecção automática de formato
• Obrigatório quando o tipo de dados de entrada for "Dados binários"
{{ $binary.data }}
Conteúdo do documento Base64StringBase64 Codificado PDF Entrada (Obrigatório se) Base64 Corda)
• Fornecer PDF dados como string codificada em base64
PDF4me decodifica e processa automaticamente o PDF contente
• Obrigatório quando o tipo de dados de entrada for "Base64 Corda"
UEsDBBQABgAI...
URL do arquivoStringPúblico PDF URL Entrada (Obrigatório se) URL)
• Fornecer uma permissão pública/aberta URL para o PDF arquivo
PDF4me baixa e processa o arquivo de URL
• Obrigatório quando o tipo de dados de entrada for "URL"
https://abc.com/sample.pdf
Nome do documento***StringFonte PDF Referência
• Especifique o nome da fonte PDF arquivo
• Para fins de referência e rastreamento na extração
• Auxilia no processamento do rastreamento
document.pdf

Opções avançadas

Os seguintes parâmetros estão disponíveis na seção Opções Avançadas e são opcionais:

ParâmetroTipoDescriçãoExemplo
Perfis personalizadosObjectConfiguração de Extração
• Objeto de configuração avançado para personalizar o comportamento de extração
• Suporta formatos de saída e opções de processamento
JSON Formato para especificação flexível de parâmetros
• Opcional para requisitos específicos
{"outputDataFormat": "json", "extractMetadata": true}

Tipos de acessórios suportados

CategoriaTipos de arquivoDescrição
DocumentosPDF, DOC, DOCX, TXT, RTF, ODTDocumentos de texto e arquivos de escritório
ImagensJPG, JPEG, PNGGIF, BMP, TIFF, SVGArquivos de imagem e gráficos
PlanilhasXLS, XLSX, CSV, ODSArquivos de dados e planilhas
DadosJSON, XML, HTML, CSSArquivos da Web e de dados

Saída

Parâmetros de saída

ParâmetroTipoDescriçãoExemplo
documentosArrayPDF4me referência do documento de entrada - Referência aos documentos de entrada originais processados para extração. Nulo para este tipo de operação.null
documentos de saídaArrayPDF4me coleção de anexos extraídos - Matriz de objetos anexos extraídos com sucesso, contendo dados de arquivo, metadados e propriedades da fonte. PDF documento[{"fileName": "sample.txt", "barcodeText": null, "docText": null, "image": null}]
traceIdStringPDF4me identificador de rastreamento de processamento - ID de rastreamento exclusivo para acompanhar a solicitação de extração. PDF4mepipeline de processamento para fins de depuração e auditorianull
ID do trabalhoStringPDF4me identificador de trabalho - Identificador de tarefa exclusivo para a operação de extração. Nulo para operações síncronas, preenchido para processamento assíncrono.null
URL do statusStringPDF4me rastreamento de status URL - URL Para verificar o status de operações de extração assíncronas. Nulo para operações síncronas.null
Uso da assinaturaObjectPDF4me dados de utilização da assinatura - Informações sobre API utilização e consumo de assinatura para a operação de extraçãonull
_metadadosObjectPDF4me metadados da operação - Objeto de metadados abrangente contendo informações de processamento, registros de data e hora e detalhes da operação.{"success": true, "message": "Attachments extracted successfully"}
_metadata.successBooleanPDF4me indicador de status de extração - Boolean Sinalizador indicando o sucesso ou a falha do processo de extração do anexo. PDF4me retornos true para extrações bem-sucedidas e false para quaisquer errostrue
_metadata.messageStringPDF4me mensagem de status da extração - Mensagem de status legível por humanos, fornecendo detalhes sobre o resultado do processo de extração. Inclui confirmação de sucesso ou detalhes de erro para solução de problemas.Attachments extracted successfully
_metadata.processingTimestampStringPDF4me carimbo de data/hora de processamento - Carimbo de data/hora ISO 8601 indicando quando a operação de extração foi concluída por PDF4memotor de extração de2025-09-23T20:04:09.290Z
_metadata.sourceFileNameStringPDF4me nome do arquivo do documento de origem - Nome original do arquivo PDF documento que foi processado para extração de anexosdocument.pdf
_metadata.operaçãoStringPDF4me tipo de operação - Tipo de operação realizada por PDF4me's API, sempre "extraia o anexo do PDF" para esta açãoextractAttachmentFromPdf

Estrutura do objeto de anexo extraído

CampoTipoDescriçãoExemplo
nome_do_arquivoStringPDF4me nome do arquivo extraído - Nome original do arquivo anexo extraído, conforme aparece na fonte PDF documentosample.txt
texto do código de barrasStringPDF4me conteúdo do código de barras - Conteúdo de texto extraído de quaisquer códigos de barras encontrados no anexo. Nulo se nenhum código de barras estiver presente.null
texto do documentoStringPDF4me conteúdo do texto do documento - Conteúdo de texto extraído do arquivo anexo. Nulo se o anexo não for um documento de texto.null
imagemStringPDF4me dados de imagem - Base64 Dados de imagem codificados se o anexo for um arquivo de imagem. Nulo para anexos que não sejam imagens.null

N8N Resposta à ação

O PDF4me Extrair anexo de PDF API Retorna uma resposta que pode ser visualizada em vários formatos. Escolha a visualização que melhor se adapta às suas necessidades:

JSON Formato de resposta

O bruto JSON resposta do API:

[
{
"documents": null,
"outputDocuments": [
{
"fileName": "sample.txt",
"barcodeText": null,
"docText": null,
"image": null
}
],
"traceId": null,
"jobId": null,
"statusUrl": null,
"subscriptionUsage": null,
"_metadata": {
"success": true,
"message": "Attachments extracted successfully",
"processingTimestamp": "2025-09-23T20:04:09.290Z",
"sourceFileName": "document.pdf",
"operation": "extractAttachmentFromPdf"
}
}
]

Casos de uso

Recuperação de conteúdo de documentos

  • Restauração de Arquivos Incorporados: Use o outputDocuments matriz para recuperar arquivos que estavam incorporados em PDF documentos, restabelecendo o acesso aos materiais de origem originais
  • Recuperação de nome de arquivoExtrair os nomes de arquivo originais do fileName campo para manter a identificação e organização adequadas dos arquivos
  • Recuperação de Documentos PerdidosRestaurar documentos que estavam previamente incorporados em PDFmas já não estão disponíveis nos seus formatos originais.

Processamento e análise de conteúdo

  • Análise de ApegoProcessar arquivos individuais do outputDocuments coleção para analisar conteúdo, extrair dados ou realizar operações específicas em cada tipo de arquivo
  • Processamento de código de barrasUtilize o barcodeText Campo para extrair e processar informações de código de barras de anexos para fins de inventário, rastreamento ou identificação.
  • Extração de conteúdo de textoAproveite o docText Campo para extrair conteúdo textual de anexos de documentos para fluxos de trabalho de pesquisa, análise ou processamento de dados.

Automação e integração de fluxos de trabalho

  • Distribuição de ArquivosDistribuir automaticamente os anexos extraídos para os sistemas, pastas ou usuários apropriados, com base no tipo de arquivo e na análise de conteúdo.
  • Arquivamento de conteúdo: Use o _metadata.traceId e resultados de extração para manter trilhas de auditoria, organizando os arquivos extraídos em sistemas de arquivamento estruturados.
  • Integração de múltiplos sistemasIntegre os arquivos extraídos com sistemas externos de gerenciamento de documentos, plataformas de armazenamento em nuvem ou aplicativos empresariais.

Obtenha ajuda