Extrair anexo de PDF usando n8n Ação
PDF4me Extrair anexo de PDF Extrai arquivos incorporados de PDF documentos através de n8n Fluxos de trabalho de automação. Processo PDFs de distância n8n gatilhos, dados binários, strings base64 ou públicos URLs para detectar e extrair automaticamente documentos anexados, imagens, planilhas, arquivos de dados e outros conteúdos incorporados, preservando a integridade dos arquivos, retendo metadados e oferecendo suporte a múltiplos formatos (PDF, DOC, XLS, imagens, etc.). Esta solução é ideal para análise de documentos, recuperação de arquivos, extração de evidências, gerenciamento de anexos, fluxos de trabalho de extração de dados e processamento abrangente de documentos que exigem extração confiável de arquivos incorporados com integração perfeita.
Configurar
Adicione o PDF4me "Extrair anexo de PDF"nó para o seu n8n fluxo de trabalho e configure os parâmetros necessários. Para obter instruções de configuração inicial, consulte nosso n8n Guia de integração.
Pré-requisitos:
- PDF4me API credenciais
- n8n acesso ao fluxo de trabalho
Configuração:
- Adicionar PDF4me nó para fluxo de trabalho
- Selecione "Extrair anexo de" PDF" Ação
- Configure os parâmetros de entrada (veja abaixo)

Parâmetros
Lista completa de parâmetros para a função Extrair Anexo de PDF Ação. Configure esses parâmetros para controlar a extração de anexos.
Importante: Os parâmetros marcados com um asterisco (***) são obrigatórios e devem ser fornecidos para que a ação funcione corretamente.
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| Tipo de dados de entrada*** | String | PDF Seleção do formato de entrada • Escolha o formato do seu PDF entrada de dados • PDF4me Suporta vários tipos de entrada • Opções: Dados binários, Base64 Corda, ou URL | Binary Data |
| Campo binário de entrada | Binário | Binário PDF Entrada de arquivo (Obrigatório se os dados forem binários) • Referência PDF arquivo do anterior n8n upload de nó ou arquivo • PDF4me processos binários PDF arquivos com detecção automática de formato • Obrigatório quando o tipo de dados de entrada for "Dados binários" | {{ $binary.data }} |
| Conteúdo do documento Base64 | String | Base64 Codificado PDF Entrada (Obrigatório se) Base64 Corda) • Fornecer PDF dados como string codificada em base64 • PDF4me decodifica e processa automaticamente o PDF contente • Obrigatório quando o tipo de dados de entrada for "Base64 Corda" | UEsDBBQABgAI... |
| URL do arquivo | String | Público PDF URL Entrada (Obrigatório se) URL) • Fornecer uma permissão pública/aberta URL para o PDF arquivo • PDF4me baixa e processa o arquivo de URL • Obrigatório quando o tipo de dados de entrada for "URL" | https://abc.com/sample.pdf |
| Nome do documento*** | String | Fonte PDF Referência • Especifique o nome da fonte PDF arquivo • Para fins de referência e rastreamento na extração • Auxilia no processamento do rastreamento | document.pdf |
Opções avançadas
Os seguintes parâmetros estão disponíveis na seção Opções Avançadas e são opcionais:
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| Perfis personalizados | Object | Configuração de Extração • Objeto de configuração avançado para personalizar o comportamento de extração • Suporta formatos de saída e opções de processamento • JSON Formato para especificação flexível de parâmetros • Opcional para requisitos específicos | {"outputDataFormat": "json", "extractMetadata": true} |
Tipos de acessórios suportados
| Categoria | Tipos de arquivo | Descrição |
|---|---|---|
| Documentos | PDF, DOC, DOCX, TXT, RTF, ODT | Documentos de texto e arquivos de escritório |
| Imagens | JPG, JPEG, PNGGIF, BMP, TIFF, SVG | Arquivos de imagem e gráficos |
| Planilhas | XLS, XLSX, CSV, ODS | Arquivos de dados e planilhas |
| Dados | JSON, XML, HTML, CSS | Arquivos da Web e de dados |
Saída
Parâmetros de saída
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| documentos | Array | PDF4me referência do documento de entrada - Referência aos documentos de entrada originais processados para extração. Nulo para este tipo de operação. | null |
| documentos de saída | Array | PDF4me coleção de anexos extraídos - Matriz de objetos anexos extraídos com sucesso, contendo dados de arquivo, metadados e propriedades da fonte. PDF documento | [{"fileName": "sample.txt", "barcodeText": null, "docText": null, "image": null}] |
| traceId | String | PDF4me identificador de rastreamento de processamento - ID de rastreamento exclusivo para acompanhar a solicitação de extração. PDF4mepipeline de processamento para fins de depuração e auditoria | null |
| ID do trabalho | String | PDF4me identificador de trabalho - Identificador de tarefa exclusivo para a operação de extração. Nulo para operações síncronas, preenchido para processamento assíncrono. | null |
| URL do status | String | PDF4me rastreamento de status URL - URL Para verificar o status de operações de extração assíncronas. Nulo para operações síncronas. | null |
| Uso da assinatura | Object | PDF4me dados de utilização da assinatura - Informações sobre API utilização e consumo de assinatura para a operação de extração | null |
| _metadados | Object | PDF4me metadados da operação - Objeto de metadados abrangente contendo informações de processamento, registros de data e hora e detalhes da operação. | {"success": true, "message": "Attachments extracted successfully"} |
| _metadata.success | Boolean | PDF4me indicador de status de extração - Boolean Sinalizador indicando o sucesso ou a falha do processo de extração do anexo. PDF4me retornos true para extrações bem-sucedidas e false para quaisquer erros | true |
| _metadata.message | String | PDF4me mensagem de status da extração - Mensagem de status legível por humanos, fornecendo detalhes sobre o resultado do processo de extração. Inclui confirmação de sucesso ou detalhes de erro para solução de problemas. | Attachments extracted successfully |
| _metadata.processingTimestamp | String | PDF4me carimbo de data/hora de processamento - Carimbo de data/hora ISO 8601 indicando quando a operação de extração foi concluída por PDF4memotor de extração de | 2025-09-23T20:04:09.290Z |
| _metadata.sourceFileName | String | PDF4me nome do arquivo do documento de origem - Nome original do arquivo PDF documento que foi processado para extração de anexos | document.pdf |
| _metadata.operação | String | PDF4me tipo de operação - Tipo de operação realizada por PDF4me's API, sempre "extraia o anexo do PDF" para esta ação | extractAttachmentFromPdf |
Estrutura do objeto de anexo extraído
| Campo | Tipo | Descrição | Exemplo |
|---|---|---|---|
| nome_do_arquivo | String | PDF4me nome do arquivo extraído - Nome original do arquivo anexo extraído, conforme aparece na fonte PDF documento | sample.txt |
| texto do código de barras | String | PDF4me conteúdo do código de barras - Conteúdo de texto extraído de quaisquer códigos de barras encontrados no anexo. Nulo se nenhum código de barras estiver presente. | null |
| texto do documento | String | PDF4me conteúdo do texto do documento - Conteúdo de texto extraído do arquivo anexo. Nulo se o anexo não for um documento de texto. | null |
| imagem | String | PDF4me dados de imagem - Base64 Dados de imagem codificados se o anexo for um arquivo de imagem. Nulo para anexos que não sejam imagens. | null |
N8N Resposta à ação
O PDF4me Extrair anexo de PDF API Retorna uma resposta que pode ser visualizada em vários formatos. Escolha a visualização que melhor se adapta às suas necessidades:
- JSON
- Table
- Schema
- Binary
JSON Formato de resposta
O bruto JSON resposta do API:
[
{
"documents": null,
"outputDocuments": [
{
"fileName": "sample.txt",
"barcodeText": null,
"docText": null,
"image": null
}
],
"traceId": null,
"jobId": null,
"statusUrl": null,
"subscriptionUsage": null,
"_metadata": {
"success": true,
"message": "Attachments extracted successfully",
"processingTimestamp": "2025-09-23T20:04:09.290Z",
"sourceFileName": "document.pdf",
"operation": "extractAttachmentFromPdf"
}
}
]
Visualização em tabela
Dados de resposta em formato de tabela estruturada:
| Parâmetro | Valor |
|---|---|
| documents | null |
| outputDocuments[0].fileName | sample.txt |
| outputDocuments[0].barcodeText | null |
| outputDocuments[0].docText | null |
| outputDocuments[0].image | null |
| traceId | null |
| jobId | null |
| statusUrl | null |
| subscriptionUsage | null |
| _metadata.success | true |
| _metadata.message | Attachments extracted successfully |
| _metadata.processingTimestamp | 2025-09-23T20:04:09.290Z |
| _metadata.sourceFileName | document.pdf |
| _metadata.operation | extractAttachmentFromPdf |
Visão do esquema
A estrutura de dados e os tipos de resposta:
1 item
documents: null
outputDocuments: [
{
fileName: AB sample.txt
barcodeText: null
docText: null
image: null
}
]
traceId: null
jobId: null
statusUrl: null
subscriptionUsage: null
_metadata: {
success: ☑ true
message: AB Attachments extracted successfully
processingTimestamp: AB 2025-09-23T20:04:09.290Z
sourceFileName: AB document.pdf
operation: AB extractAttachmentFromPdf
}
Indicadores de tipo:
AB= String#= Número☑= Boolean{}= Object[]= Array
Visualização de Dados Binários
Os dados e metadados reais do anexo:
outputDocuments
─────────────────────────────
File Count: {{ $json.outputDocuments.length }}
Success Status: {{ $json._metadata.success }}
Processing Time: {{ $json._metadata.processingTimestamp }}
Casos de uso
Recuperação de conteúdo de documentos
- Restauração de Arquivos Incorporados: Use o
outputDocumentsmatriz para recuperar arquivos que estavam incorporados em PDF documentos, restabelecendo o acesso aos materiais de origem originais - Recuperação de nome de arquivoExtrair os nomes de arquivo originais do
fileNamecampo para manter a identificação e organização adequadas dos arquivos - Recuperação de Documentos PerdidosRestaurar documentos que estavam previamente incorporados em PDFmas já não estão disponíveis nos seus formatos originais.
Processamento e análise de conteúdo
- Análise de ApegoProcessar arquivos individuais do
outputDocumentscoleção para analisar conteúdo, extrair dados ou realizar operações específicas em cada tipo de arquivo - Processamento de código de barrasUtilize o
barcodeTextCampo para extrair e processar informações de código de barras de anexos para fins de inventário, rastreamento ou identificação. - Extração de conteúdo de textoAproveite o
docTextCampo para extrair conteúdo textual de anexos de documentos para fluxos de trabalho de pesquisa, análise ou processamento de dados.
Automação e integração de fluxos de trabalho
- Distribuição de ArquivosDistribuir automaticamente os anexos extraídos para os sistemas, pastas ou usuários apropriados, com base no tipo de arquivo e na análise de conteúdo.
- Arquivamento de conteúdo: Use o
_metadata.traceIde resultados de extração para manter trilhas de auditoria, organizando os arquivos extraídos em sistemas de arquivamento estruturados. - Integração de múltiplos sistemasIntegre os arquivos extraídos com sistemas externos de gerenciamento de documentos, plataformas de armazenamento em nuvem ou aplicativos empresariais.