Pular para o conteúdo principal

Extrair anexo de PDF em Make

Extrair anexo de PDF é um Make módulo que recupera todos os arquivos incorporados dentro de um PDF documento automaticamente dentro de um cenário. Ele lida com PDF portfólios, padrão PDF anexos e PDF/A-3 arquivos de origem, retornando cada arquivo extraído como um Base64Item codificado em um array de anexos, pronto para ser processado individualmente por um iterador.

O que este módulo faz
PDF4me Extrair anexo de PDF recupera todos os arquivos incorporados de um PDF documento ou PDF portfólio dentro de um Make cenário. Forneça o PDF como um buffer binário e o módulo retorna uma matriz Attachments onde cada item contém o nome do arquivo e os dados do arquivo (Base64). Encadeie um Make Iterador para processar cada arquivo individualmente: fazer upload para armazenamento em nuvem, enviar por e-mail aos destinatários, importar arquivos de dados para um banco de dados ou passar para outro módulo.
Utilize um iterador para processar cada anexo separadamente.

O módulo retorna todos os anexos como uma matriz em um único pacote de saída. Adicione um Make Iterador O módulo imediatamente seguinte divide o array em pacotes individuais, um para cada anexo. Cada pacote contém Nome do arquivo e Dados do arquivo (Base64) para que você possa encaminhar arquivos para diferentes destinos com base no tipo ou nome.

Os dados do arquivo são Base64-codificado

Cada anexo extraído é retornado como um Base64 corda no Dados do arquivo campo. Maioria Make Aceitamos integrações de armazenamento (Google Drive, Dropbox, OneDrive). Base64 diretamente. Se um módulo subsequente exigir entrada binária, converta usando o Make toBinary(FileData, 'base64') função antes do mapeamento.

Funciona com PDF portfólios e PDF/A-3 arquivos

Além do padrão PDF anexos, este módulo lida com PDF portfólios (contêineres de vários arquivos) e PDF/A-3 Arquivar documentos com arquivos de origem incorporados. Para PDF/A-3, os arquivos de origem (Word, Excel, XML) são extraídos enquanto o arquivo PDF permanece intacto no armazenamento em conformidade com o PDF/A-3 especificação.

Artigos relacionados no blogue
Ainda não há nenhuma publicação no blogue sobre esta funcionalidade — em breve.
Entretanto, explore o blogue da PDF4me para encontrar tutoriais e fluxos de trabalho para todas as plataformas.
Visite o blogue

Autenticando seu API Solicitar

Para acessar o PDF4me Web API através MakeCada solicitação deve incluir credenciais de autenticação adequadas. A autenticação garante a comunicação segura entre você e seu cliente. Make cenários e PDF4meserviços de extração de anexos.

O módulo "Extrair anexo do PDF" do PDF4me mostra os campos "Nome do arquivo" e "Documento" mapeados de um módulo anterior.

Mapa Nome do arquivo e Documento da etapa de download anterior, em seguida, encadeie um Make Iterador para processar cada anexo extraído.

Como configurar a extração de anexos de PDF em Make

  1. Adicionar PDF4me > Extrair anexo de PDF de acordo com o seu cenário.
  2. Selecione o seu Conexão ou clique Adicionar para criar um com o seu API chave.
  3. Mapa Nome do arquivo (com extensão .pdf) do módulo anterior ou insira um nome estático.
  4. Mapa Documento (binário) PDF buffer) de um Google Drive, Dropbox, e-mail ou HTTP Etapa de download.
  5. Adicionar um Make Iterador após este módulo e mapeá-lo para o Anexos saída em matriz.
  6. Conecte os módulos subsequentes à saída do Iterator: faça upload para armazenamento em nuvem, envie por e-mail, importe dados ou direcione por tipo de arquivo.

Parâmetros

ParâmetroObrigatórioO que fazExemplo
File NameRequiredFilename of the source PDF including the .pdf extension. Map from the previous module's file name output or enter a static name.portfolio.pdf
DocumentRequiredBinary PDF file content. Map from a Google Drive, Dropbox, email, or HTTP download step. The PDF must contain embedded attachments for the module to return results.[PDF Buffer]

Saída

CampoTipoO que contém
AttachmentsArrayCollection of all extracted attachment objects. Feed into a Make Iterator to process each file individually.
File NameStringFilename of the individual attachment including its extension (e.g. source_data.xlsx).
File DataBase64Content of the individual attachment encoded as Base64. Map to a storage upload module or decode with toBinary() for modules that require binary input.

Que tipos de arquivo você pode extrair de um PDF?

Qualquer tipo de arquivo incorporado como anexo é suportado: planilhas (XLSX, CSV), documentos do Word (DOCX), imagens (PNG, JPG), CEPs ou outros PDFsIsso inclui arquivos em PDF portfólios (formato de contêiner de vários arquivos da Adobe) e arquivos de origem incorporados em PDF/A-3 arquivos de acordo com o ISO 19005-3 padrãoO módulo preserva os formatos e extensões de arquivo originais no campo Nome do Arquivo retornado.

Exemplos de fluxo de trabalho

Extrair e organizar arquivos de evidências de documentos de conformidade. PDFs

  1. Acionar: Submissão de conformidade PDF recebido (anexo de e-mail ou pasta de monitoramento)
  2. Download PDFRecuperar o pacote de conformidade
  3. Extrair anexosRecuperar todos os arquivos de evidência incorporados
  4. IteradorProcessar cada anexo extraído individualmente
  5. Classificar por extensãoDirecione para a pasta de conformidade apropriada (planilhas, imagens, documentos)
  6. CarregarSalve cada arquivo na pasta correta em SharePoint ou Google Drive
  7. RegistroRegistre todos os arquivos extraídos em um banco de dados de conformidade.
  8. Notificar a equipe: Alertar a equipe de conformidade sobre o envio processado

Perguntas frequentes

What types of files can this module extract from a PDF?+
The module extracts any file type embedded as an attachment: spreadsheets, Word documents, images, CSVs, ZIPs, or other PDFs. This includes files in PDF portfolios and source files embedded in PDF/A-3 archive documents. Original file formats and extensions are preserved in the returned File Name field.
How do I process multiple attachments returned by the module?+
The module returns an Attachments array. Use a Make Iterator immediately after to split the array into individual bundles, one per attachment. Each bundle contains File Name and File Data (Base64). You can then upload each file to Google Drive, Dropbox, or SharePoint, or apply routing logic based on the file extension.
What is the File Data format and how do I use it?+
File Data is returned as a Base64-encoded string. Most Make storage modules (Google Drive, Dropbox, OneDrive) accept Base64 data directly in their upload fields. If a module requires binary input, use the Make function toBinary(File Data, "base64") to convert before mapping. No separate decoding step is needed for standard storage integrations.
Does this module work with PDF/A-3 source file extraction?+
Yes. PDF/A-3 is the only PDF/A variant that permits embedded file attachments. If your archive workflow produces PDF/A-3 documents with embedded source files such as Word, Excel, or XML, this module retrieves them for editing or reprocessing while the PDF/A-3 archive document remains intact in your compliance storage.

Obtenha ajuda