Pular para o conteúdo principal

Ler PDF Metadados em MakeObter informações do documento

PDF4me Obter informações do documento é um Make módulo que lê um PDF e retorna 11 campos de metadados, título, autor, número de páginas, tamanho do arquivo e muito mais, sem modificar o arquivo de origem. Use-o para direcionar documentos por palavra-chave, bloquear uploads muito grandes antes da conversão ou catalogar automaticamente arquivos compactados em uma planilha.

O que este módulo faz

PDF4me - Obter informações do documento Lê os metadados e as propriedades estruturais de qualquer PDF sem alterar o arquivo de origem. Ele retorna 11 campos individuais - Título, Autor, Assunto, Palavras-chave, Criador, Produtor, Data de Criação, Data de Modificação, Número de Páginas, Tamanho do Arquivo e Versão do PDF - como tokens mapeáveis que você pode conectar diretamente. Make Filtros, roteadores, módulos de banco de dados ou etapas de notificação. Use-o para pré-selecionar o tamanho do documento antes de uma etapa de conversão, encaminhar arquivos por palavra-chave do autor ou departamento, catalogar automaticamente uploads de arquivos no Airtable ou no Google Sheets ou exibir a contagem de páginas em um e-mail de aprovação para que os revisores saibam o que estão aprovando.

Artigos relacionados no blogue
Ainda não há nenhuma publicação no blogue sobre esta funcionalidade — em breve.
Entretanto, explore o blogue da PDF4me para encontrar tutoriais e fluxos de trabalho para todas as plataformas.
Visite o blogue

Autenticando seu API Solicitar

Todo PDF4me módulo em Make requer um válido ConexãoCrie ou selecione um que contenha o seu PDF4me API chave para que o cenário possa chamar o serviço de metadados com segurança.

Fatos importantes que você não deve perder

Estritamente não destrutivo

O módulo lê a estrutura do arquivo e retorna os dados. Não há bytes no original. PDF são escritos, reordenados ou removidos. O documento que você mapeia é idêntico ao que é passado adiante — seguro para executar em arquivos de produção sem qualquer risco de alterar a origem.

11 campos estruturados retornados

Título, Autor, Assunto, Palavras-chave, Criador, Produtor, Data de Criação, Data de Modificação, Número de Páginas, Tamanho do Arquivo e Versão do PDF estão todos disponíveis como tokens mapeáveis individuais no pacote de saída - nenhuma etapa de análise sintática ou função personalizada é necessária para extrair valores individuais.

Conecte diretamente à lógica de roteamento.

Mapear a contagem de páginas, o autor ou as palavras-chave diretamente em um Make Filtre ou direcione seu cenário com base nas propriedades do documento. Direcione arquivos muito grandes para um caminho de rejeição, envie-os com etiquetas de departamento. PDFs para pastas correspondentes ou ignorar documentos já catalogados com uma verificação de duplicados.

Configure o módulo "Obter informações do documento" do PDF4me para exibir a conexão definida como testuser01@pdf4me.com, o arquivo configurado para "Mapear com o Dropbox" e a opção "Baixar um arquivo" visível, o nome do arquivo mapeado da etapa 7 (Nome do arquivo) e o documento mapeado da etapa 7 (Dados).

Selecione Mapa Em Arquivo, clique em Mapa. Nome do arquivo e Documento a partir da etapa que baixou o PDF.

Parâmetros

Obrigatório: Conexão, Nome do arquivo, e Documento. Definir Arquivo para Mapa Primeiro, para que ambos os campos de entrada fiquem visíveis. São necessários bytes binários do arquivo para o documento; uma string de URL ou o nome do arquivo sozinhos não funcionarão.

ParâmetroObrigatórioO que fazExemplo de mapeamento
ConnectionRequiredPDF4me API connection used by the scenario to authenticate metadata requests. Click Add and paste your API key if connecting for the first time.Your PDF4me connection
FileRequiredDetermines how the PDF is supplied. Choose Map to wire File Name and Document from a prior module's output - the most common setup for multi-step scenarios.Map
File NameConditionalFilename with .pdf extension from the source module, required when File is set to Map. Map from the file name field of your Dropbox, Drive, or OneDrive step.7. File Name
DocumentConditionalBinary PDF content from the download step, required when File is set to Map. Must be actual file bytes - not a URL or a filename string. Map from the Data field of Dropbox or the File Content field of SharePoint.7. Data

Como faço para ler? PDF Metadados em Make?

  1. Adicionar PDF4meObter informações do documento de acordo com o seu cenário.
  2. Selecione Conexão (ou clique) Adicionar para criar um com o seu API chave).
  3. Sob Arquivo, escolher Mapa.
  4. Mapa Nome do arquivo No campo de nome do arquivo da sua etapa de download, inclua o .pdf extensão.
  5. Mapa Documento para o campo de dados binários da mesma etapa (normalmente Dados no Dropbox ou Conteúdo do arquivo (em módulos do SharePoint/OneDrive).
  6. Salvar e clique Executar uma vezExpanda o Informações do arquivo Pacote de saída - cada um dos 11 campos de metadados é um token mapeável separado, pronto para ser integrado a qualquer módulo subsequente.

Quais campos de metadados este módulo retorna?

O módulo retorna um Informações do arquivo Pacote com 11 campos de metadados individuais - cada um mapeável independentemente. Título, Autor, Assunto, Palavras-chave, Criador e Produtor vêm do Dicionário de informações de documentos PDF (Seção 14.3.3 do PDF 32000-1:2008 (especificação), enquanto a Data de Criação e a Data de Modificação seguem ISO 8601 Formatação de carimbo de data/hora.

CampoTipoO que contém e como usar
TitleStringDocument title as stored in the PDF metadata dictionary. Empty string if not set. Map into an Airtable record or email subject line.
AuthorStringName of the person or system that created the document. Use in a Router to send files to department-specific folders based on creator.
SubjectStringSubject or description field from the document properties dialog. Often populated by enterprise document management systems.
KeywordsStringComma-separated keyword tags embedded by the author. Filter on this field in a Make Filter to route to the correct team or project.
CreatorStringApplication that originally created the document - for example, Microsoft Word, Adobe InDesign, or a PDF library name.
ProducerStringPDF conversion library or printer driver that generated the final PDF bytes. Different from Creator when a Word file was later exported to PDF.
Creation DateDateTimeISO 8601 timestamp of when the document was first created. Use in a Filter to process only documents created within a target date range.
Modification DateDateTimeISO 8601 timestamp of the last save. Compare to a stored baseline date to detect documents that have changed since last processing.
Page CountIntegerTotal number of pages. Use in a Filter to block files over a page limit or route short vs. long documents to different processing branches.
File SizeIntegerFile size in bytes. Gate on this before a conversion or email step - reject oversized files and notify the submitter to re-upload a compressed version.
PDF VersionStringPDF specification version (e.g. 1.4, 1.7, 2.0). Verify conformance before routing to a PDF/A archive that requires a specific version.

Quando devo usar a opção "Obter informações do documento"?

Configurações típicasCommon Make scenario patterns that use Get Document Information to drive routing, validation, or cataloging.
Encaminhar documentos para pastas departamentais por palavra-chave
  1. Um novo PDF A mensagem cai em uma pasta de entrada compartilhada do Dropbox e desencadeia o cenário.
  2. Obter informações do documento Extrai o campo de metadados "Palavras-chave".
  3. A Make O roteador verifica o valor da palavra-chave em relação aos nomes dos departamentos (Finanças, Jurídico, RH).
  4. Cada filial carrega o arquivo para a pasta da equipe correspondente no Google Drive.
  5. Uma notificação do Slack alerta a equipe de destino com o título do documento e o número de páginas.
Portão de validação de pré-processamento
  1. O envio de um formulário aciona o cenário com um anexo. PDF.
  2. Obter informações do documento Retorna a contagem de páginas e o tamanho do arquivo.
  3. Um filtro impede que arquivos com mais de 50 MB ou menos de uma página sejam carregados.
  4. Os documentos válidos seguem para o módulo de conversão ou assinatura eletrônica.
  5. Os arquivos rejeitados geram uma resposta por e-mail solicitando ao remetente que reenvie uma versão menor.
Catalogue automaticamente os novos uploads de arquivos no Airtable.
  1. Um cenário agendado itera sobre novos PDFs em uma pasta de arquivo do OneDrive.
  2. Obter informações do documento Extrai todos os 11 campos de metadados por arquivo.
  3. Um módulo do Airtable cria um novo registro com Título, Autor, Data de Criação e Número de Páginas.
  4. O registro inclui um link para o URL do arquivo no OneDrive, permitindo o acesso com um único clique.
  5. Um filtro ignora arquivos que já possuem um registro correspondente no Airtable para evitar duplicatas.

Dicas práticas

Structural fields are always populated
Page Count, File Size, and PDF Version come from the file structure itself, not optional metadata, so they are never empty even on documents with no author-supplied properties.
Empty strings are normal, not errors
Author, Title, Subject, Keywords, Creator, and Producer return empty strings when the document creator never set them. The module does not fail on missing metadata.
File Name and Document only appear after choosing Map
The panel starts with just Connection and File visible. Select Map under File to reveal the File Name and Document mapping fields.
Run Repair PDF first on suspect files
If incoming PDFs may be corrupted or come from an unreliable source, run Repair PDF before this module so metadata reads cleanly instead of returning empty fields.
Creator and Producer are often different
Creator names the authoring application, Producer names the library or driver that generated the final PDF bytes, useful for distinguishing a Word export from a native PDF tool.

Folha de dicas

CampoValor
FileMap
File Name7. File Name
Document7. Data
Always populatedPage Count, File Size, PDF Version
Can be emptyTitle, Author, Subject, Keywords, Creator, Producer

Perguntas frequentes

Does this module modify the PDF in any way?+
No. Get Document Information performs a strictly read-only inspection of the file. The module reads the document dictionary and cross-reference table to extract metadata values and returns them as a structured output bundle. No bytes in the source PDF are written, reordered, or removed during this process. The file you map into this module is identical byte-for-byte to what gets passed into any downstream module - you can safely run it on production documents without any risk of altering the originals.
What if the PDF has no metadata fields set?+
Page Count, File Size, and PDF Version are always populated because they are derived from the document structure itself rather than optional metadata fields. Author, Title, Subject, Keywords, Creator, and Producer will return empty strings when the document creator did not fill them in - this is common with PDFs generated by automated systems or older software that strips document information during export. The module does not error on empty metadata; it simply returns empty strings for those specific fields.
Can I use the Page Count output to branch my scenario conditionally?+
Yes - this is one of the most practical uses of the module. Map the Page Count field into a Make Filter condition placed after Get Document Information. For example, set the Filter to pass only when Page Count is greater than 20 and route those to a PDF splitting workflow, while shorter documents continue to an email step. You can similarly use File Size to reject oversized uploads before a conversion step, or check Creation Date to process only documents created within a target date range such as the current calendar month.
What PDF versions and variants does this module support?+
The module reads metadata from all common PDF versions - PDF 1.0 through PDF 2.0 - as well as PDF/A archival variants including PDF/A-1, PDF/A-2, and PDF/A-3. The PDF Version field in the output tells you exactly which specification the document conforms to (for example 1.4, 1.7, or 2.0). This is particularly useful in compliance workflows where you need to verify that a document meets a required PDF version before it is sent to a regulated archive or long-term storage system.
How do I access a specific metadata field in a downstream module?+
After the module runs, expand the File Info output bundle in the Make mapping panel - each of the 11 fields (Title, Author, Subject, Keywords, Creator, Producer, Creation Date, Modification Date, Page Count, File Size, PDF Version) appears as its own individually selectable token. Click any token to insert it into a field in the next module - for example, map Title into the Subject field of a Gmail step, Page Count into a Filter condition, or Author into an Airtable record column. No custom function or JSON parsing is required.

Ações relacionadas

Mesma tarefa em outras plataformas

Obtenha ajuda