Saltar al contenido principal

Leer PDF Metadatos en MakeObtener información del documento

PDF4me Obtener información del documento es un Make módulo que lee un PDF Devuelve 11 campos de metadatos, título, autor, número de páginas, tamaño del archivo y más, sin modificar el archivo original. Úselo para enrutar documentos por palabra clave, bloquear cargas de archivos demasiado grandes antes de la conversión o catalogar automáticamente archivos de archivo en una hoja de cálculo.

Lo que hace este módulo

PDF4me - Obtener información del documento lee los metadatos y las propiedades estructurales de cualquier PDF sin tocar el archivo fuente. Devuelve 11 campos individuales - Título, Autor, Tema, Palabras clave, Creador, Productor, Fecha de creación, Fecha de modificación, Número de páginas, Tamaño del archivo y Versión PDF: como tokens asignables que puede conectar directamente en Make Filtros, enrutadores, módulos de base de datos o pasos de notificación. Úselo para preseleccionar el tamaño del documento antes de un paso de conversión, enrutar archivos por autor o palabra clave del departamento, catalogar automáticamente las cargas de archivos en Airtable o Google Sheets, o mostrar el número de páginas en un correo electrónico de aprobación para que los revisores sepan qué están aprobando.

Entradas de blog relacionadas
Aún no hay ninguna entrada de blog sobre esta función; estará disponible próximamente.
Mientras tanto, echa un vistazo al blog de PDF4me para encontrar tutoriales y flujos de trabajo para todas las plataformas.
Visita el blog

Autenticando su API Pedido

Cada PDF4me módulo en Make requiere un válido Conexión. Crea o selecciona uno que contenga tu PDF4me API clave para que el escenario pueda llamar al servicio de metadatos de forma segura.

Datos importantes que no debes perderte

Estrictamente no destructivo

El módulo lee la estructura del archivo y devuelve datos. No hay bytes en el original. PDF Se escriben, reordenan o eliminan. El documento que se introduce es idéntico al que se pasa posteriormente, por lo que se puede ejecutar con seguridad en archivos de producción sin riesgo de alterar el código fuente.

Se devolvieron 11 campos estructurados.

El título, el autor, el tema, las palabras clave, el creador, el productor, la fecha de creación, la fecha de modificación, el número de páginas, el tamaño del archivo y la versión del PDF están disponibles como tokens individuales asignables en el paquete de salida; no se necesita ningún paso de análisis ni función personalizada para extraer los valores individuales.

Conéctalo directamente a la lógica de enrutamiento.

Mapa Número de páginas, autor o palabras clave directamente en un Make Filtra o enrutador para ramificar tu escenario según las propiedades del documento. Enruta los archivos de gran tamaño a una ruta de rechazo, envíalos etiquetados por departamento. PDFs a carpetas coincidentes, o bien omitir los documentos ya catalogados con una comprobación de duplicados.

Haga que el módulo PDF4me Obtener información del documento muestre Conexión establecida en testuser01@pdf4me.com, Archivo establecido en Asignar con Dropbox - opción Descargar un archivo visible, Nombre de archivo asignado desde el paso 7 Nombre de archivo, y Documento asignado desde el paso 7 Datos

Seleccionar Mapa En Archivo, luego mapeo Nombre del archivo y Documento desde el paso que descargó el PDF.

Parámetros

Requerido: Conexión, Nombre del archivo, y Documento. Colocar Archivo a Mapa Primero, para que ambos campos de entrada sean visibles. Se requieren bytes de archivo binario para el documento; una cadena URL o un nombre de archivo por sí solos no funcionarán.

ParámetroRequeridoLo que haceEjemplo de mapeo
ConnectionRequiredPDF4me API connection used by the scenario to authenticate metadata requests. Click Add and paste your API key if connecting for the first time.Your PDF4me connection
FileRequiredDetermines how the PDF is supplied. Choose Map to wire File Name and Document from a prior module's output - the most common setup for multi-step scenarios.Map
File NameConditionalFilename with .pdf extension from the source module, required when File is set to Map. Map from the file name field of your Dropbox, Drive, or OneDrive step.7. File Name
DocumentConditionalBinary PDF content from the download step, required when File is set to Map. Must be actual file bytes - not a URL or a filename string. Map from the Data field of Dropbox or the File Content field of SharePoint.7. Data

¿Cómo leo? PDF Metadatos en Make¿

  1. Agregar PDF4meObtener información del documento a tu escenario.
  2. Seleccionar Conexión (o haga clic Agregar para crear uno con tu API llave).
  3. Bajo Archivo, elegir Mapa.
  4. Mapa Nombre del archivo al campo nombre de archivo de su paso de descarga - incluya el .pdf extensión.
  5. Mapa Documento al campo de datos binarios del mismo paso (generalmente Datos en Dropbox o Contenido del archivo en los módulos de SharePoint/OneDrive).
  6. Ahorrar y haga clic Correr una vez. Ampliar el Información del archivo Paquete de salida: cada uno de los 11 campos de metadatos es un token asignable independiente, listo para integrarse en cualquier módulo posterior.

¿Qué campos de metadatos devuelve este módulo?

El módulo devuelve un Información del archivo paquete con 11 campos de metadatos individuales, cada uno de los cuales se puede asignar de forma independiente. Título, Autor, Tema, Palabras clave, Creador y Productor provienen de Diccionario de información de documentos PDF (Sección 14.3.3 de la PDF especificación 32000-1:2008), mientras que la fecha de creación y la fecha de modificación siguen ISO 8601 formato de marca de tiempo.

CampoTipoQué contiene y cómo usarlo
TitleStringDocument title as stored in the PDF metadata dictionary. Empty string if not set. Map into an Airtable record or email subject line.
AuthorStringName of the person or system that created the document. Use in a Router to send files to department-specific folders based on creator.
SubjectStringSubject or description field from the document properties dialog. Often populated by enterprise document management systems.
KeywordsStringComma-separated keyword tags embedded by the author. Filter on this field in a Make Filter to route to the correct team or project.
CreatorStringApplication that originally created the document - for example, Microsoft Word, Adobe InDesign, or a PDF library name.
ProducerStringPDF conversion library or printer driver that generated the final PDF bytes. Different from Creator when a Word file was later exported to PDF.
Creation DateDateTimeISO 8601 timestamp of when the document was first created. Use in a Filter to process only documents created within a target date range.
Modification DateDateTimeISO 8601 timestamp of the last save. Compare to a stored baseline date to detect documents that have changed since last processing.
Page CountIntegerTotal number of pages. Use in a Filter to block files over a page limit or route short vs. long documents to different processing branches.
File SizeIntegerFile size in bytes. Gate on this before a conversion or email step - reject oversized files and notify the submitter to re-upload a compressed version.
PDF VersionStringPDF specification version (e.g. 1.4, 1.7, 2.0). Verify conformance before routing to a PDF/A archive that requires a specific version.

¿Cuándo debo usar la función Obtener información del documento?

Configuraciones típicasCommon Make scenario patterns that use Get Document Information to drive routing, validation, or cataloging.
Enrutar documentos a las carpetas departamentales por palabra clave
  1. Un nuevo PDF El archivo llega a una carpeta de entrada compartida de Dropbox y activa el escenario.
  2. Obtener información del documento Extrae el campo de metadatos Palabras clave.
  3. A Make El enrutador compara el valor de la palabra clave con los nombres de los departamentos (Finanzas, Legal, Recursos Humanos).
  4. Cada sucursal sube el archivo a la carpeta del equipo correspondiente en Google Drive.
  5. Una notificación de Slack alerta al equipo de destino con el título del documento y el número de páginas.
Puerta de validación de preprocesamiento
  1. El envío de un formulario activa el escenario con un archivo adjunto. PDF.
  2. Obtener información del documento Devuelve el número de páginas y el tamaño del archivo.
  3. Un filtro impide que los archivos de más de 50 MB o de menos de 1 página se procesen correctamente.
  4. Los documentos válidos pasan al módulo de conversión o firma electrónica.
  5. Los archivos rechazados generan una respuesta por correo electrónico en la que se le pide al remitente que vuelva a subir una versión más pequeña.
Catalogar automáticamente las nuevas cargas de archivos en Airtable.
  1. Un escenario programado itera sobre nuevos PDFs en una carpeta de archivo de OneDrive.
  2. Obtener información del documento Extrae los 11 campos de metadatos por archivo.
  3. Un módulo de Airtable crea un nuevo registro con título, autor, fecha de creación y número de páginas.
  4. El registro enlaza con la URL del archivo de OneDrive para su recuperación con un solo clic.
  5. Un filtro omite los archivos que ya tienen un registro coincidente en Airtable para evitar duplicados.

Consejos prácticos

Structural fields are always populated
Page Count, File Size, and PDF Version come from the file structure itself, not optional metadata, so they are never empty even on documents with no author-supplied properties.
Empty strings are normal, not errors
Author, Title, Subject, Keywords, Creator, and Producer return empty strings when the document creator never set them. The module does not fail on missing metadata.
File Name and Document only appear after choosing Map
The panel starts with just Connection and File visible. Select Map under File to reveal the File Name and Document mapping fields.
Run Repair PDF first on suspect files
If incoming PDFs may be corrupted or come from an unreliable source, run Repair PDF before this module so metadata reads cleanly instead of returning empty fields.
Creator and Producer are often different
Creator names the authoring application, Producer names the library or driver that generated the final PDF bytes, useful for distinguishing a Word export from a native PDF tool.

Hoja de trucos

CampoValor
FileMap
File Name7. File Name
Document7. Data
Always populatedPage Count, File Size, PDF Version
Can be emptyTitle, Author, Subject, Keywords, Creator, Producer

Preguntas frecuentes

Does this module modify the PDF in any way?+
No. Get Document Information performs a strictly read-only inspection of the file. The module reads the document dictionary and cross-reference table to extract metadata values and returns them as a structured output bundle. No bytes in the source PDF are written, reordered, or removed during this process. The file you map into this module is identical byte-for-byte to what gets passed into any downstream module - you can safely run it on production documents without any risk of altering the originals.
What if the PDF has no metadata fields set?+
Page Count, File Size, and PDF Version are always populated because they are derived from the document structure itself rather than optional metadata fields. Author, Title, Subject, Keywords, Creator, and Producer will return empty strings when the document creator did not fill them in - this is common with PDFs generated by automated systems or older software that strips document information during export. The module does not error on empty metadata; it simply returns empty strings for those specific fields.
Can I use the Page Count output to branch my scenario conditionally?+
Yes - this is one of the most practical uses of the module. Map the Page Count field into a Make Filter condition placed after Get Document Information. For example, set the Filter to pass only when Page Count is greater than 20 and route those to a PDF splitting workflow, while shorter documents continue to an email step. You can similarly use File Size to reject oversized uploads before a conversion step, or check Creation Date to process only documents created within a target date range such as the current calendar month.
What PDF versions and variants does this module support?+
The module reads metadata from all common PDF versions - PDF 1.0 through PDF 2.0 - as well as PDF/A archival variants including PDF/A-1, PDF/A-2, and PDF/A-3. The PDF Version field in the output tells you exactly which specification the document conforms to (for example 1.4, 1.7, or 2.0). This is particularly useful in compliance workflows where you need to verify that a document meets a required PDF version before it is sent to a regulated archive or long-term storage system.
How do I access a specific metadata field in a downstream module?+
After the module runs, expand the File Info output bundle in the Make mapping panel - each of the 11 fields (Title, Author, Subject, Keywords, Creator, Producer, Creation Date, Modification Date, Page Count, File Size, PDF Version) appears as its own individually selectable token. Click any token to insert it into a field in the next module - for example, map Title into the Subject field of a Gmail step, Page Count into a Filter condition, or Author into an Airtable record column. No custom function or JSON parsing is required.

Acciones relacionadas

La misma tarea en otras plataformas

Obtén ayuda