Extraer metadatos de Word usando Make
Extraer metadatos es un Make módulo por PDF4me que lee las propiedades integradas y personalizadas de un documento de Word, título, autor, asunto, palabras clave, fecha de creación, fecha de modificación y las devuelve como estructuradas. JSONÚselo para catalogar documentos, realizar auditorías de cumplimiento o para alimentar un sistema de gestión de contenido sin tener que abrir cada archivo manualmente.
Lo que hace este módulo
PDF4me Extraer metadatos de Word lee las propiedades integradas (título, autor, asunto, palabras clave, empresa, fecha de creación, fecha de modificación, número de páginas, número de palabras) y cualquier propiedad de documento personalizada de un archivo de Word, devolviéndolas como un objeto estructurado. JSON objeto dentro de tu Make escenario.
¿Cómo autentico mi Make ¿Escenario?
Cada PDF4me módulo en Make requiere un válido Conexión. Crea o selecciona uno que contenga tu PDF4me API clave para que el escenario pueda autenticar de forma segura las solicitudes de extracción de metadatos.
Datos importantes que no debes perderte

Asigne el nombre del archivo y el documento, luego ejecute el escenario para recibir las propiedades del documento de Word integradas y personalizadas como JSON.
Parámetros
Requerido: Se deben proporcionar la conexión, el nombre del archivo y el documento.
| Parámetro | Requerido | Lo que hace | Ejemplo |
|---|---|---|---|
| Connection | Required | PDF4me API connection. Click Add and paste your API key if connecting for the first time. | My PDF4me connection |
| File Name | Required | Filename of the Word document with proper extension (.doc or .docx), used for processing identification. | document.docx |
| Document | Required | Word file buffer mapped from a preceding module such as Dropbox, Google Drive, or SharePoint. | [Buffer from Get File] |
Campos de salida
| Campo | Tipo | Lo que contiene |
|---|---|---|
Metadata | Object | Container object with all extracted document properties, both built-in and custom. |
Title | String | The document title property. |
Author | String | The document author property. |
Subject | String | The document subject property. |
Keywords | String | The document keywords/tags property. |
CreatedDate | String | The document creation timestamp. |
ModifiedDate | String | The document last-modified timestamp. |
PageCount | Number | Total number of pages in the document. |
WordCount | Number | Total word count in the document. |
Success | Boolean | True if metadata extraction completed successfully; false if it failed. |
¿Cómo configuro la extracción de metadatos en? Make¿
- Agregar PDF4me → Extraer metadatos a tu Make escenario.
- Seleccionar Conexión (o haga clic Agregar para crear uno con tu PDF4me API llave).
- Mapa Nombre del archivo al nombre del archivo con extensión (
.doco.docx). - Mapa Documento al contenido binario del módulo fuente: Dropbox, Google Drive o SharePoint.
- Ejecuta el escenario. El
MetadataEl objeto aparece en la salida, listo para ser asignado a un catálogo, registro de cumplimiento o CMS.
Configuraciones típicas
Ejemplos de flujo de trabajoCommon Make scenario patterns using Extract Metadata.
- Un disparador de la carpeta de vigilancia de Dropbox se activa cuando se carga un nuevo documento de Word en la biblioteca.
- La función Extraer metadatos lee el título, el autor, las palabras clave y las fechas del archivo.
- Un paso de creación de registro en Airtable indexa el documento con las propiedades extraídas para realizar búsquedas y filtros.
- Las etiquetas se generan automáticamente a partir de la propiedad Palabras clave del catálogo de documentos.
- Un disparador programado muestra todos los documentos controlados en una carpeta de cumplimiento.
- Un iterador recorre cada archivo, Obtener archivo → Extraer metadatos.
- Un filtro marca los documentos cuyo ModifiedDate Queda fuera del plazo de revisión previsto.
- Los documentos marcados y sus metadatos se registran en un informe de auditoría de cumplimiento.
- Un documento llega a una carpeta de preparación conectada a Make.
- La función Extraer metadatos lee el título, el autor, el tema y las palabras clave.
- Un HTTP módulo POSTlas propiedades extraídas a la CMS API para crear un nuevo registro de contenido.
- El documento original se mueve a una carpeta de archivo una vez que CMS Se confirma la creación del registro.
Consejos prácticos
Hoja de trucos
| Campo | Valor |
|---|---|
| Module | Extract Metadata (Word) |
| Connection | PDF4me API key |
| Supported extensions | .doc, .docx |
| Key output fields | Metadata.Title, Author, Subject, Keywords, CreatedDate, ModifiedDate |
| Empty property behavior | Returns empty string, not an error |
| Custom properties | Included when present in the source template |
Preguntas frecuentes
Casos de uso y aplicaciones en la industria
- Compliance & Audit
- Content Management
- Legal & Professional
- Publishing & Documentation
- Registros de auditoría de documentosExtraer las fechas de modificación y los autores para la evidencia de auditoría de cumplimiento
- Seguimiento del control de versiones: Monitorear las versiones de los documentos utilizando marcas de tiempo de creación y modificación.
- Verificación del autor: Validar que los autores de los documentos coincidan con las listas de personal autorizado.
- Aplicación de la política de retención: Comprobar las fechas de creación con los calendarios de retención para tomar decisiones de archivo.
- Gestión controlada de documentos: Seguimiento de las propiedades del documento para el cumplimiento de la norma ISO/gestión de calidad.
- CMS Integración: Rellenar los sistemas de gestión de contenido con títulos de documentos, autores y palabras clave.
- Indexación de búsqueda: Extraer palabras clave y temas para la indexación en motores de búsqueda de texto completo.
- Clasificación de documentos: Categorizar documentos en función de los metadatos de tema y palabras clave.
- Catalogación de bibliotecas: Indexar las bibliotecas de documentos corporativos utilizando propiedades extraídas.
- Generación de etiquetas: Genera automáticamente etiquetas de documento a partir de palabras clave y campos de asunto.
- Seguimiento de documentos de asuntos: Extraer metadatos para sistemas de gestión de documentos legales
- Indexación de documentos de descubrimiento: Documentos de descubrimiento del catálogo por autor, fecha y tema para su revisión
- Gestión de contratosExtraer las partes contratantes, las fechas y los asuntos para alimentar la base de datos de contratos.
- Generación de registro de privilegios: Utilice los metadatos del documento para generar automáticamente entradas de registro de privilegios.
- Producción de documentos: Seguimiento de los metadatos de los documentos de producción para los sistemas de bases de datos de litigios
- Seguimiento de manuscritos: Extraer autor, título y recuento de palabras para sistemas de gestión de manuscritos
- Flujo de trabajo de publicación: Enrutar documentos según los metadatos del autor y la fecha de modificación
- Cumplimiento de la guía de estilo: Compruebe que las propiedades del documento coincidan con los requisitos de la guía de estilo de publicación.
- Análisis de contenidoAnalizar las estadísticas del documento (número de palabras, número de páginas) para la planificación del contenido.
- Coordinación entre múltiples autores: Seguimiento de los autores de los documentos y las fechas de modificación en proyectos colaborativos