Saltar al contenido principal

Extraer metadatos de Word en Zapier

PDF4me Extraer metadatos es un Zapier acción que lee el título, el autor, el asunto, las palabras clave, las fechas de creación y modificación, el número de páginas, el número de palabras y cualquier propiedad personalizada de un Word Permite visualizar el documento sin necesidad de abrir el archivo. Úselo para catalogar documentos, realizar el seguimiento del cumplimiento normativo, alimentar sistemas de gestión de contenido (CMS) o enrutar documentos según sus metadatos. Devuelve un objeto de metadatos estructurado en lugar de un archivo.

Entradas de blog relacionadas
Aún no hay ninguna entrada de blog sobre esta función; estará disponible próximamente.
Mientras tanto, echa un vistazo al blog de PDF4me para encontrar tutoriales y flujos de trabajo para todas las plataformas.
Visita el blog

Autenticando su API Pedido

Para acceder al PDF4me Web API a través de ZapierCada solicitud debe incluir las credenciales de autenticación adecuadas. La autenticación garantiza una comunicación segura y valida su identidad como usuario autorizado, lo que permite una integración perfecta entre su Zapier flujos de trabajo y PDF4me's Word servicios de extracción de metadatos.

Datos importantes que no debes perderte

Solo se requiere el archivo
El nombre del archivo y el nombre de la cultura son opcionales en el Zapier configuración.
Devuelve metadatos, no un archivo.
El resultado es un objeto de metadatos con propiedades anidadas. La respuesta no incluye una URL de archivo; esta acción no modifica ni devuelve el documento en sí.
Se incluyen propiedades personalizadas.
Cualquier propiedad de documento personalizada agregada a través de WordEl cuadro de diálogo Propiedades avanzadas aparece en el objeto Metadatos junto con los campos estándar.
Archivo de mapa de los pasos anteriores

Utilice el + botón al lado de Archivo y Nombre del archivo para mapear desde pasos anteriores de Zap (por ejemplo, Google Drive, Dropbox o un activador). Word El archivo debe proporcionar el contenido completo, no referencias del tipo "Existe pero no se muestra".

:::advertencia Archivo: (Existe pero no se muestra) Si ve "Archivo: (Existe pero no se muestra)" en el campo Archivo y aparecen errores, seleccione la opción que proporciona la contenido completo del archivo en cambio. Ver Zapier & Power Automate Consejos Para más detalles.

:::

PDF4me Extraer metadatos Word Zapier - Documento, Nombre del archivo
Solo el archivo lleva un asterisco. El nombre del archivo y el nombre de la cultura son opcionales.

¿Cuáles son las características clave de la extracción de metadatos?

  • Propiedades integradasTítulo, autor, tema, palabras clave, empresa
  • Información de fecha: fecha de creación, fecha de modificación, fecha de última impresión
  • Estadísticas de documentos: número de páginas, número de palabras, número de caracteres
  • Propiedades personalizadas: extraer propiedades de documentos personalizadas definidas por el usuario
  • JSON Producción: estructurado JSON formato para una fácil integración

Parámetros

Lista completa de parámetros para la acción Extraer metadatos. Los nombres de los parámetros coinciden con los Zapier configuración UI Como se muestra en la captura de pantalla anterior.

Lista de verificación de configuración rápida
  1. Mapa Archivo y Nombre del archivo desde un paso anterior
  2. Opcionalmente se puede configurar Nombre de la cultura si importa el formato de fecha regional
ParámetroRequeridoLo que haceEjemplo
FileRequiredWord document to read metadata from. Map from a previous step. Must provide full file content.[4. File from Step 4]
File NameConditionalWord filename with .docx or .doc extension.document.docx
Culture NameConditionalLocale used when interpreting region-specific values in the metadata.en-US

Importante: Solo Archivo Es obligatorio. Mapa Nombre del archivo a partir del nombre de archivo de salida del paso anterior, cuando esté disponible.

¿Qué devuelve la función Extraer metadatos?

El PDF4me Extraer metadatos La acción devuelve un Metadatos Objeto, no un archivo, que contiene propiedades del documento. Asigne campos de metadatos individuales a sus próximos pasos de Zap para catalogación, cumplimiento o integración con CMS.

Metadatos (Objeto)

JSON Objeto con Título, Autor, Asunto, Palabras clave, Fecha de creación, Fecha de modificación, Número de páginas, Número de palabras y cualquier propiedad personalizada. Asigne campos anidados, por ejemplo Metadata.Title o Metadata.Author, a los siguientes pasos.

CampoTipoLo que contiene
Job IdStringUnique identifier for the Zapier job execution.
MetadataObjectJSON object with document properties.
Metadata.TitleStringDocument title.
Metadata.AuthorStringDocument author.
Metadata.SubjectStringDocument subject.
Metadata.KeywordsStringDocument keywords.
Metadata.CreatedDateStringCreation date, in ISO 8601 format.
Metadata.ModifiedDateStringLast modification date.
Metadata.PageCountNumberTotal page count.
Metadata.WordCountNumberTotal word count.

Ejemplo JSON producción:

{
"Job Id": "...",
"Metadata": {
"Title": "Q4 Financial Report",
"Author": "John Doe",
"Subject": "Financial Analysis",
"Keywords": "finance, Q4, report",
"CreatedDate": "2024-01-15T10:30:00Z",
"ModifiedDate": "2024-01-20T15:45:00Z",
"PageCount": 25,
"WordCount": 5280
}
}

Configuraciones típicas

Ejemplos de flujo de trabajoCommon Zapier workflow patterns using Extract Metadata.
Indexación del catálogo de documentos
  1. Se activa un disparador cuando se sube un nuevo documento a una biblioteca compartida.
  2. PDF4me La función Extraer metadatos lee el título, el autor y las palabras clave del archivo.
  3. Los campos extraídos se insertan en una base de datos de catálogo o índice de búsqueda para su posterior consulta.
Registro de auditoría de cumplimiento
  1. Un disparador programado muestra los documentos controlados de una carpeta de cumplimiento.
  2. PDF4me La función Extract Metadata lee la fecha de modificación y el autor de cada archivo en un bucle.
  3. Un filtro marca cualquier documento cuya fecha de modificación o autor no se ajuste a la política para su revisión manual.
población de metadatos de CMS
  1. Un documento se guarda en una carpeta de preparación antes de su publicación.
  2. PDF4me La función Extraer metadatos lee el título, el autor y las palabras clave del archivo.
  3. Los campos se publican en un CMS. API rellenar previamente el registro de contenido antes de que el editor lo revise.

Consejos prácticos

File: (Exists but not shown) causes errors
Select the mapping option that provides the file's full binary content instead of a reference. See Zapier & Power Automate Tips for the exact steps.
Only File is required
File Name and Culture Name are both optional, there is no need to set them if the defaults are fine.
Empty properties return empty, not an error
A Word file with no Title or Author set simply returns an empty value for that field, the action does not fail.
This returns metadata, not the document
There is no File Url in the output. Use a different PDF4me Word action if the next step needs the actual document content.
Check for custom properties before assuming a field is missing
Fields added through Word's Advanced Properties dialog show up in the Metadata object too, review the full JSON output rather than only the standard fields.

Hoja de trucos

CampoValor
ActionExtract Metadata
File[Mapped from previous step]
File Namedocument.docx
Culture Nameen-US (optional)
Core outputMetadata.Title, Metadata.Author, Metadata.CreatedDate, Metadata.WordCount, and more

Preguntas frecuentes

Does Extract Metadata return the document itself?+
No. It returns a Metadata object containing document properties such as Title, Author, CreatedDate, and WordCount, not the Word file. Use a different PDF4me action if the next step needs the actual document content.
What if a Word document has no title or author set?+
The corresponding Metadata field returns empty for any built-in property that was never filled in. See Microsoft's guide to viewing and changing Office file properties for where these values come from in the source document.
Can I extract custom document properties, not just the built-in ones?+
Yes. Any custom properties added to the Word file through its Advanced Properties dialog are included in the Metadata object alongside the standard fields like Title and Author.
Is Culture Name required to extract metadata?+
No. Culture Name is optional. It only affects how region-specific values in the metadata, such as date formatting, are interpreted, the extraction itself works without it.
How do I map nested metadata fields like Metadata.Title in later Zap steps?+
Use the + button in a later step and select the nested field directly, for example Metadata.Title or Metadata.ModifiedDate, from the Extract Metadata step's output. See this overview of document properties for what each standard field typically represents.

Acciones relacionadas

La misma tarea en otras plataformas

Casos de uso y aplicaciones en la industria

  • Registros de auditoría de documentos: extraer las fechas de modificación y los autores para la evidencia de auditoría de cumplimiento
  • Seguimiento del control de versiones: monitorizar las versiones de los documentos utilizando marcas de tiempo de creación y modificación.
  • Verificación del autor: validar que los autores de los documentos coincidan con las listas de personal autorizado
  • Aplicación de la política de retención: comprobar las fechas de creación con los calendarios de retención para tomar decisiones de archivo.
  • Gestión controlada de documentos: realizar un seguimiento de las propiedades del documento para el cumplimiento de la norma ISO o de la gestión de la calidad.

Obtén ayuda