Aller au contenu principal

Extraire les métadonnées de Word dans Zapier

PDF4me Extraire les métadonnées est un Zapier action qui lit le titre, l'auteur, le sujet, les mots-clés, les dates de création et de modification, le nombre de pages, le nombre de mots et toutes les propriétés personnalisées d'un Word Ce document, sans ouvrir le fichier, est idéal pour le catalogage, le suivi de la conformité, l'alimentation des CMS ou le routage basé sur les métadonnées. Il renvoie un objet Metadata structuré au lieu d'un fichier.

Articles de blog connexes
Il n'y a pas encore d'article de blog consacré à cette fonctionnalité — à venir prochainement.
En attendant, n'hésitez pas à consulter le blog de PDF4me pour découvrir des tutoriels et des procédures de travail adaptés à toutes les plateformes.
Consultez le blog

Authentification de votre API Demande

Pour accéder au PDF4me Web API à travers ZapierChaque requête doit inclure des informations d'authentification valides. L'authentification garantit une communication sécurisée et valide votre identité en tant qu'utilisateur autorisé, permettant une intégration fluide entre vos Zapier flux de travail et PDF4me's Word Services d'extraction de métadonnées.

Informations importantes à ne pas manquer

Seul le fichier est requis
Le nom du fichier et le nom de la culture sont tous deux facultatifs dans le Zapier configuration.
Renvoie des métadonnées, pas un fichier.
Le résultat est un objet Metadata avec des propriétés imbriquées. La réponse ne contient pas d'URL de fichier ; cette action ne modifie ni ne renvoie le document lui-même.
Les propriétés personnalisées sont incluses
Toutes les propriétés de document personnalisées ajoutées via WordLa boîte de dialogue Propriétés avancées apparaît dans l'objet Métadonnées, à côté des champs standard.
Fichier de carte des étapes précédentes

Utilisez le + bouton à côté de Déposer et Nom de fichier pour faire le lien à partir des étapes Zap précédentes (par exemple, Google Drive, Dropbox ou un déclencheur). Word Le fichier doit fournir son contenu intégral, et non des références du type « Existe mais non affiché ».

:::avertissement Fichier : (Existe mais non affiché)

Si le message « Fichier : (Existe mais non affiché) » apparaît dans le champ Fichier et que des erreurs se produisent, sélectionnez l’option qui fournit le Contenu intégral du fichier au lieu de cela. Voir Zapier & Power Automate Conseils Pour plus de détails.

:::

PDF4me Extraire les métadonnées Word Zapier - Document, Nom de fichier
Seul le champ « Fichier » est précédé d’un astérisque. Les champs « Nom du fichier » et « Nom de la culture » sont facultatifs.

Quelles sont les principales caractéristiques de l'extraction de métadonnées ?

  • Propriétés intégrées: titre, auteur, sujet, mots-clés, entreprise
  • Informations sur les dates: date de création, date de modification, date de dernière impression
  • Statistiques des documents: nombre de pages, nombre de mots, nombre de caractères
  • Propriétés personnalisées: extraire les propriétés personnalisées du document définies par l'utilisateur
  • JSON Sortir: structuré JSON format pour une intégration facile

Paramètres

Liste complète des paramètres de l'action Extraire les métadonnées. Les noms des paramètres correspondent à Zapier configuration UI comme indiqué dans la capture d'écran ci-dessus.

Liste de vérification pour une configuration rapide
  1. Carte Déposer et Nom de fichier d'une étape précédente
  2. Paramètre optionnel Nom de la culture si le formatage régional des dates a de l'importance
ParamètreRequisCe que cela faitExemple
FileRequiredWord document to read metadata from. Map from a previous step. Must provide full file content.[4. File from Step 4]
File NameConditionalWord filename with .docx or .doc extension.document.docx
Culture NameConditionalLocale used when interpreting region-specific values in the metadata.en-US

Important: Seulement Déposer est requis. Carte Nom de fichier à partir du nom de fichier de sortie de l'étape précédente, lorsqu'il est disponible.

Que renvoie la fonction Extraction de métadonnées ?

Le PDF4me Extraire les métadonnées l'action renvoie un Métadonnées Objet (et non fichier) contenant les propriétés du document. Associez chaque champ de métadonnées aux prochaines étapes de votre Zap pour le catalogage, la conformité ou l'intégration CMS.

Métadonnées (Objet)

JSON Objet contenant les propriétés suivantes : Titre, Auteur, Sujet, Mots-clés, Date de création, Date de modification, Nombre de pages, Nombre de mots et toute propriété personnalisée. Associez les champs imbriqués, par exemple Metadata.Title ou Metadata.Author, aux étapes suivantes.

ChampTaperCe qu'il contient
Job IdStringUnique identifier for the Zapier job execution.
MetadataObjectJSON object with document properties.
Metadata.TitleStringDocument title.
Metadata.AuthorStringDocument author.
Metadata.SubjectStringDocument subject.
Metadata.KeywordsStringDocument keywords.
Metadata.CreatedDateStringCreation date, in ISO 8601 format.
Metadata.ModifiedDateStringLast modification date.
Metadata.PageCountNumberTotal page count.
Metadata.WordCountNumberTotal word count.

Exemple JSON sortir:

{
"Job Id": "...",
"Metadata": {
"Title": "Q4 Financial Report",
"Author": "John Doe",
"Subject": "Financial Analysis",
"Keywords": "finance, Q4, report",
"CreatedDate": "2024-01-15T10:30:00Z",
"ModifiedDate": "2024-01-20T15:45:00Z",
"PageCount": 25,
"WordCount": 5280
}
}

Configurations typiques

Exemples de flux de travailCommon Zapier workflow patterns using Extract Metadata.
Indexation du catalogue de documents
  1. Un déclencheur s'active lorsqu'un nouveau document est téléchargé dans une bibliothèque partagée.
  2. PDF4me L'extraction des métadonnées permet de lire le titre, l'auteur et les mots-clés du fichier.
  3. Les champs extraits sont insérés dans une base de données de catalogue ou un index de recherche pour une consultation ultérieure.
Piste d'audit de conformité
  1. Un déclencheur programmé liste les documents contrôlés d'un dossier de conformité.
  2. PDF4me Extraire les métadonnées lit la date de modification et l'auteur pour chaque fichier en boucle.
  3. Un filtre signale tout document dont la date de modification ou l'auteur ne respectent pas la politique de vérification manuelle.
Population des métadonnées du CMS
  1. Un document est placé dans un dossier de transit avant sa publication.
  2. PDF4me L'extraction des métadonnées permet de lire le titre, l'auteur et les mots-clés du fichier.
  3. Les champs sont publiés dans un CMS API préremplir la fiche de contenu avant que le rédacteur ne la consulte.

Conseils pratiques

File: (Exists but not shown) causes errors
Select the mapping option that provides the file's full binary content instead of a reference. See Zapier & Power Automate Tips for the exact steps.
Only File is required
File Name and Culture Name are both optional, there is no need to set them if the defaults are fine.
Empty properties return empty, not an error
A Word file with no Title or Author set simply returns an empty value for that field, the action does not fail.
This returns metadata, not the document
There is no File Url in the output. Use a different PDF4me Word action if the next step needs the actual document content.
Check for custom properties before assuming a field is missing
Fields added through Word's Advanced Properties dialog show up in the Metadata object too, review the full JSON output rather than only the standard fields.

Aide-mémoire

ChampValeur
ActionExtract Metadata
File[Mapped from previous step]
File Namedocument.docx
Culture Nameen-US (optional)
Core outputMetadata.Title, Metadata.Author, Metadata.CreatedDate, Metadata.WordCount, and more

Questions fréquentes

Does Extract Metadata return the document itself?+
No. It returns a Metadata object containing document properties such as Title, Author, CreatedDate, and WordCount, not the Word file. Use a different PDF4me action if the next step needs the actual document content.
What if a Word document has no title or author set?+
The corresponding Metadata field returns empty for any built-in property that was never filled in. See Microsoft's guide to viewing and changing Office file properties for where these values come from in the source document.
Can I extract custom document properties, not just the built-in ones?+
Yes. Any custom properties added to the Word file through its Advanced Properties dialog are included in the Metadata object alongside the standard fields like Title and Author.
Is Culture Name required to extract metadata?+
No. Culture Name is optional. It only affects how region-specific values in the metadata, such as date formatting, are interpreted, the extraction itself works without it.
How do I map nested metadata fields like Metadata.Title in later Zap steps?+
Use the + button in a later step and select the nested field directly, for example Metadata.Title or Metadata.ModifiedDate, from the Extract Metadata step's output. See this overview of document properties for what each standard field typically represents.

Actions connexes

Même tâche sur d'autres plateformes

Cas d'utilisation et applications industrielles

  • Pistes d'audit des documents: extraire les dates de modification et les auteurs à des fins d'audit de conformité
  • Suivi du contrôle de version: surveiller les versions des documents à l'aide des horodatages de création et de modification
  • Vérification de l'auteur: vérifier que les auteurs des documents correspondent aux listes de personnel autorisé
  • Application de la politique de rétention: vérifier les dates de création par rapport aux calendriers de conservation pour les décisions d'archivage
  • Gestion des documents contrôlés: suivre les propriétés des documents pour la conformité aux normes ISO ou à la gestion de la qualité

Obtenez de l'aide