Aller au contenu principal

Extraire les métadonnées d'un document Word à l'aide de n8n action

PDF4me Extraire les métadonnées d'un document Word permet d'extraire des métadonnées et des propriétés complètes à partir de documents Word via n8n Automatisation des flux de travail grâce à des fonctionnalités d'analyse documentaire détaillées. Cette puissante fonction d'extraction de métadonnées prend en charge les propriétés intégrées et personnalisées des documents, les statistiques, les informations sur l'auteur, les dates de création et le suivi des révisions, avec une mise en forme et une localisation adaptées aux spécificités culturelles. Elle est idéale pour la gestion documentaire, le suivi de la conformité et l'analyse de contenu.

Articles de blog connexes
Il n'y a pas encore d'article de blog consacré à cette fonctionnalité — à venir prochainement.
En attendant, n'hésitez pas à consulter le blog de PDF4me pour découvrir des tutoriels et des procédures de travail adaptés à toutes les plateformes.
Consultez le blog

Installation

Ajoutez le PDF4me Ajoutez le nœud « Extraire les métadonnées d'un document Word » à votre n8n Suivez le flux de travail et configurez les paramètres requis. Pour les instructions de configuration initiale, consultez notre documentation. n8n Guide d'intégration.

Prérequis :

  • PDF4me API informations d'identification
  • n8n accès au flux de travail

Configuration:

  1. Ajouter PDF4me nœud vers flux de travail
  2. Sélectionnez l'action « Extraire les métadonnées du document Word ».
  3. Configurer les paramètres d'entrée (voir ci-dessous)
Extraire les métadonnées d'un document Word

Paramètres

Liste complète des paramètres de l'action Extraire les métadonnées d'un document Word. Configurez ces paramètres pour contrôler le comportement d'extraction des métadonnées.

Important: Les paramètres marqués d'un astérisque (***) sont obligatoires. Les paramètres avancés permettent un contrôle précis de la mise en forme des métadonnées.

ParamètreTaperDescriptionExemple
Type de données d'entrée***StringSélection du format d'entrée du document Word
• Choisissez le format de vos données Word.
PDF4me prend en charge plusieurs types d'entrée
• Options : Données binaires, Base64 Chaîne, ou URL
Binary Data
Champ binaire d'entrée***BinaireEntrée de fichier Word binaire (Obligatoire si données binaires)
• Fichier Word de référence (.docx, .doc) de la session précédente n8n Téléchargement de nœud ou de fichier
PDF4me traite les fichiers Word binaires avec détection automatique du format
• Obligatoire lorsque le type de données d'entrée est « Données binaires »
{{ $binary.data }}
Contenu de mots en Base64***StringBase64 Saisie de mots encodés (Obligatoire si chaîne Base64)
• Fournir le contenu Word (.docx, .doc) sous forme de chaîne encodée en base64 pour une transmission sécurisée
PDF4me décode et traite automatiquement le contenu Word
• Obligatoire lorsque le type de données d'entrée est « Chaîne Base64 »
UEsDBBQABgAI...
URL du document Word***StringDocument Word public URL Saisir (Obligatoire si URL)
• Fournir une autorisation publique/ouverte URL au fichier Word (.docx, .doc) à traiter
PDF4me télécharge et traite le fichier Word à partir du fichier fourni URL
• Obligatoire lorsque le type de données d'entrée est « URL »
https://abc.com/document.docx
Nom du document Word***StringNom du fichier d'entrée du document Word
• Spécifiez le nom du fichier Word d'entrée avec l'extension appropriée (.docx, .doc).
PDF4me utilise ceci pour la détection de format et l'optimisation du traitement
document.docx
Nom de la cultureStringDocument Culture/Locale
• Code de culture pour le formatage de la date et de l'heure (par exemple, « en-US », « de-DE », « fr-FR »)
• Par défaut : InvariantCulture (mise en forme cohérente)
• Affecte le format d'affichage de la date et de l'heure dans les métadonnées
en-US

Sortir

Paramètres de sortie

ParamètreTaperDescriptionExemple
nom de fichierStringNom du fichier Word original - Le nom du fichier Word d'entréemyWordFile.docx
succèsBooleanPDF4me état de fonctionnement - Boolean Un indicateur signalant le succès ou l'échec de l'opération d'extraction des métadonnées. PDF4me retours true pour des opérations réussies et false pour toute erreurtrue
nom de la cultureStringCode culturel/local - Code de culture utilisé pour le formatage de la date et de l'heure (par exemple, « en-US », « de-DE », « fr-FR »)en-US
métadonnéesObjectObjet de métadonnées imbriqué - Contient la structure des métadonnées du document avec un objet de métadonnées imbriqué contenant toutes les propriétés du document, notamment : Auteur, Titre, Sujet, Mots clés, Commentaires, Catégorie, Société, Responsable, Date de création, Date de dernière modification, Date de dernière impression, Numéro de révision, Temps total d'édition, Pages, Mots, Caractères, Paragraphes{"metadata": {"Author": "Ynoox Testtwo", "Company": "HP Inc.", "Words": 921}}
messageStringMessage d'opération - Message descriptif indiquant le résultat de l'opération d'extraction des métadonnéesWord metadata extracted successfully

N8N Réponse à l'action

Le PDF4me Extraire les métadonnées d'un document Word API renvoie une réponse pouvant être affichée dans plusieurs formats. Choisissez l'affichage qui correspond le mieux à vos besoins :

JSON Format de réponse

Le cru JSON réponse de la API:

[
{
"fileName": "myWordFile.docx",
"success": true,
"cultureName": "en-US",
"metadata": {
"document": null,
"fileName": null,
"success": true,
"errorMessage": null,
"metadata": {
"Author": "Ynoox Testtwo",
"Title": "",
"Subject": "",
"Keywords": "",
"Comments": "",
"Category": "",
"Company": "HP Inc.",
"Manager": "",
"Created": "5/16/2019 6:04:00 AM",
"LastModified": "8/7/2024 7:04:00 AM",
"LastPrinted": "5/16/2019 6:04:00 AM",
"RevisionNumber": 5,
"TotalEditingTime": 2,
"Pages": 3,
"Words": 921,
"Characters": 5256,
"Paragraphs": 12
}
},
"message": "Word metadata extracted successfully"
}
]

Cas d'utilisation

Automatisation des documents d'entreprise

  • Gestion documentaireExtraire les métadonnées pour l'organisation et le catalogage des documents
  • Suivi de la conformitéSuivre les propriétés des documents pour assurer la conformité réglementaire
  • Analyse de contenuAnalyser les statistiques et les propriétés des documents
  • Recherche de documentsUtiliser les métadonnées pour la recherche et la récupération de documents

Traitement de documents par l'IA

  • Prise en charge multiformatTraiter les documents Word aux formats .docx et .doc
  • Traitement multilingue: Prise en charge de différentes langues et régions
  • Extraction intelligente de métadonnéesExtraction automatique de toutes les propriétés du document

Veille stratégique et analyse de données

  • Analyse de documentsAnalyser les propriétés et les statistiques des documents
  • Surveillance de la conformité: S'assurer que les documents respectent les exigences en matière de métadonnées
  • Indicateurs de performanceSuivre la précision et l'efficacité du traitement

Obtenez de l'aide