Extraire les métadonnées d'un document Word à l'aide de n8n action
PDF4me Extraire les métadonnées d'un document Word permet d'extraire des métadonnées et des propriétés complètes à partir de documents Word via n8n Automatisation des flux de travail grâce à des fonctionnalités d'analyse documentaire détaillées. Cette puissante fonction d'extraction de métadonnées prend en charge les propriétés intégrées et personnalisées des documents, les statistiques, les informations sur l'auteur, les dates de création et le suivi des révisions, avec une mise en forme et une localisation adaptées aux spécificités culturelles. Elle est idéale pour la gestion documentaire, le suivi de la conformité et l'analyse de contenu.
Installation
Ajoutez le PDF4me Ajoutez le nœud « Extraire les métadonnées d'un document Word » à votre n8n Suivez le flux de travail et configurez les paramètres requis. Pour les instructions de configuration initiale, consultez notre documentation. n8n Guide d'intégration.
Prérequis :
- PDF4me API informations d'identification
- n8n accès au flux de travail
Configuration:
- Ajouter PDF4me nœud vers flux de travail
- Sélectionnez l'action « Extraire les métadonnées du document Word ».
- Configurer les paramètres d'entrée (voir ci-dessous)

Paramètres
Liste complète des paramètres de l'action Extraire les métadonnées d'un document Word. Configurez ces paramètres pour contrôler le comportement d'extraction des métadonnées.
Important: Les paramètres marqués d'un astérisque (***) sont obligatoires. Les paramètres avancés permettent un contrôle précis de la mise en forme des métadonnées.
| Paramètre | Taper | Description | Exemple |
|---|---|---|---|
| Type de données d'entrée*** | String | Sélection du format d'entrée du document Word • Choisissez le format de vos données Word. • PDF4me prend en charge plusieurs types d'entrée • Options : Données binaires, Base64 Chaîne, ou URL | Binary Data |
| Champ binaire d'entrée*** | Binaire | Entrée de fichier Word binaire (Obligatoire si données binaires) • Fichier Word de référence (.docx, .doc) de la session précédente n8n Téléchargement de nœud ou de fichier • PDF4me traite les fichiers Word binaires avec détection automatique du format • Obligatoire lorsque le type de données d'entrée est « Données binaires » | {{ $binary.data }} |
| Contenu de mots en Base64*** | String | Base64 Saisie de mots encodés (Obligatoire si chaîne Base64) • Fournir le contenu Word (.docx, .doc) sous forme de chaîne encodée en base64 pour une transmission sécurisée • PDF4me décode et traite automatiquement le contenu Word • Obligatoire lorsque le type de données d'entrée est « Chaîne Base64 » | UEsDBBQABgAI... |
| URL du document Word*** | String | Document Word public URL Saisir (Obligatoire si URL) • Fournir une autorisation publique/ouverte URL au fichier Word (.docx, .doc) à traiter • PDF4me télécharge et traite le fichier Word à partir du fichier fourni URL • Obligatoire lorsque le type de données d'entrée est « URL » | https://abc.com/document.docx |
| Nom du document Word*** | String | Nom du fichier d'entrée du document Word • Spécifiez le nom du fichier Word d'entrée avec l'extension appropriée (.docx, .doc). • PDF4me utilise ceci pour la détection de format et l'optimisation du traitement | document.docx |
| Nom de la culture | String | Document Culture/Locale • Code de culture pour le formatage de la date et de l'heure (par exemple, « en-US », « de-DE », « fr-FR ») • Par défaut : InvariantCulture (mise en forme cohérente) • Affecte le format d'affichage de la date et de l'heure dans les métadonnées | en-US |
Sortir
Paramètres de sortie
| Paramètre | Taper | Description | Exemple |
|---|---|---|---|
| nom de fichier | String | Nom du fichier Word original - Le nom du fichier Word d'entrée | myWordFile.docx |
| succès | Boolean | PDF4me état de fonctionnement - Boolean Un indicateur signalant le succès ou l'échec de l'opération d'extraction des métadonnées. PDF4me retours true pour des opérations réussies et false pour toute erreur | true |
| nom de la culture | String | Code culturel/local - Code de culture utilisé pour le formatage de la date et de l'heure (par exemple, « en-US », « de-DE », « fr-FR ») | en-US |
| métadonnées | Object | Objet de métadonnées imbriqué - Contient la structure des métadonnées du document avec un objet de métadonnées imbriqué contenant toutes les propriétés du document, notamment : Auteur, Titre, Sujet, Mots clés, Commentaires, Catégorie, Société, Responsable, Date de création, Date de dernière modification, Date de dernière impression, Numéro de révision, Temps total d'édition, Pages, Mots, Caractères, Paragraphes | {"metadata": {"Author": "Ynoox Testtwo", "Company": "HP Inc.", "Words": 921}} |
| message | String | Message d'opération - Message descriptif indiquant le résultat de l'opération d'extraction des métadonnées | Word metadata extracted successfully |
N8N Réponse à l'action
Le PDF4me Extraire les métadonnées d'un document Word API renvoie une réponse pouvant être affichée dans plusieurs formats. Choisissez l'affichage qui correspond le mieux à vos besoins :
- JSON
- Table
- Schema
JSON Format de réponse
Le cru JSON réponse de la API:
[
{
"fileName": "myWordFile.docx",
"success": true,
"cultureName": "en-US",
"metadata": {
"document": null,
"fileName": null,
"success": true,
"errorMessage": null,
"metadata": {
"Author": "Ynoox Testtwo",
"Title": "",
"Subject": "",
"Keywords": "",
"Comments": "",
"Category": "",
"Company": "HP Inc.",
"Manager": "",
"Created": "5/16/2019 6:04:00 AM",
"LastModified": "8/7/2024 7:04:00 AM",
"LastPrinted": "5/16/2019 6:04:00 AM",
"RevisionNumber": 5,
"TotalEditingTime": 2,
"Pages": 3,
"Words": 921,
"Characters": 5256,
"Paragraphs": 12
}
},
"message": "Word metadata extracted successfully"
}
]
Vue tableau
Données de réponse présentées sous forme de tableau structuré :
| Paramètre | Valeur |
|---|---|
| fileName | myWordFile.docx |
| success | true |
| cultureName | en-US |
| metadata | Objet imbriqué contenant les métadonnées du document |
| message | Word metadata extracted successfully |
Structure de l'objet métadonnées :
| Paramètre | Valeur |
|---|---|
| document | null |
| fileName | null |
| success | true |
| errorMessage | null |
| metadata | Objet contenant les propriétés du document |
Propriétés du document (metadata.metadata) :
| Propriété | Valeur |
|---|---|
| Author | Ynoox Testtwo |
| Title | "" |
| Subject | "" |
| Keywords | "" |
| Comments | "" |
| Category | "" |
| Company | HP Inc. |
| Manager | "" |
| Created | 5/16/2019 6:04:00 AM |
| LastModified | 8/7/2024 7:04:00 AM |
| LastPrinted | 5/16/2019 6:04:00 AM |
| RevisionNumber | 5 |
| TotalEditingTime | 2 |
| Pages | 3 |
| Words | 921 |
| Characters | 5256 |
| Paragraphs | 12 |
Vue schématique
Structure des données et types de réponses :
1 item
fileName: T myWordFile.docx
success: ☑ true
cultureName: T en-US
metadata: {} Object
document: null
fileName: null
success: ☑ true
errorMessage: null
metadata: {} Object
Author: T Ynoox Testtwo
Title: T ""
Subject: T ""
Keywords: T ""
Comments: T ""
Category: T ""
Company: T HP Inc.
Manager: T ""
Created: T 5/16/2019 6:04:00 AM
LastModified: T 8/7/2024 7:04:00 AM
LastPrinted: T 5/16/2019 6:04:00 AM
RevisionNumber: # 5
TotalEditingTime: # 2
Pages: # 3
Words: # 921
Characters: # 5256
Paragraphs: # 12
message: T Word metadata extracted successfully
Indicateurs de type :
T= String (Texte)#= Nombre☑= Boolean[]= Array{}= Objectnull= Valeur nulle
Cas d'utilisation
Automatisation des documents d'entreprise
- Gestion documentaireExtraire les métadonnées pour l'organisation et le catalogage des documents
- Suivi de la conformitéSuivre les propriétés des documents pour assurer la conformité réglementaire
- Analyse de contenuAnalyser les statistiques et les propriétés des documents
- Recherche de documentsUtiliser les métadonnées pour la recherche et la récupération de documents
Traitement de documents par l'IA
- Prise en charge multiformatTraiter les documents Word aux formats .docx et .doc
- Traitement multilingue: Prise en charge de différentes langues et régions
- Extraction intelligente de métadonnéesExtraction automatique de toutes les propriétés du document
Veille stratégique et analyse de données
- Analyse de documentsAnalyser les propriétés et les statistiques des documents
- Surveillance de la conformité: S'assurer que les documents respectent les exigences en matière de métadonnées
- Indicateurs de performanceSuivre la précision et l'efficacité du traitement