Metadaten aus Word-Dokument extrahieren n8n Aktion
PDF4me Metadaten aus einem Word-Dokument extrahieren ermöglicht das Extrahieren umfassender Metadaten und Eigenschaften aus Word-Dokumenten durch n8n Automatisierte Workflows mit detaillierten Dokumentenanalysefunktionen. Diese leistungsstarke Metadatenextraktionsfunktion unterstützt integrierte Dokumenteigenschaften, benutzerdefinierte Eigenschaften, Dokumentstatistiken, Autoreninformationen, Erstellungsdaten und Revisionsverfolgung mit kulturspezifischer Formatierung und Lokalisierungsunterstützung – ideal für Dokumentenmanagement, Compliance-Überwachung und Inhaltsanalyse-Workflows.
Aufstellen
Füge die PDF4me Knoten "Metadaten aus Word-Dokument extrahieren" zu Ihrem n8n Führen Sie den Workflow durch und konfigurieren Sie die erforderlichen Parameter. Anweisungen zur Ersteinrichtung finden Sie in unserer [Website/Dokumentation/etc.]. n8n IntegrationsleitfadenDie
Voraussetzungen:
- PDF4me API Zugangsdaten
- n8n Workflow-Zugriff
Konfiguration:
- Hinzufügen PDF4me Knoten zum Workflow
- Wählen Sie die Aktion „Metadaten aus Word-Dokument extrahieren“.
- Eingabeparameter konfigurieren (siehe unten)

Parameter
Vollständige Liste der Parameter für die Aktion „Metadaten aus Word-Dokument extrahieren“. Konfigurieren Sie diese Parameter, um das Verhalten der Metadatenextraktion zu steuern.
Wichtig: Mit einem Sternchen (***) gekennzeichnete Parameter sind Pflichtfelder. Erweiterte Parameter ermöglichen eine detaillierte Steuerung der Metadatenformatierung.
| Parameter | Typ | Beschreibung | Beispiel |
|---|---|---|---|
| Eingabedatentyp*** | String | Auswahl des Eingabeformats für Word-Dokumente • Wählen Sie das Format für die Dateneingabe in Ihr Word-Dokument. • PDF4me unterstützt mehrere Eingabetypen • Optionen: Binärdaten, Base64 Zeichenkette oder URL | Binary Data |
| Binäres Eingabefeld*** | Binär | Eingabe einer Binär-Word-Datei (Erforderlich bei Binärdaten) • Referenz-Word-Datei (.docx, .doc) aus dem vorherigen n8n Knoten- oder Datei-Upload • PDF4me verarbeitet binäre Word-Dateien mit automatischer Formaterkennung • Erforderlich, wenn der Eingabedatentyp "Binärdaten" ist | {{ $binary.data }} |
| Base64-Wortinhalt*** | String | Base64 Eingabe kodierter Wörter (Erforderlich bei Base64-String) • Stellen Sie den Word-Inhalt (.docx, .doc) als Base64-kodierte Zeichenkette für eine sichere Übertragung bereit. • PDF4me Dekodiert und verarbeitet automatisch den Word-Inhalt • Erforderlich, wenn der Eingabedatentyp "Base64 String" ist | UEsDBBQABgAI... |
| URL des Word-Dokuments*** | String | Öffentliches Word-Dokument URL Eingabe (Erforderlich, falls URL) • Eine öffentliche/offene Genehmigung einholen URL zur Verarbeitung in die Word-Datei (.docx, .doc) umwandeln. • PDF4me Lädt die Word-Datei von der bereitgestellten Quelle herunter und verarbeitet sie. URL • Erforderlich, wenn der Eingabedatentyp "URL" ist | https://abc.com/document.docx |
| Name des Word-Dokuments*** | String | Word-Dokument-Eingabedateiname • Geben Sie den Namen der Word-Eingabedatei mit der entsprechenden Dateiendung (.docx, .doc) an. • PDF4me nutzt dies zur Formaterkennung und Verarbeitungsoptimierung | document.docx |
| Kulturname | String | Dokumentkultur/Lokalisierung • Kulturcode für die Datums-/Zeitformatierung (z. B. "en-US", "de-DE", "fr-FR") • Standard: InvariantCulture (einheitliche Formatierung) • Beeinflusst das Datums-/Zeitformat in den Metadaten | en-US |
Ausgabe
Ausgabeparameter
| Parameter | Typ | Beschreibung | Beispiel |
|---|---|---|---|
| Dateiname | String | Dateiname des ursprünglichen Word-Dokuments - Der Name der Word-Eingabedatei | myWordFile.docx |
| Erfolg | Boolean | PDF4me Betriebsstatus - Boolean Flagge, die den Erfolg oder Misserfolg der Metadatenextraktion anzeigt. PDF4me Rückgaben true für einen erfolgreichen Betrieb und false für etwaige Fehler | true |
| Kulturname | String | Kultur-/Lokalisierungscode - Kulturcode für die Datums-/Zeitformatierung (z. B. "en-US", "de-DE", "fr-FR") | en-US |
| Metadaten | Object | Verschachteltes Metadatenobjekt - Enthält eine Dokumentmetadatenstruktur mit verschachtelten Metadatenobjekten, die alle Dokumenteigenschaften enthalten, darunter Autor, Titel, Betreff, Stichwörter, Kommentare, Kategorie, Firma, Vorgesetzter, Erstellungsdatum, Letzte Änderung, Letzter Druck, Revisionsnummer, Gesamtbearbeitungszeit, Seiten, Wörter, Zeichen, Absätze | {"metadata": {"Author": "Ynoox Testtwo", "Company": "HP Inc.", "Words": 921}} |
| Nachricht | String | Operationsmeldung - Beschreibende Meldung, die das Ergebnis der Metadatenextraktion angibt | Word metadata extracted successfully |
N8N Maßnahmenreaktion
Der PDF4me Metadaten aus einem Word-Dokument extrahieren API Die Antwort kann in verschiedenen Formaten angezeigt werden. Wählen Sie die Ansicht, die Ihren Bedürfnissen am besten entspricht:
- JSON
- Table
- Schema
JSON Antwortformat
Das Rohmaterial JSON Antwort von der API:
[
{
"fileName": "myWordFile.docx",
"success": true,
"cultureName": "en-US",
"metadata": {
"document": null,
"fileName": null,
"success": true,
"errorMessage": null,
"metadata": {
"Author": "Ynoox Testtwo",
"Title": "",
"Subject": "",
"Keywords": "",
"Comments": "",
"Category": "",
"Company": "HP Inc.",
"Manager": "",
"Created": "5/16/2019 6:04:00 AM",
"LastModified": "8/7/2024 7:04:00 AM",
"LastPrinted": "5/16/2019 6:04:00 AM",
"RevisionNumber": 5,
"TotalEditingTime": 2,
"Pages": 3,
"Words": 921,
"Characters": 5256,
"Paragraphs": 12
}
},
"message": "Word metadata extracted successfully"
}
]
Tabellenansicht
Antwortdaten in strukturierter Tabellenform:
| Parameter | Wert |
|---|---|
| fileName | myWordFile.docx |
| success | true |
| cultureName | en-US |
| metadata | Verschachteltes Objekt, das Dokumentmetadaten enthält |
| message | Word metadata extracted successfully |
Metadatenobjektstruktur:
| Parameter | Wert |
|---|---|
| dokumentieren | null |
| fileName | null |
| success | true |
| errorMessage | null |
| metadata | Objekt, das Dokumenteigenschaften enthält |
Dokumenteigenschaften (metadata.metadata):
| Eigentum | Wert |
|---|---|
| Author | Ynoox Testtwo |
| Title | "" |
| Subject | "" |
| Keywords | "" |
| Comments | "" |
| Category | "" |
| Company | HP Inc. |
| Manager | "" |
| Created | 5/16/2019 6:04:00 AM |
| LastModified | 8/7/2024 7:04:00 AM |
| LastPrinted | 5/16/2019 6:04:00 AM |
| RevisionNumber | 5 |
| TotalEditingTime | 2 |
| Pages | 3 |
| Words | 921 |
| Characters | 5256 |
| Paragraphs | 12 |
Schemaansicht
Die Datenstruktur und die Datentypen der Antwort:
1 item
fileName: T myWordFile.docx
success: ☑ true
cultureName: T en-US
metadata: {} Object
document: null
fileName: null
success: ☑ true
errorMessage: null
metadata: {} Object
Author: T Ynoox Testtwo
Title: T ""
Subject: T ""
Keywords: T ""
Comments: T ""
Category: T ""
Company: T HP Inc.
Manager: T ""
Created: T 5/16/2019 6:04:00 AM
LastModified: T 8/7/2024 7:04:00 AM
LastPrinted: T 5/16/2019 6:04:00 AM
RevisionNumber: # 5
TotalEditingTime: # 2
Pages: # 3
Words: # 921
Characters: # 5256
Paragraphs: # 12
message: T Word metadata extracted successfully
Typenindikatoren:
T= String (Text)#= Zahl☑= Boolean[]= Array{}= Objectnull= Nullwert
Anwendungsfälle
Enterprise Document Automation
- Dokumentenmanagement: Metadaten für die Dokumentenorganisation und -katalogisierung extrahieren
- Compliance-Überwachung: Dokumenteigenschaften zur Sicherstellung der Einhaltung gesetzlicher Vorschriften verfolgen
- Inhaltsanalyse: Dokumentstatistiken und -eigenschaften analysieren
- Dokumentensuche: Metadaten für die Dokumentensuche und den Dokumentenabruf verwenden
KI-gestützte Dokumentenverarbeitung
- Unterstützung mehrerer Formate: Word-Dokumente in den Formaten .docx und .doc verarbeiten
- Mehrsprachige VerarbeitungUnterstützung für verschiedene Sprachen und Regionen
- Intelligente MetadatenextraktionAutomatische Extraktion aller Dokumenteigenschaften
Business Intelligence und Analytik
- Dokumentenanalyse: Dokumenteigenschaften und Statistiken analysieren
- Überwachung der Einhaltung: Sicherstellen, dass die Dokumente die Metadatenanforderungen erfüllen
- Leistungskennzahlen: Genauigkeit und Effizienz der Verarbeitung verfolgen