Zum Hauptinhalt springen

Metadaten aus Word-Dokument extrahieren n8n Aktion

PDF4me Metadaten aus einem Word-Dokument extrahieren ermöglicht das Extrahieren umfassender Metadaten und Eigenschaften aus Word-Dokumenten durch n8n Automatisierte Workflows mit detaillierten Dokumentenanalysefunktionen. Diese leistungsstarke Metadatenextraktionsfunktion unterstützt integrierte Dokumenteigenschaften, benutzerdefinierte Eigenschaften, Dokumentstatistiken, Autoreninformationen, Erstellungsdaten und Revisionsverfolgung mit kulturspezifischer Formatierung und Lokalisierungsunterstützung – ideal für Dokumentenmanagement, Compliance-Überwachung und Inhaltsanalyse-Workflows.

Verwandte Blog-Beiträge
Zu dieser Funktion gibt es noch keinen Blogbeitrag – folgt in Kürze.
Schauen Sie sich in der Zwischenzeit im PDF4me-Blog Tutorials und Arbeitsabläufe für alle Plattformen an.
Besuchen Sie den Blog

Aufstellen

Füge die PDF4me Knoten "Metadaten aus Word-Dokument extrahieren" zu Ihrem n8n Führen Sie den Workflow durch und konfigurieren Sie die erforderlichen Parameter. Anweisungen zur Ersteinrichtung finden Sie in unserer [Website/Dokumentation/etc.]. n8n IntegrationsleitfadenDie

Voraussetzungen:

  • PDF4me API Zugangsdaten
  • n8n Workflow-Zugriff

Konfiguration:

  1. Hinzufügen PDF4me Knoten zum Workflow
  2. Wählen Sie die Aktion „Metadaten aus Word-Dokument extrahieren“.
  3. Eingabeparameter konfigurieren (siehe unten)
Metadaten aus einem Word-Dokument extrahieren

Parameter

Vollständige Liste der Parameter für die Aktion „Metadaten aus Word-Dokument extrahieren“. Konfigurieren Sie diese Parameter, um das Verhalten der Metadatenextraktion zu steuern.

Wichtig: Mit einem Sternchen (***) gekennzeichnete Parameter sind Pflichtfelder. Erweiterte Parameter ermöglichen eine detaillierte Steuerung der Metadatenformatierung.

ParameterTypBeschreibungBeispiel
Eingabedatentyp***StringAuswahl des Eingabeformats für Word-Dokumente
• Wählen Sie das Format für die Dateneingabe in Ihr Word-Dokument.
PDF4me unterstützt mehrere Eingabetypen
• Optionen: Binärdaten, Base64 Zeichenkette oder URL
Binary Data
Binäres Eingabefeld***BinärEingabe einer Binär-Word-Datei (Erforderlich bei Binärdaten)
• Referenz-Word-Datei (.docx, .doc) aus dem vorherigen n8n Knoten- oder Datei-Upload
PDF4me verarbeitet binäre Word-Dateien mit automatischer Formaterkennung
• Erforderlich, wenn der Eingabedatentyp "Binärdaten" ist
{{ $binary.data }}
Base64-Wortinhalt***StringBase64 Eingabe kodierter Wörter (Erforderlich bei Base64-String)
• Stellen Sie den Word-Inhalt (.docx, .doc) als Base64-kodierte Zeichenkette für eine sichere Übertragung bereit.
PDF4me Dekodiert und verarbeitet automatisch den Word-Inhalt
• Erforderlich, wenn der Eingabedatentyp "Base64 String" ist
UEsDBBQABgAI...
URL des Word-Dokuments***StringÖffentliches Word-Dokument URL Eingabe (Erforderlich, falls URL)
• Eine öffentliche/offene Genehmigung einholen URL zur Verarbeitung in die Word-Datei (.docx, .doc) umwandeln.
PDF4me Lädt die Word-Datei von der bereitgestellten Quelle herunter und verarbeitet sie. URL
• Erforderlich, wenn der Eingabedatentyp "URL" ist
https://abc.com/document.docx
Name des Word-Dokuments***StringWord-Dokument-Eingabedateiname
• Geben Sie den Namen der Word-Eingabedatei mit der entsprechenden Dateiendung (.docx, .doc) an.
PDF4me nutzt dies zur Formaterkennung und Verarbeitungsoptimierung
document.docx
KulturnameStringDokumentkultur/Lokalisierung
• Kulturcode für die Datums-/Zeitformatierung (z. B. "en-US", "de-DE", "fr-FR")
• Standard: InvariantCulture (einheitliche Formatierung)
• Beeinflusst das Datums-/Zeitformat in den Metadaten
en-US

Ausgabe

Ausgabeparameter

ParameterTypBeschreibungBeispiel
DateinameStringDateiname des ursprünglichen Word-Dokuments - Der Name der Word-EingabedateimyWordFile.docx
ErfolgBooleanPDF4me Betriebsstatus - Boolean Flagge, die den Erfolg oder Misserfolg der Metadatenextraktion anzeigt. PDF4me Rückgaben true für einen erfolgreichen Betrieb und false für etwaige Fehlertrue
KulturnameStringKultur-/Lokalisierungscode - Kulturcode für die Datums-/Zeitformatierung (z. B. "en-US", "de-DE", "fr-FR")en-US
MetadatenObjectVerschachteltes Metadatenobjekt - Enthält eine Dokumentmetadatenstruktur mit verschachtelten Metadatenobjekten, die alle Dokumenteigenschaften enthalten, darunter Autor, Titel, Betreff, Stichwörter, Kommentare, Kategorie, Firma, Vorgesetzter, Erstellungsdatum, Letzte Änderung, Letzter Druck, Revisionsnummer, Gesamtbearbeitungszeit, Seiten, Wörter, Zeichen, Absätze{"metadata": {"Author": "Ynoox Testtwo", "Company": "HP Inc.", "Words": 921}}
NachrichtStringOperationsmeldung - Beschreibende Meldung, die das Ergebnis der Metadatenextraktion angibtWord metadata extracted successfully

N8N Maßnahmenreaktion

Der PDF4me Metadaten aus einem Word-Dokument extrahieren API Die Antwort kann in verschiedenen Formaten angezeigt werden. Wählen Sie die Ansicht, die Ihren Bedürfnissen am besten entspricht:

JSON Antwortformat

Das Rohmaterial JSON Antwort von der API:

[
{
"fileName": "myWordFile.docx",
"success": true,
"cultureName": "en-US",
"metadata": {
"document": null,
"fileName": null,
"success": true,
"errorMessage": null,
"metadata": {
"Author": "Ynoox Testtwo",
"Title": "",
"Subject": "",
"Keywords": "",
"Comments": "",
"Category": "",
"Company": "HP Inc.",
"Manager": "",
"Created": "5/16/2019 6:04:00 AM",
"LastModified": "8/7/2024 7:04:00 AM",
"LastPrinted": "5/16/2019 6:04:00 AM",
"RevisionNumber": 5,
"TotalEditingTime": 2,
"Pages": 3,
"Words": 921,
"Characters": 5256,
"Paragraphs": 12
}
},
"message": "Word metadata extracted successfully"
}
]

Anwendungsfälle

Enterprise Document Automation

  • Dokumentenmanagement: Metadaten für die Dokumentenorganisation und -katalogisierung extrahieren
  • Compliance-Überwachung: Dokumenteigenschaften zur Sicherstellung der Einhaltung gesetzlicher Vorschriften verfolgen
  • Inhaltsanalyse: Dokumentstatistiken und -eigenschaften analysieren
  • Dokumentensuche: Metadaten für die Dokumentensuche und den Dokumentenabruf verwenden

KI-gestützte Dokumentenverarbeitung

  • Unterstützung mehrerer Formate: Word-Dokumente in den Formaten .docx und .doc verarbeiten
  • Mehrsprachige VerarbeitungUnterstützung für verschiedene Sprachen und Regionen
  • Intelligente MetadatenextraktionAutomatische Extraktion aller Dokumenteigenschaften

Business Intelligence und Analytik

  • Dokumentenanalyse: Dokumenteigenschaften und Statistiken analysieren
  • Überwachung der Einhaltung: Sicherstellen, dass die Dokumente die Metadatenanforderungen erfüllen
  • Leistungskennzahlen: Genauigkeit und Effizienz der Verarbeitung verfolgen

Hilfe erhalten