Zum Hauptinhalt springen

Anhang extrahieren PDF Verwendung n8n Aktion

PDF4me Anhang extrahieren PDF extrahiert eingebettete Dateien von PDF Dokumente durch n8n Automatisierte Arbeitsabläufe. Prozess PDFs weg n8n Trigger, Binärdaten, Base64-Strings oder öffentliche URLs zur automatischen Erkennung und Extraktion von angehängten Dokumenten, Bildern, Tabellenkalkulationen, Datendateien und anderen eingebetteten Inhalten unter Beibehaltung der Dateiintegrität, Metadaten und Unterstützung mehrerer Formate (PDFDiese Lösung eignet sich ideal für Dokumentenanalyse, Dateiwiederherstellung, Beweissicherung, Anhangsverwaltung, Datenextraktions-Workflows und umfassende Dokumentenverarbeitung, die eine zuverlässige, eingebettete Dateiextraktion mit nahtloser Integration erfordern.

Verwandte Blog-Beiträge
Zu dieser Funktion gibt es noch keinen Blogbeitrag – folgt in Kürze.
Schauen Sie sich in der Zwischenzeit im PDF4me-Blog Tutorials und Arbeitsabläufe für alle Plattformen an.
Besuchen Sie den Blog

Aufstellen

Füge die PDF4me "Anhang extrahieren von PDF" Knoten zu Ihrem n8n Führen Sie den Workflow durch und konfigurieren Sie die erforderlichen Parameter. Anweisungen zur Ersteinrichtung finden Sie in unserer [Website/Dokumentation/etc.]. n8n IntegrationsleitfadenDie

Voraussetzungen:

  • PDF4me API Zugangsdaten
  • n8n Workflow-Zugriff

Konfiguration:

  1. Hinzufügen PDF4me Knoten zum Workflow
  2. Wählen Sie „Anhang extrahieren aus“ PDF" Aktion
  3. Eingabeparameter konfigurieren (siehe unten)
Anhang aus PDF extrahieren

Parameter

Vollständige Liste der Parameter für „Anhang extrahieren von“ PDF Aktion. Konfigurieren Sie diese Parameter, um die Extraktion von Anhängen zu steuern.

Wichtig: Mit einem Sternchen (***) gekennzeichnete Parameter sind erforderlich und müssen angegeben werden, damit die Aktion ordnungsgemäß funktioniert.

ParameterTypBeschreibungBeispiel
Eingabedatentyp***StringPDF Auswahl des Eingabeformats
• Wählen Sie das Format Ihrer PDF Dateneingabe
PDF4me unterstützt mehrere Eingabetypen
• Optionen: Binärdaten, Base64 Zeichenkette oder URL
Binary Data
Binäres EingabefeldBinärBinär PDF Dateieingabe (Erforderlich bei Binärdaten)
• Referenz PDF Datei von vorheriger n8n Knoten- oder Datei-Upload
PDF4me Prozesse binär PDF Dateien mit automatischer Formaterkennung
• Erforderlich, wenn der Eingabedatentyp "Binärdaten" ist
{{ $binary.data }}
Base64-DokumentinhaltStringBase64 Kodiert PDF Eingabe (Erforderlich, wenn Base64 Zeichenkette)
• Bieten PDF Daten als Base64-kodierter String
PDF4me dekodiert und verarbeitet automatisch die PDF Inhalt
• Erforderlich, wenn der Eingabedatentyp "Base64 String"
UEsDBBQABgAI...
Datei-URLStringÖffentlich PDF URL Eingabe (Erforderlich, wenn URL)
• Eine öffentliche/offene Genehmigung einholen URL zum PDF Datei
PDF4me lädt die Datei herunter und verarbeitet sie von URL
• Erforderlich, wenn der Eingabedatentyp "URL"
https://abc.com/sample.pdf
Dokumentenname***StringQuelle PDF Referenz
• Geben Sie den Namen der Quelle an. PDF Datei
• Zu Referenz- und Nachverfolgungszwecken bei der Extraktion
• Hilft bei der Nachverfolgung von Verarbeitungsprozessen
document.pdf

Erweiterte Optionen

Folgende Parameter stehen im Abschnitt „Erweiterte Optionen“ zur Verfügung und sind optional:

ParameterTypBeschreibungBeispiel
Benutzerdefinierte ProfileObjectExtraktionskonfiguration
• Erweitertes Konfigurationsobjekt zur Anpassung des Extraktionsverhaltens
• Unterstützt Ausgabeformate und Verarbeitungsoptionen
JSON Format für flexible Parameterspezifikation
• Optional für spezielle Anforderungen
{"outputDataFormat": "json", "extractMetadata": true}

Unterstützte Anbauteiltypen

KategorieDateitypenBeschreibung
UnterlagenPDF, DOC, DOCXTXT, RTF, ODTTextdokumente und Office-Dateien
BilderJPG, JPEG, PNG, GIF, BMP, TIFF, SVGBilddateien und Grafiken
TabellenkalkulationenXLS, XLSX, CSV, ODSDatendateien und Tabellenkalkulationen
DatenJSON, XML, HTML, CSSWeb- und Datendateien

Ausgabe

Ausgabeparameter

ParameterTypBeschreibungBeispiel
UnterlagenArrayPDF4me Referenz auf das Eingabedokument - Verweis auf die ursprünglich zur Extraktion verarbeiteten Eingabedokumente. Nullwert für diesen Vorgangstypnull
AusgabedokumenteArrayPDF4me extrahierte Anhänge - Array von erfolgreich extrahierten Anhangsobjekten, die Dateidaten, Metadaten und Eigenschaften aus der Quelle enthalten PDF dokumentieren[{"fileName": "sample.txt", "barcodeText": null, "docText": null, "image": null}]
traceIdStringPDF4me Verarbeitungsspur-Kennung - Eindeutige Trace-ID zur Nachverfolgung der Extraktionsanforderung durch PDF4meVerarbeitungspipeline für Debugging- und Prüfzweckenull
Job-IDStringPDF4me Auftragskennung - Eindeutige Auftrags-ID für den Extraktionsvorgang. Nullwert bei synchronen Vorgängen, Wert wird bei asynchroner Verarbeitung gesetzt.null
Status-URLStringPDF4me Statusverfolgung URL - URL zur Überprüfung des Status asynchroner Extraktionsvorgänge. Nullwert für synchrone Vorgänge.null
AbonnementnutzungObjectPDF4me Abonnementnutzungsdaten - Informationen über API Nutzung und Abonnementverbrauch für den Extraktionsvorgangnull
_metadataObjectPDF4me Betriebsmetadaten - Umfassendes Metadatenobjekt mit Verarbeitungsinformationen, Zeitstempeln und Details zum Vorgang{"success": true, "message": "Attachments extracted successfully"}
_metadata.successBooleanPDF4me Extraktionsstatusanzeige - Boolean Flagge, die den Erfolg oder Misserfolg des Extraktionsprozesses des Anhangs anzeigt. PDF4me Rückgaben true für erfolgreiche Extraktionen und false für etwaige Fehlertrue
_metadata.messageStringPDF4me Extraktionsstatusmeldung - Eine für Menschen lesbare Statusmeldung mit Details zum Ergebnis des Extraktionsprozesses. Enthält eine Erfolgsbestätigung oder Fehlerdetails zur Fehlerbehebung.Attachments extracted successfully
_metadata.processingTimestampStringPDF4me Verarbeitungszeitstempel - ISO 8601-Zeitstempel, der angibt, wann der Extraktionsvorgang abgeschlossen wurde von PDF4me's Extraktionsmaschine2025-09-23T20:04:09.290Z
_metadata.sourceFileNameStringPDF4me Dateiname des Quelldokuments - Ursprünglicher Dateiname der PDF Dokument, das zur Extraktion von Anhängen verarbeitet wurdedocument.pdf
_metadata.operationStringPDF4me Operationsart - Art der durchgeführten Operation PDF4me'S APIVerwenden Sie für diese Aktion immer "extractAttachmentFromPdf".extractAttachmentFromPdf

Struktur des extrahierten Anhangsobjekts

FeldTypBeschreibungBeispiel
DateinameStringPDF4me extrahierter Dateiname - Ursprünglicher Dateiname des extrahierten Anhangs, wie er in der Quelle erscheint PDF dokumentierensample.txt
BarcodeTextStringPDF4me Barcode-Inhalt - Der aus den im Anhang gefundenen Barcodes extrahierte Textinhalt. Null, falls keine Barcodes vorhanden sind.null
docTextStringPDF4me Dokumenttextinhalt - Aus der angehängten Datei extrahierter Textinhalt. Null, falls es sich bei dem Anhang nicht um ein Textdokument handelt.null
BildStringPDF4me Bilddaten - Base64 Kodierte Bilddaten, falls es sich bei dem Anhang um eine Bilddatei handelt. Nullwert für Nicht-Bild-Anhänge.null

N8N Maßnahmenreaktion

Der PDF4me Anhang extrahieren PDF API Die Antwort kann in verschiedenen Formaten angezeigt werden. Wählen Sie die Ansicht, die Ihren Bedürfnissen am besten entspricht:

JSON Antwortformat

Das Rohmaterial JSON Antwort von der API:

[
{
"documents": null,
"outputDocuments": [
{
"fileName": "sample.txt",
"barcodeText": null,
"docText": null,
"image": null
}
],
"traceId": null,
"jobId": null,
"statusUrl": null,
"subscriptionUsage": null,
"_metadata": {
"success": true,
"message": "Attachments extracted successfully",
"processingTimestamp": "2025-09-23T20:04:09.290Z",
"sourceFileName": "document.pdf",
"operation": "extractAttachmentFromPdf"
}
}
]

Anwendungsfälle

Wiederherstellung von Dokumentinhalten

  • Wiederherstellung eingebetteter DateienVerwenden Sie die outputDocuments Array zur Wiederherstellung von Dateien, die eingebettet waren PDF Dokumente, Wiederherstellung des Zugangs zu den Originalquellen
  • Dateinamenwiederherstellung: Originale Dateinamen aus dem extrahieren fileName Feld zur Aufrechterhaltung einer ordnungsgemäßen Dateiidentifizierung und -organisation
  • Wiederherstellung verlorener Dokumente: Dokumente wiederherstellen, die zuvor eingebettet waren in PDFsind aber nicht mehr in ihren Originalformaten erhältlich.

Inhaltsverarbeitung und -analyse

  • Bindungsanalyse: Einzelne Dateien aus dem outputDocuments Sammlung zum Analysieren von Inhalten, Extrahieren von Daten oder Durchführen spezifischer Operationen an jedem Dateityp
  • Barcode-VerarbeitungNutzen Sie die barcodeText Feld zum Extrahieren und Verarbeiten von Barcode-Informationen aus Anhängen für Inventarisierungs-, Verfolgungs- oder Identifizierungszwecke
  • Extraktion von TextinhaltenNutzen Sie die docText Feld zum Extrahieren von Textinhalten aus Dokumentanhängen für Such-, Analyse- oder Datenverarbeitungs-Workflows

Workflow-Automatisierung und -Integration

  • DateiverteilungAutomatische Verteilung extrahierter Anhänge an die entsprechenden Systeme, Ordner oder Benutzer basierend auf Dateityp- und Inhaltsanalyse
  • InhaltsarchivierungVerwenden Sie die _metadata.traceId und Extraktionsergebnisse, um Prüfprotokolle zu führen und gleichzeitig die extrahierten Dateien in strukturierten Archivsystemen zu organisieren.
  • Multisystemintegration: Integration der extrahierten Dateien in externe Dokumentenmanagementsysteme, Cloud-Speicherplattformen oder Geschäftsanwendungen

Hilfe erhalten