Zum Hauptinhalt springen

Rohstoffe gewinnen PDF Verwendung n8n Aktion

PDF4me Rohstoffgewinnung extrahiert Textinhalte und eingebettete Bilder aus PDF Dokumente durch n8n Automatisierte Arbeitsabläufe. Prozess PDFs weg n8n Trigger, Binärdaten, Base64-Strings oder öffentliche URLDiese Lösung extrahiert automatisch Text, Bilder, Grafiken und visuelle Elemente seitenweise, mit selektiven Extraktionsoptionen (nur Text, nur Bilder oder beides) und strukturierter Ausgabeformatierung. Sie eignet sich ideal für die Wiederverwendung von Inhalten, die Bildextraktion, die Textanalyse, die Dokumentendigitalisierung, die Inhaltsmigration und Workflows zur Ressourcenwiederherstellung, die eine präzise Inhaltsextraktion mit flexibler Ausrichtung und nahtloser Integration erfordern.

Verwandte Blog-Beiträge
Zu dieser Funktion gibt es noch keinen Blogbeitrag – folgt in Kürze.
Schauen Sie sich in der Zwischenzeit im PDF4me-Blog Tutorials und Arbeitsabläufe für alle Plattformen an.
Besuchen Sie den Blog

Aufstellen

Füge die PDF4me Knoten "Ressourcen extrahieren" zu Ihrem n8n Führen Sie den Workflow durch und konfigurieren Sie die erforderlichen Parameter. Anweisungen zur Ersteinrichtung finden Sie in unserer [Website/Dokumentation/etc.]. n8n IntegrationsleitfadenDie

Voraussetzungen:

  • PDF4me API Zugangsdaten
  • n8n Workflow-Zugriff

Konfiguration:

  1. Hinzufügen PDF4me Knoten zum Workflow
  2. Wählen Sie die Aktion „Ressourcen extrahieren“ aus.
  3. Eingabeparameter konfigurieren (siehe unten)
Konfiguration zum Extrahieren von Ressourcen

Parameter

Vollständige Liste der Parameter für die Aktion „Ressourcen extrahieren“. Konfigurieren Sie diese Parameter, um die Ressourcenextraktion zu steuern.

Wichtig: Mit einem Sternchen (***) gekennzeichnete Parameter sind erforderlich und müssen angegeben werden, damit die Aktion ordnungsgemäß funktioniert.

ParameterTypBeschreibungBeispiel
Eingabedatentyp***StringPDF Auswahl des Eingabeformats
• Wählen Sie das Format Ihrer PDF Dateneingabe
PDF4me unterstützt mehrere Eingabetypen
• Optionen: Binärdaten, Base64 Zeichenkette oder URL
Binary Data
Binäres EingabefeldBinärBinär PDF Dateieingabe (Erforderlich bei Binärdaten)
• Referenz PDF Datei von vorheriger n8n Knoten- oder Datei-Upload
PDF4me Prozesse binär PDF Dateien mit automatischer Formaterkennung
• Erforderlich, wenn der Eingabedatentyp "Binärdaten" ist
{{ $binary.data }}
Base64-PDF-InhaltStringBase64 Kodiert PDF Eingabe (Erforderlich, wenn Base64 Zeichenkette)
• Bieten PDF Inhalt als Base64-kodierter String
PDF4me dekodiert und verarbeitet automatisch die PDF Inhalt
• Erforderlich, wenn der Eingabedatentyp "Base64 String"
JVBERi0x...
PDF-URLStringÖffentlich PDF URL Eingabe (Erforderlich, wenn URL)
• Eine öffentliche/offene Genehmigung einholen URL zum PDF Datei
PDF4me lädt die Datei herunter und verarbeitet sie von URL
• Erforderlich, wenn der Eingabedatentyp "URL"
https://abc.com/xyz.pdf
Dokumentenname***StringEingabedateiname
• Geben Sie den Namen der Eingabe an. PDF Datei
• Wird zur Formaterkennung und Verarbeitungsoptimierung verwendet
• Muss die Dateiendung .pdf enthalten.
document.pdf
Text aus dem Text extrahierenBooleanTextextraktion umschalten
• Textinhaltsextraktion aktivieren oder deaktivieren
• Wenn diese Option aktiviert ist, werden alle lesbaren Textinhalte extrahiert.
• Behält Formatierungsinformationen bei
true
Bilder extrahierenBooleanBildextraktion umschalten
• Bildextraktion aktivieren oder deaktivieren
• Wenn diese Option aktiviert ist, werden alle eingebetteten Bilder und Grafiken extrahiert.
• Visuelle Elemente als separate Dateien gespeichert
true

Erweiterte Optionen

Folgende Parameter stehen im Abschnitt „Erweiterte Optionen“ zur Verfügung und sind optional:

ParameterTypBeschreibungBeispiel
SeitenStringSeitenbereichsspezifikation
• Festlegen, welche Seiten zur Ressourcenextraktion verarbeitet werden sollen
• Verwenden Sie „alle“ für das gesamte Dokument, bestimmte Zahlen oder Bereiche.
• Beispiele: „1,3,5“ (bestimmte Seiten), „1-5,10-15“ (Bereiche)
all
Benutzerdefinierte ProfileStringBenutzerdefinierte Konfigurationsprofile
• Zusätzliche Optionen mithilfe benutzerdefinierter Profile festlegen
JSON-ähnliches Format mit vordefinierten Parametern
• Ermöglicht erweiterte Extraktionsverarbeitungseinstellungen
• Optional für spezielle Anforderungen
{ "outputDataFormat": "json" }

Ausgabe

Ausgabeparameter

ParameterTypBeschreibungBeispiel
DateinameStringPDF4me generierter Dateiname - Der vollständige Dateiname des erfolgreich verarbeiteten Dokuments mit korrekter Dateiendung und Zeitstempel. PDF4me gewährleistet eine eindeutige Benennung und validiert die Einhaltung des Dateiformats für eine nahtlose Integration mit nachgelagerten Prozessen.extracted_resources_1756999816629.json
MIME-TypStringPDF4me MIME Typbezeichner - Die standardisierte MIME Typ für die extrahierte Inhaltsdatei, typischerweise application/json für strukturierte Daten oder application/zip Dies gilt für mehrere Dateien und gewährleistet die korrekte Dateiverarbeitung und -erkennung in allen Systemen und Anwendungen.application/json
DateigrößeNummerPDF4me Dateigröße in Bytes Die genaue Größe der extrahierten Inhaltsdatei in Bytes wird für die Speicherplanung, Bandbreitenoptimierung und Überwachung von Dateiübertragungen bereitgestellt. Unverzichtbar für die Dokumentenverwaltung und Workflow-Automatisierung in Unternehmen.1945
ErfolgBooleanPDF4me Extraktionsstatusanzeige - Boolescher Wert, der den Erfolg oder Misserfolg des Ressourcenextraktionsprozesses angibt. Rückgabewert true für erfolgreiche Extraktionen und false für alle Fehler, wodurch eine robuste Fehlerbehandlung in automatisierten Arbeitsabläufen ermöglicht wirdtrue
NachrichtStringPDF4me Extraktionsstatusmeldung - Eine beschreibende Meldung, die das Ergebnis des Ressourcenextraktionsprozesses angibt. Sie liefert klare Statusmeldungen für erfolgreiche Extraktionen und detaillierte Fehlerinformationen zur Fehlerbehebung.Resource extraction completed successfully
docNameStringPDF4me Originaldokumentname-Referenz - Der ursprüngliche Dateiname der Eingabedatei PDF Die verarbeitete Datei. Diese Referenz wird für Prüfprotokolle, Debugging-Zwecke und die Nachverfolgung der Quelle extrahierter Inhalte in Unternehmensworkflows aufbewahrt.document.pdf

N8N Maßnahmenreaktion

Der PDF4me Rohstoffgewinnung API Die Antwort kann in verschiedenen Formaten angezeigt werden. Wählen Sie die Ansicht, die Ihren Bedürfnissen am besten entspricht:

JSON Antwortformat

Das Rohmaterial JSON Antwort von der API:

{
"fileName": "extracted_resources_1756999816629.json",
"mimeType": "application/json",
"fileSize": 1945,
"success": true,
"message": "Resource extraction completed successfully",
"docName": "document.pdf"
}

Anwendungsfälle

Content-Management-Systeme: Text und Bilder extrahieren aus PDF Dokumente für zentrale Inhaltsrepositorien, die durchsuchbare Datenbanken von Dokumentinhalten ermöglichen.

DatenverarbeitungspipelinesAutomatische Extraktion strukturierter Daten aus PDF Berichte, Rechnungen und Formulare zur Integration mit Business-Intelligence-Tools und Analyseplattformen.

Dokumentenanalyse: Große Mengen verarbeiten PDF Dokumente zur Gewinnung spezifischer Informationen für Compliance-Überwachung, Forschung und automatisierte Berichterstattung.

Archivdigitalisierung: Konvertierung älterer Systeme PDF Archive werden in durchsuchbare, strukturierte Daten für moderne Content-Management- und Wissensfindungssysteme umgewandelt.

Hilfe erhalten