Rohstoffe gewinnen PDF Verwendung n8n Aktion
PDF4me Rohstoffgewinnung extrahiert Textinhalte und eingebettete Bilder aus PDF Dokumente durch n8n Automatisierte Arbeitsabläufe. Prozess PDFs weg n8n Trigger, Binärdaten, Base64-Strings oder öffentliche URLDiese Lösung extrahiert automatisch Text, Bilder, Grafiken und visuelle Elemente seitenweise, mit selektiven Extraktionsoptionen (nur Text, nur Bilder oder beides) und strukturierter Ausgabeformatierung. Sie eignet sich ideal für die Wiederverwendung von Inhalten, die Bildextraktion, die Textanalyse, die Dokumentendigitalisierung, die Inhaltsmigration und Workflows zur Ressourcenwiederherstellung, die eine präzise Inhaltsextraktion mit flexibler Ausrichtung und nahtloser Integration erfordern.
Aufstellen
Füge die PDF4me Knoten "Ressourcen extrahieren" zu Ihrem n8n Führen Sie den Workflow durch und konfigurieren Sie die erforderlichen Parameter. Anweisungen zur Ersteinrichtung finden Sie in unserer [Website/Dokumentation/etc.]. n8n IntegrationsleitfadenDie
Voraussetzungen:
- PDF4me API Zugangsdaten
- n8n Workflow-Zugriff
Konfiguration:
- Hinzufügen PDF4me Knoten zum Workflow
- Wählen Sie die Aktion „Ressourcen extrahieren“ aus.
- Eingabeparameter konfigurieren (siehe unten)

Parameter
Vollständige Liste der Parameter für die Aktion „Ressourcen extrahieren“. Konfigurieren Sie diese Parameter, um die Ressourcenextraktion zu steuern.
Wichtig: Mit einem Sternchen (***) gekennzeichnete Parameter sind erforderlich und müssen angegeben werden, damit die Aktion ordnungsgemäß funktioniert.
| Parameter | Typ | Beschreibung | Beispiel |
|---|---|---|---|
| Eingabedatentyp*** | String | PDF Auswahl des Eingabeformats • Wählen Sie das Format Ihrer PDF Dateneingabe • PDF4me unterstützt mehrere Eingabetypen • Optionen: Binärdaten, Base64 Zeichenkette oder URL | Binary Data |
| Binäres Eingabefeld | Binär | Binär PDF Dateieingabe (Erforderlich bei Binärdaten) • Referenz PDF Datei von vorheriger n8n Knoten- oder Datei-Upload • PDF4me Prozesse binär PDF Dateien mit automatischer Formaterkennung • Erforderlich, wenn der Eingabedatentyp "Binärdaten" ist | {{ $binary.data }} |
| Base64-PDF-Inhalt | String | Base64 Kodiert PDF Eingabe (Erforderlich, wenn Base64 Zeichenkette) • Bieten PDF Inhalt als Base64-kodierter String • PDF4me dekodiert und verarbeitet automatisch die PDF Inhalt • Erforderlich, wenn der Eingabedatentyp "Base64 String" | JVBERi0x... |
| PDF-URL | String | Öffentlich PDF URL Eingabe (Erforderlich, wenn URL) • Eine öffentliche/offene Genehmigung einholen URL zum PDF Datei • PDF4me lädt die Datei herunter und verarbeitet sie von URL • Erforderlich, wenn der Eingabedatentyp "URL" | https://abc.com/xyz.pdf |
| Dokumentenname*** | String | Eingabedateiname • Geben Sie den Namen der Eingabe an. PDF Datei • Wird zur Formaterkennung und Verarbeitungsoptimierung verwendet • Muss die Dateiendung .pdf enthalten. | document.pdf |
| Text aus dem Text extrahieren | Boolean | Textextraktion umschalten • Textinhaltsextraktion aktivieren oder deaktivieren • Wenn diese Option aktiviert ist, werden alle lesbaren Textinhalte extrahiert. • Behält Formatierungsinformationen bei | true |
| Bilder extrahieren | Boolean | Bildextraktion umschalten • Bildextraktion aktivieren oder deaktivieren • Wenn diese Option aktiviert ist, werden alle eingebetteten Bilder und Grafiken extrahiert. • Visuelle Elemente als separate Dateien gespeichert | true |
Erweiterte Optionen
Folgende Parameter stehen im Abschnitt „Erweiterte Optionen“ zur Verfügung und sind optional:
| Parameter | Typ | Beschreibung | Beispiel |
|---|---|---|---|
| Seiten | String | Seitenbereichsspezifikation • Festlegen, welche Seiten zur Ressourcenextraktion verarbeitet werden sollen • Verwenden Sie „alle“ für das gesamte Dokument, bestimmte Zahlen oder Bereiche. • Beispiele: „1,3,5“ (bestimmte Seiten), „1-5,10-15“ (Bereiche) | all |
| Benutzerdefinierte Profile | String | Benutzerdefinierte Konfigurationsprofile • Zusätzliche Optionen mithilfe benutzerdefinierter Profile festlegen • JSON-ähnliches Format mit vordefinierten Parametern • Ermöglicht erweiterte Extraktionsverarbeitungseinstellungen • Optional für spezielle Anforderungen | { "outputDataFormat": "json" } |
Ausgabe
Ausgabeparameter
| Parameter | Typ | Beschreibung | Beispiel |
|---|---|---|---|
| Dateiname | String | PDF4me generierter Dateiname - Der vollständige Dateiname des erfolgreich verarbeiteten Dokuments mit korrekter Dateiendung und Zeitstempel. PDF4me gewährleistet eine eindeutige Benennung und validiert die Einhaltung des Dateiformats für eine nahtlose Integration mit nachgelagerten Prozessen. | extracted_resources_1756999816629.json |
| MIME-Typ | String | PDF4me MIME Typbezeichner - Die standardisierte MIME Typ für die extrahierte Inhaltsdatei, typischerweise application/json für strukturierte Daten oder application/zip Dies gilt für mehrere Dateien und gewährleistet die korrekte Dateiverarbeitung und -erkennung in allen Systemen und Anwendungen. | application/json |
| Dateigröße | Nummer | PDF4me Dateigröße in Bytes Die genaue Größe der extrahierten Inhaltsdatei in Bytes wird für die Speicherplanung, Bandbreitenoptimierung und Überwachung von Dateiübertragungen bereitgestellt. Unverzichtbar für die Dokumentenverwaltung und Workflow-Automatisierung in Unternehmen. | 1945 |
| Erfolg | Boolean | PDF4me Extraktionsstatusanzeige - Boolescher Wert, der den Erfolg oder Misserfolg des Ressourcenextraktionsprozesses angibt. Rückgabewert true für erfolgreiche Extraktionen und false für alle Fehler, wodurch eine robuste Fehlerbehandlung in automatisierten Arbeitsabläufen ermöglicht wird | true |
| Nachricht | String | PDF4me Extraktionsstatusmeldung - Eine beschreibende Meldung, die das Ergebnis des Ressourcenextraktionsprozesses angibt. Sie liefert klare Statusmeldungen für erfolgreiche Extraktionen und detaillierte Fehlerinformationen zur Fehlerbehebung. | Resource extraction completed successfully |
| docName | String | PDF4me Originaldokumentname-Referenz - Der ursprüngliche Dateiname der Eingabedatei PDF Die verarbeitete Datei. Diese Referenz wird für Prüfprotokolle, Debugging-Zwecke und die Nachverfolgung der Quelle extrahierter Inhalte in Unternehmensworkflows aufbewahrt. | document.pdf |
N8N Maßnahmenreaktion
Der PDF4me Rohstoffgewinnung API Die Antwort kann in verschiedenen Formaten angezeigt werden. Wählen Sie die Ansicht, die Ihren Bedürfnissen am besten entspricht:
- JSON
- Table
- Schema
- Binary
JSON Antwortformat
Das Rohmaterial JSON Antwort von der API:
{
"fileName": "extracted_resources_1756999816629.json",
"mimeType": "application/json",
"fileSize": 1945,
"success": true,
"message": "Resource extraction completed successfully",
"docName": "document.pdf"
}
Tabellenansicht
Antwortdaten in strukturierter Tabellenform:
| Parameter | Wert |
|---|---|
| fileName | extracted_resources_1756999816629.json |
| mimeType | application/json |
| fileSize | 1945 |
| success | true |
| docName | document.pdf |
| message | Resource extraction completed successfully |
Schemaansicht
Die Datenstruktur und die Datentypen der Antwort:
fileName: AB extracted_resources_1756999816629.json
mimeType: AB application/json
fileSize: # 1945
success: ✓ true
docName: AB document.pdf
message: AB Resource extraction completed successfully
Typenindikatoren:
AB= String#= Zahl✓= Boolean
Binärdatenansicht
Die tatsächlich extrahierten Inhaltsdaten und Metadaten:
data
─────────────────────────────────────────
File Name: extracted_resources_1756999816629.json
File Extension: json
Mime Type: application/json
File Size: 1.9 KB
Anwendungsfälle
Content-Management-Systeme: Text und Bilder extrahieren aus PDF Dokumente für zentrale Inhaltsrepositorien, die durchsuchbare Datenbanken von Dokumentinhalten ermöglichen.
DatenverarbeitungspipelinesAutomatische Extraktion strukturierter Daten aus PDF Berichte, Rechnungen und Formulare zur Integration mit Business-Intelligence-Tools und Analyseplattformen.
Dokumentenanalyse: Große Mengen verarbeiten PDF Dokumente zur Gewinnung spezifischer Informationen für Compliance-Überwachung, Forschung und automatisierte Berichterstattung.
Archivdigitalisierung: Konvertierung älterer Systeme PDF Archive werden in durchsuchbare, strukturierte Daten für moderne Content-Management- und Wissensfindungssysteme umgewandelt.