Konvertieren PDF zu bearbeitbar PDF Verwendung OCR Verwendung n8n Aktion
PDF4me Konvertieren PDF zu bearbeitbar PDF Verwendung OCR transformiert gescannt PDFs und bildbasierte Dokumente in durchsuchbare, bearbeitbare PDFs durch n8n Automatisierte Arbeitsabläufe. Prozess PDFs weg n8n Trigger, Binärdaten, Base64-Strings oder öffentliche URLs zu bewerben OCR Technologie mit Mehrsprachigkeitsunterstützung, Auswahl der Qualitätsstufe (Entwurf/Hoch), bedingte OCR Verarbeitung, Erstellung von Textebenen, Layout-Erhaltung und Generierung durchsuchbarer Inhalte. Diese Lösung eignet sich ideal für die Dokumentendigitalisierung, die Verarbeitung gescannter Dokumente und die Rechnungserstellung. OCRArchivkonvertierung, durchsuchbar PDF Erstellung und automatisierte OCR Arbeitsabläufe, die eine präzise Texterkennung unter Beibehaltung der Formatierung und nahtlose Integration erfordern.
Aufstellen
Füge die PDF4me "Konvertieren PDF zu bearbeitbar PDF Verwendung OCR" Knoten zu Ihrem n8n Führen Sie den Workflow durch und konfigurieren Sie die erforderlichen Parameter. Anweisungen zur Ersteinrichtung finden Sie in unserer [Website/Dokumentation/etc.]. n8n IntegrationsleitfadenDie
Voraussetzungen:
- PDF4me API Zugangsdaten
- n8n Workflow-Zugriff
Konfiguration:
- Hinzufügen PDF4me Knoten zum Workflow
- Wählen Sie „Konvertieren“. PDF zu bearbeitbar PDF Verwendung OCR" Aktion
- Eingabeparameter konfigurieren (siehe unten)

Parameter
Vollständige Liste der Parameter für die Konvertierung PDF zu bearbeitbar PDF Verwendung OCR Aktion. Konfigurieren Sie diese Parameter, um die Aktion zu steuern. OCR Konvertierung.
Wichtig: Mit einem Sternchen (***) gekennzeichnete Parameter sind erforderlich und müssen angegeben werden, damit die Aktion ordnungsgemäß funktioniert.
| Parameter | Typ | Beschreibung | Beispiel |
|---|---|---|---|
| Eingabedatentyp*** | String | PDF Auswahl des Eingabeformats • Wählen Sie das Format Ihrer PDF Dokumenteneingabe • PDF4me unterstützt mehrere Eingabetypen für OCR Konvertierung • Optionen: Binärdaten, Base64 Zeichenkette oder URL | Binary Data |
| Binäres Eingabefeld | Binär | Binär PDF Dateieingabe (Erforderlich bei Binärdaten) • Referenz PDF Datei von vorheriger n8n Knoten- oder Datei-Upload • Funktioniert mit gescannten PDFs, bildbasiert PDFs und gemischte Inhalte • Erforderlich, wenn der Eingabedatentyp "Binärdaten" ist | {{ $binary.data }} |
| Base64-PDF-Inhalt | String | Base64 Kodiert PDF Eingabe (Erforderlich, wenn Base64 Zeichenkette) • Bieten PDF Inhalt als Base64-kodierter String • Unterstützt verschiedene PDF Formate einschließlich gescannter Dokumente • Erforderlich, wenn der Eingabedatentyp "Base64 String" | JVBE... |
| PDF-URL | String | Öffentlich PDF URL Eingabe (Erforderlich, wenn URL) • Eine öffentliche/offene Genehmigung einholen URL zum PDF Datei • Lädt das Dokument herunter und verarbeitet es für OCR Konvertierung • Erforderlich, wenn der Eingabedatentyp "URL" | https://abc.com/scanned.pdf |
| Dokumentenname*** | String | Eingabedateiname • Geben Sie den Namen der Eingabe an. PDF Datei • Wichtig für OCR Qualität und Genauigkeit der Texterkennung • Muss die Dateiendung .pdf enthalten. | scanned_document.pdf |
| Qualitätsart*** | String | OCR Qualitätsauswahl • Wählen Sie die OCR Verarbeitungsqualitätsniveau • Entwurf: geeignet für normale PDFs (1 API Aufruf pro Datei) • Hoch: geeignet für Bilder/gescannte Dokumente (2 API Anrufe pro Seite) | Draft |
| OCR nur bei Bedarf*** | Boolean | Konditional OCR Verarbeitung • Richtig: anwenden OCR nur wenn PDF ist bildbasiert oder nicht durchsuchbar • Falsch: anwenden OCR auf alle Inhalte unabhängig von vorhandenen Textebenen • Optimiert die Verarbeitung und API Verbrauch | True |
| Sprache*** | String | OCR Spracheinstellungen • Geben Sie die primäre Sprache des Textes im PDF • Optimiert OCR Genauigkeit für bessere Texterkennung • Englisch ist die Standardeinstellung, weitere Sprachen verfügbar | English |
| Ausgabeformat*** | Boolean | Ausgabeformatsteuerung • Wahr: Erweiterte Formatierungsoptionen für bearbeitbare Elemente aktivieren PDF • Gewährleistet eine bessere Erhaltung von Layout und Struktur • Empfohlen zur Beibehaltung der Dokumentformatierung | true |
| Alle Tabellenblätter zusammenführen*** | Boolean | Blattzusammenführungssteuerung • Richtig: Alle Blätter/Seiten zu einem einzigen durchgehenden Dokument zusammenführen • Falsch: Beibehaltung der individuellen Seitenstruktur und Formatierung • Wählen Sie anhand der gewünschten Ausgabestruktur | True |
| Name der Ausgabedatei*** | String | Ausgabedateiname • Geben Sie den Namen für die generierte bearbeitbare Datei an. PDF Datei • Muss die Dateiendung .pdf enthalten. • PDF4me gewährleistet eindeutige Namensgebung und Formatvalidierung | editable_pdf_output.pdf |
| Name des Binärausgabefelds*** | String | Binäre Datenzuordnung • Definieren Sie den Variablennamen für den Zugriff auf generierte bearbeitbare Daten. PDF Daten • Wird in nachfolgenden Workflow-Aktionen verwendet • Unverzichtbar für den Workflow-Datenfluss | data |
Erweiterte Optionen
Folgende Parameter stehen im Abschnitt „Erweiterte Optionen“ zur Verfügung und sind optional:
| Parameter | Typ | Beschreibung | Beispiel |
|---|---|---|---|
| Benutzerdefinierte Profile | String | Benutzerdefinierte Konfigurationsprofile • Zusätzliche Optionen mithilfe benutzerdefinierter Profile festlegen • JSON-ähnliches Format mit vordefinierten OCR Parameter • Umfasst Spracherkennung, Genauigkeit der Texterkennung und Formatierungserhaltung • Optional für spezielle Anforderungen | { "language": "auto", "accuracy": "high", "preserveFormatting": true } |
Ausgabe
Ausgabeparameter
| Parameter | Typ | Beschreibung | Beispiel |
|---|---|---|---|
| Erfolg | Boolean | PDF4me OCR Konvertierungsstatusanzeige - Boolescher Wert, der den Erfolg oder Misserfolg des Vorgangs anzeigt OCR Umtauschprozess. Rücksendungen. true für erfolgreiche Konvertierungen und false für alle Fehler, wodurch eine robuste Fehlerbehandlung in automatisierten Arbeitsabläufen ermöglicht wird | true |
| Nachricht | String | PDF4me OCR Konvertierungsstatusmeldung - Beschreibende Nachricht, die das Ergebnis angibt OCR Konvertierungsprozess. Liefert klare Statusmeldungen für erfolgreiche Konvertierungen und detaillierte Fehlerinformationen zur Fehlerbehebung. | PDF converted to editable PDF using OCR successfully |
| Dateiname | String | PDF4me generierter Dateiname - Der vollständige Dateiname der erfolgreich verarbeiteten bearbeitbaren Datei PDF Dokument mit korrekter Dateiendung. PDF4me gewährleistet eine eindeutige Benennung und validiert die Einhaltung des Dateiformats für eine nahtlose Integration mit nachgelagerten Prozessen. | editable_pdf_output.pdf |
| MIME-Typ | String | PDF4me MIME Typbezeichner - Die standardisierte MIME Typ für das generierte bearbeitbare PDF Datei, immer auf gesetzt application/pdf von PDF4me'S OCR Verarbeitungsmodul. Dies gewährleistet die korrekte Dateiverarbeitung und -erkennung in allen Systemen und Anwendungen. | application/pdf |
| Dateigröße | Nummer | PDF4me Dateigröße in Bytes - Die genaue Größe der generierten bearbeitbaren Datei PDF Dateigröße in Bytes, bereitgestellt für Speicherplanung, Bandbreitenoptimierung und Überwachung von Dateiübertragungen. Unverzichtbar für die Dokumentenverwaltung und Workflow-Automatisierung in Unternehmen. | 121875 |
| Qualitätstyp | String | PDF4me OCR verwendete Qualitätseinstellung - Die Qualitätseinstellung, die während der OCR Konvertierungsprozess. Zeigt die tatsächliche Qualitätsstufe für die Texterkennung und Dokumentenverarbeitung an. Gängige Werte sind „Entwurf“, „Hoch“ und „Archiv“. | Draft |
| ocrWhenNeeded | String | PDF4me OCR Einstellung für bedingte Verarbeitung - Gibt an, ob OCR wurde bedingt (nur bei Bedarf) oder auf alle Inhalte angewendet. Zeigt die tatsächlich während der Verarbeitung verwendete Einstellung zu Verifizierungs- und Debugging-Zwecken an. | true |
| Sprache | String | PDF4me OCR verwendete Spracheinstellung - Die Spracheinstellung, die während der OCR Konvertierungsprozess. Zeigt die tatsächlich für die Texterkennung verwendete Sprache an, um Genauigkeit und Verarbeitung zu optimieren. | English |
| mergeAllSheets | Boolean | PDF4me verwendete Einstellung zum Zusammenführen von Tabellenblättern Gibt an, ob alle Blätter oder Seiten während der Verarbeitung zu einem einzigen Dokument zusammengeführt wurden. Zeigt die tatsächlich angewendete Einstellung für die Dokumentstrukturverwaltung an. | false |
N8N Maßnahmenreaktion
Der PDF4me Konvertieren PDF zu bearbeitbar PDF Verwendung OCR API Die Antwort kann in verschiedenen Formaten angezeigt werden. Wählen Sie die Ansicht, die Ihren Bedürfnissen am besten entspricht:
- JSON
- Table
- Schema
- Binary
JSON Antwortformat
Das Rohmaterial JSON Antwort von der API:
{
"success": true,
"message": "PDF converted to editable PDF using OCR successfully",
"fileName": "editable_pdf_output.pdf",
"mimeType": "application/pdf",
"fileSize": 121875,
"qualityType": "Draft",
"ocrWhenNeeded": "true",
"language": "English",
"mergeAllSheets": false
}
Tabellenansicht
Antwortdaten in strukturierter Tabellenform:
| Parameter | Wert |
|---|---|
| success | true |
| message | PDF in bearbeitbar umgewandelt PDF Verwendung OCR erfolgreich |
| fileName | editable_pdf_output.pdf |
| mimeType | application/pdf |
| fileSize | 121875 |
| qualityType | Draft |
| ocrWhenNeeded | true |
| language | English |
| mergeAllSheets | false |
Schemaansicht
Die Datenstruktur und die Datentypen der Antwort:
success: ✓ true
message: AB PDF converted to editable PDF using OCR successfully
fileName: AB editable_pdf_output.pdf
mimeType: AB application/pdf
fileSize: # 121875
qualityType: AB Draft
ocrWhenNeeded: AB true
language: AB English
mergeAllSheets: ✓ false
Typenindikatoren:
AB= String#= Zahl✓= Boolean
Binärdatenansicht
Das tatsächliche bearbeitbare PDF Dateidaten und Metadaten:
data
─────────────────────────────────────────
File Name: editable_pdf_output.pdf
File Extension: pdf
Mime Type: application/pdf
File Size: 119.0 KB
Anwendungsfälle
Dokumentendigitalisierung und Archivierung
- Konvertieren Sie Papierdokumente und gescannte Dateien in durchsuchbare, bearbeitbare digitale Formate.
- Historische Archive und Dokumente digitalisieren, um sie zeitgemäß zugänglich zu machen und zu bewahren.
- Physische Formulare und Dokumente in bearbeitbare digitale Versionen umwandeln
Inhaltsverwaltung und Suchbarkeit
- Gescannte Dokumente für Content-Management-Systeme durchsuchbar machen
- Aktivieren Sie die Volltextsuche für zuvor nicht durchsuchbare Dokumente.
- Konvertierung bildbasierter PDFs in zugängliche, bearbeitbare Inhalte für eine bessere Benutzererfahrung
Workflow-Automatisierung und -Verarbeitung
- Automatisieren Sie die Konvertierung gescannter Dokumente in Dokumentenverarbeitungs-Workflows.
- Verarbeitung eingehender Papierdokumente zur automatisierten Datenextraktion und -analyse
- Ermöglichen Sie die Weiterverarbeitung von zuvor statischen Dokumentinhalten