Zum Hauptinhalt springen

Konvertieren PDF zu bearbeitbar PDF Verwendung OCR Verwendung n8n Aktion

PDF4me Konvertieren PDF zu bearbeitbar PDF Verwendung OCR transformiert gescannt PDFs und bildbasierte Dokumente in durchsuchbare, bearbeitbare PDFs durch n8n Automatisierte Arbeitsabläufe. Prozess PDFs weg n8n Trigger, Binärdaten, Base64-Strings oder öffentliche URLs zu bewerben OCR Technologie mit Mehrsprachigkeitsunterstützung, Auswahl der Qualitätsstufe (Entwurf/Hoch), bedingte OCR Verarbeitung, Erstellung von Textebenen, Layout-Erhaltung und Generierung durchsuchbarer Inhalte. Diese Lösung eignet sich ideal für die Dokumentendigitalisierung, die Verarbeitung gescannter Dokumente und die Rechnungserstellung. OCRArchivkonvertierung, durchsuchbar PDF Erstellung und automatisierte OCR Arbeitsabläufe, die eine präzise Texterkennung unter Beibehaltung der Formatierung und nahtlose Integration erfordern.

Verwandte Blog-Beiträge
Zu dieser Funktion gibt es noch keinen Blogbeitrag – folgt in Kürze.
Schauen Sie sich in der Zwischenzeit im PDF4me-Blog Tutorials und Arbeitsabläufe für alle Plattformen an.
Besuchen Sie den Blog

Aufstellen

Füge die PDF4me "Konvertieren PDF zu bearbeitbar PDF Verwendung OCR" Knoten zu Ihrem n8n Führen Sie den Workflow durch und konfigurieren Sie die erforderlichen Parameter. Anweisungen zur Ersteinrichtung finden Sie in unserer [Website/Dokumentation/etc.]. n8n IntegrationsleitfadenDie

Voraussetzungen:

  • PDF4me API Zugangsdaten
  • n8n Workflow-Zugriff

Konfiguration:

  1. Hinzufügen PDF4me Knoten zum Workflow
  2. Wählen Sie „Konvertieren“. PDF zu bearbeitbar PDF Verwendung OCR" Aktion
  3. Eingabeparameter konfigurieren (siehe unten)
PDF mithilfe von OCR-Konfiguration in bearbeitbares PDF konvertieren

Parameter

Vollständige Liste der Parameter für die Konvertierung PDF zu bearbeitbar PDF Verwendung OCR Aktion. Konfigurieren Sie diese Parameter, um die Aktion zu steuern. OCR Konvertierung.

Wichtig: Mit einem Sternchen (***) gekennzeichnete Parameter sind erforderlich und müssen angegeben werden, damit die Aktion ordnungsgemäß funktioniert.

ParameterTypBeschreibungBeispiel
Eingabedatentyp***StringPDF Auswahl des Eingabeformats
• Wählen Sie das Format Ihrer PDF Dokumenteneingabe
PDF4me unterstützt mehrere Eingabetypen für OCR Konvertierung
• Optionen: Binärdaten, Base64 Zeichenkette oder URL
Binary Data
Binäres EingabefeldBinärBinär PDF Dateieingabe (Erforderlich bei Binärdaten)
• Referenz PDF Datei von vorheriger n8n Knoten- oder Datei-Upload
• Funktioniert mit gescannten PDFs, bildbasiert PDFs und gemischte Inhalte
• Erforderlich, wenn der Eingabedatentyp "Binärdaten" ist
{{ $binary.data }}
Base64-PDF-InhaltStringBase64 Kodiert PDF Eingabe (Erforderlich, wenn Base64 Zeichenkette)
• Bieten PDF Inhalt als Base64-kodierter String
• Unterstützt verschiedene PDF Formate einschließlich gescannter Dokumente
• Erforderlich, wenn der Eingabedatentyp "Base64 String"
JVBE...
PDF-URLStringÖffentlich PDF URL Eingabe (Erforderlich, wenn URL)
• Eine öffentliche/offene Genehmigung einholen URL zum PDF Datei
• Lädt das Dokument herunter und verarbeitet es für OCR Konvertierung
• Erforderlich, wenn der Eingabedatentyp "URL"
https://abc.com/scanned.pdf
Dokumentenname***StringEingabedateiname
• Geben Sie den Namen der Eingabe an. PDF Datei
• Wichtig für OCR Qualität und Genauigkeit der Texterkennung
• Muss die Dateiendung .pdf enthalten.
scanned_document.pdf
Qualitätsart***StringOCR Qualitätsauswahl
• Wählen Sie die OCR Verarbeitungsqualitätsniveau
• Entwurf: geeignet für normale PDFs (1 API Aufruf pro Datei)
• Hoch: geeignet für Bilder/gescannte Dokumente (2 API Anrufe pro Seite)
Draft
OCR nur bei Bedarf***BooleanKonditional OCR Verarbeitung
• Richtig: anwenden OCR nur wenn PDF ist bildbasiert oder nicht durchsuchbar
• Falsch: anwenden OCR auf alle Inhalte unabhängig von vorhandenen Textebenen
• Optimiert die Verarbeitung und API Verbrauch
True
Sprache***StringOCR Spracheinstellungen
• Geben Sie die primäre Sprache des Textes im PDF
• Optimiert OCR Genauigkeit für bessere Texterkennung
• Englisch ist die Standardeinstellung, weitere Sprachen verfügbar
English
Ausgabeformat***BooleanAusgabeformatsteuerung
• Wahr: Erweiterte Formatierungsoptionen für bearbeitbare Elemente aktivieren PDF
• Gewährleistet eine bessere Erhaltung von Layout und Struktur
• Empfohlen zur Beibehaltung der Dokumentformatierung
true
Alle Tabellenblätter zusammenführen***BooleanBlattzusammenführungssteuerung
• Richtig: Alle Blätter/Seiten zu einem einzigen durchgehenden Dokument zusammenführen
• Falsch: Beibehaltung der individuellen Seitenstruktur und Formatierung
• Wählen Sie anhand der gewünschten Ausgabestruktur
True
Name der Ausgabedatei***StringAusgabedateiname
• Geben Sie den Namen für die generierte bearbeitbare Datei an. PDF Datei
• Muss die Dateiendung .pdf enthalten.
PDF4me gewährleistet eindeutige Namensgebung und Formatvalidierung
editable_pdf_output.pdf
Name des Binärausgabefelds***StringBinäre Datenzuordnung
• Definieren Sie den Variablennamen für den Zugriff auf generierte bearbeitbare Daten. PDF Daten
• Wird in nachfolgenden Workflow-Aktionen verwendet
• Unverzichtbar für den Workflow-Datenfluss
data

Erweiterte Optionen

Folgende Parameter stehen im Abschnitt „Erweiterte Optionen“ zur Verfügung und sind optional:

ParameterTypBeschreibungBeispiel
Benutzerdefinierte ProfileStringBenutzerdefinierte Konfigurationsprofile
• Zusätzliche Optionen mithilfe benutzerdefinierter Profile festlegen
JSON-ähnliches Format mit vordefinierten OCR Parameter
• Umfasst Spracherkennung, Genauigkeit der Texterkennung und Formatierungserhaltung
• Optional für spezielle Anforderungen
{ "language": "auto", "accuracy": "high", "preserveFormatting": true }

Ausgabe

Ausgabeparameter

ParameterTypBeschreibungBeispiel
ErfolgBooleanPDF4me OCR Konvertierungsstatusanzeige - Boolescher Wert, der den Erfolg oder Misserfolg des Vorgangs anzeigt OCR Umtauschprozess. Rücksendungen. true für erfolgreiche Konvertierungen und false für alle Fehler, wodurch eine robuste Fehlerbehandlung in automatisierten Arbeitsabläufen ermöglicht wirdtrue
NachrichtStringPDF4me OCR Konvertierungsstatusmeldung - Beschreibende Nachricht, die das Ergebnis angibt OCR Konvertierungsprozess. Liefert klare Statusmeldungen für erfolgreiche Konvertierungen und detaillierte Fehlerinformationen zur Fehlerbehebung.PDF converted to editable PDF using OCR successfully
DateinameStringPDF4me generierter Dateiname - Der vollständige Dateiname der erfolgreich verarbeiteten bearbeitbaren Datei PDF Dokument mit korrekter Dateiendung. PDF4me gewährleistet eine eindeutige Benennung und validiert die Einhaltung des Dateiformats für eine nahtlose Integration mit nachgelagerten Prozessen.editable_pdf_output.pdf
MIME-TypStringPDF4me MIME Typbezeichner - Die standardisierte MIME Typ für das generierte bearbeitbare PDF Datei, immer auf gesetzt application/pdf von PDF4me'S OCR Verarbeitungsmodul. Dies gewährleistet die korrekte Dateiverarbeitung und -erkennung in allen Systemen und Anwendungen.application/pdf
DateigrößeNummerPDF4me Dateigröße in Bytes - Die genaue Größe der generierten bearbeitbaren Datei PDF Dateigröße in Bytes, bereitgestellt für Speicherplanung, Bandbreitenoptimierung und Überwachung von Dateiübertragungen. Unverzichtbar für die Dokumentenverwaltung und Workflow-Automatisierung in Unternehmen.121875
QualitätstypStringPDF4me OCR verwendete Qualitätseinstellung - Die Qualitätseinstellung, die während der OCR Konvertierungsprozess. Zeigt die tatsächliche Qualitätsstufe für die Texterkennung und Dokumentenverarbeitung an. Gängige Werte sind „Entwurf“, „Hoch“ und „Archiv“.Draft
ocrWhenNeededStringPDF4me OCR Einstellung für bedingte Verarbeitung - Gibt an, ob OCR wurde bedingt (nur bei Bedarf) oder auf alle Inhalte angewendet. Zeigt die tatsächlich während der Verarbeitung verwendete Einstellung zu Verifizierungs- und Debugging-Zwecken an.true
SpracheStringPDF4me OCR verwendete Spracheinstellung - Die Spracheinstellung, die während der OCR Konvertierungsprozess. Zeigt die tatsächlich für die Texterkennung verwendete Sprache an, um Genauigkeit und Verarbeitung zu optimieren.English
mergeAllSheetsBooleanPDF4me verwendete Einstellung zum Zusammenführen von Tabellenblättern Gibt an, ob alle Blätter oder Seiten während der Verarbeitung zu einem einzigen Dokument zusammengeführt wurden. Zeigt die tatsächlich angewendete Einstellung für die Dokumentstrukturverwaltung an.false

N8N Maßnahmenreaktion

Der PDF4me Konvertieren PDF zu bearbeitbar PDF Verwendung OCR API Die Antwort kann in verschiedenen Formaten angezeigt werden. Wählen Sie die Ansicht, die Ihren Bedürfnissen am besten entspricht:

JSON Antwortformat

Das Rohmaterial JSON Antwort von der API:

{
"success": true,
"message": "PDF converted to editable PDF using OCR successfully",
"fileName": "editable_pdf_output.pdf",
"mimeType": "application/pdf",
"fileSize": 121875,
"qualityType": "Draft",
"ocrWhenNeeded": "true",
"language": "English",
"mergeAllSheets": false
}

Anwendungsfälle

Dokumentendigitalisierung und Archivierung

  • Konvertieren Sie Papierdokumente und gescannte Dateien in durchsuchbare, bearbeitbare digitale Formate.
  • Historische Archive und Dokumente digitalisieren, um sie zeitgemäß zugänglich zu machen und zu bewahren.
  • Physische Formulare und Dokumente in bearbeitbare digitale Versionen umwandeln

Inhaltsverwaltung und Suchbarkeit

  • Gescannte Dokumente für Content-Management-Systeme durchsuchbar machen
  • Aktivieren Sie die Volltextsuche für zuvor nicht durchsuchbare Dokumente.
  • Konvertierung bildbasierter PDFs in zugängliche, bearbeitbare Inhalte für eine bessere Benutzererfahrung

Workflow-Automatisierung und -Verarbeitung

  • Automatisieren Sie die Konvertierung gescannter Dokumente in Dokumentenverarbeitungs-Workflows.
  • Verarbeitung eingehender Papierdokumente zur automatisierten Datenextraktion und -analyse
  • Ermöglichen Sie die Weiterverarbeitung von zuvor statischen Dokumentinhalten

Hilfe erhalten