Zum Hauptinhalt springen

Teilt PDF durch Text n8n Aktion

PDF4me Teilt PDF per Text teilt PDF Dokumente basierend auf erkannten Textmustern und Inhalten durch n8n Automatisierte Arbeitsabläufe. Prozess PDFs via n8n Trigger, Binärdaten, Base64-Strings oder öffentliche URLs Diese Lösung erkennt automatisch bestimmte Textzeichenfolgen, teilt Dokumente an Textstellen und organisiert Dateien anhand des erkannten Inhalts für eine intelligente Dateibenennung. Sie eignet sich ideal für die Trennung von Rechnungen, die Aufteilung von Verträgen, die Stapelverarbeitung von Dokumenten, die inhaltsbasierte Organisation, die automatisierte Ablage und Workflows zur textbasierten Dokumentensortierung, die eine präzise Texterkennung mit intelligenter Dokumentenaufteilung und nahtloser Integration erfordern.

Verwandte Blog-Beiträge
Zu dieser Funktion gibt es noch keinen Blogbeitrag – folgt in Kürze.
Schauen Sie sich in der Zwischenzeit im PDF4me-Blog Tutorials und Arbeitsabläufe für alle Plattformen an.
Besuchen Sie den Blog

Aufstellen

Füge die PDF4me "Teilt PDF durch "Text"-Knoten zu Ihrem n8n Führen Sie den Workflow durch und konfigurieren Sie die erforderlichen Parameter. Anweisungen zur Ersteinrichtung finden Sie in unserer [Website/Dokumentation/etc.]. n8n IntegrationsleitfadenDie

Voraussetzungen:

  • PDF4me API Zugangsdaten
  • n8n Workflow-Zugriff

Konfiguration:

  1. Hinzufügen PDF4me Knoten zum Workflow
  2. Wählen Sie „Aufteilen“ PDF durch Text-Aktion
  3. Eingabeparameter konfigurieren (siehe unten)
PDF nach Text aufteilen

Parameter

Vollständige Liste der Parameter für die Aufteilung PDF Durch Textaktion. Konfigurieren Sie diese Parameter, um textbasierte Aktionen zu steuern. PDF Aufspaltung.

Wichtig: Mit einem Sternchen (***) gekennzeichnete Parameter sind erforderlich und müssen angegeben werden, damit die Aktion ordnungsgemäß funktioniert.

ParameterTypBeschreibungBeispiel
Eingabedatentyp***StringPDF Auswahl des Eingabeformats
• Wählen Sie das Format Ihrer PDF Dateneingabe
PDF4me unterstützt mehrere Eingabetypen
• Optionen: Binärdaten, Base64-Zeichenkette oder URL
Binary Data
Binärer EigenschaftsnameStringBinär PDF Dateieingabe (Erforderlich bei Binärdaten)
• Referenz PDF Datei von vorheriger n8n Knoten- oder Datei-Upload
PDF4me Prozesse binär PDF Dateien mit automatischer Formaterkennung
• Erforderlich, wenn der Eingabedatentyp "Binärdaten" ist
data
Base64-DokumentinhaltStringBase64 Kodiert PDF Eingabe (Erforderlich bei Base64-String)
• Bieten PDF Daten als Base64-kodierter String
PDF4me dekodiert und verarbeitet automatisch die PDF Inhalt
• Erforderlich, wenn der Eingabedatentyp "Base64 String"
UEsDBBQABgAI...
Datei-URLStringÖffentlich PDF URL Eingabe (Erforderlich, falls URL)
• Eine öffentliche/offene Genehmigung einholen URL zum PDF Datei
PDF4me lädt die Datei herunter und verarbeitet sie von URL
• Erforderlich, wenn der Eingabedatentyp "URL"
https://abc.com/sample.pdf
Text zum Suchen***StringTextsuchspezifikation
• Geben Sie die genaue Zeichenfolge an, nach der innerhalb des PDF
PDF4me verwendet diesen Text als Trennpunkt für die Aufteilung des Dokuments
• Groß-/Kleinschreibung beachten für präzise Texterkennung
page 1, line 10.
Geteilte Textseite***StringAuswahl der geteilten Position
• Wählen Sie, wo Sie die Daten aufteilen möchten. PDF im Verhältnis zum erkannten Text
• Optionen: Nach (nach der Seite teilen), Vor (vor der Seite teilen)
PDF4me ermöglicht flexible geteilte Positionierung
After
Dateibenennung***StringNamenskonvention für Ausgabedateien
• Wählen Sie, wie die Aufteilung generiert wird. PDF Die Dateien sollten benannt werden
• Optionen: Benennung gemäß Reihenfolge (fortlaufend), Benennung gemäß Seite (mit Seitenzahlen)
• Hilft bei der Organisation von Ausgabedateien
Name As Per Order
Dateiname***StringSpezifikation des Ausgabedateinamens
• Geben Sie den Namen für die generierte Aufteilung an. PDF Datei
• Muss die Dateiendung .pdf enthalten.
PDF4me gewährleistet eindeutige Namensgebung und Formatvalidierung
output.pdf
Name des Binärausgabefelds***StringBinäre Datenzuordnung
• Definiere den Variablennamen für den Zugriff auf den generierten Split. PDF Daten
• Wird in nachfolgenden Workflow-Aktionen verwendet
• Unverzichtbar für den Workflow-Datenfluss
data

Erweiterte Optionen

Folgende Parameter stehen im Abschnitt „Erweiterte Optionen“ zur Verfügung und sind optional:

ParameterTypBeschreibungBeispiel
Benutzerdefinierte ProfileStringBenutzerdefinierte Konfigurationsprofile
• Zusätzliche Optionen mithilfe benutzerdefinierter Profile festlegen
JSON-ähnliches Format mit vordefinierten Parametern
• Unterstützt outputDataFormat, preserveMetadata usw.
• Optional für spezielle Anforderungen
{ "outputDataFormat": "base64", "preserveMetadata": true, "optimizeForPrinting": false, "compressionLevel": "medium" }

Ausgabe

Ausgabeparameter

ParameterTypBeschreibungBeispiel
ErfolgBooleanPDF4me Statusanzeige für die Textaufteilung - Boolean Flagge, die den Erfolg oder Misserfolg anzeigt PDF Textaufteilungsprozess. PDF4me Rückgaben true für einen erfolgreichen Betrieb und false für alle Fehler, wodurch eine robuste Fehlerbehandlung in automatisierten Arbeitsabläufen ermöglicht wirdtrue
NachrichtStringPDF4me Statusmeldung zum Textaufteilungsvorgang - Eine für Menschen lesbare Statusmeldung mit Details zum Ergebnis des Textaufteilungsprozesses. Enthält eine Erfolgsbestätigung oder Fehlerdetails zur Fehlerbehebung.PDF split by text successfully
DateinameStringPDF4me generierte Aufteilung PDF Dateiname - Der vollständige Dateiname der erfolgreich generierten Aufteilung PDF Dokument mit der korrekten Dateiendung .pdf. PDF4me gewährleistet eine eindeutige Benennung und validiert die Einhaltung des Dateiformats für eine nahtlose Integration mit nachgelagerten Prozessen.text_split_output.pdf
MIME-TypStringPDF4me Ausgabe MIME Typ - MIME Art des generierten PDF Datei, immer "application/pdf" für PDF Dokumente. Nützlich für die Inhaltstypvalidierung und die korrekte Dateiverarbeitung in Webanwendungen.application/pdf
DateigrößeNummerPDF4me Teilt PDF Dateigröße in Bytes - Die genaue Größe der generierten Aufteilung PDF Datei in Bytes, bereitgestellt von PDF4me Für Speicherplanung, Bandbreitenoptimierung und Überwachung von Dateiübertragungen. Unverzichtbar für die Dokumentenverwaltung und Workflow-Automatisierung in Unternehmen.125430
docNameStringPDF4me Dokumentnamensreferenz - Der Name des verarbeiteten, aufgeteilten Dokuments zu Referenz- und Nachverfolgungszwecken. Dieser entspricht dem fileName für einheitliche Dokumentenmanagement-Workflowstext_split_output.pdf
textSplitCompletedBooleanPDF4me Bestätigung des Abschlusses der Textaufteilung - Boolean Flagge, die bestätigt, dass PDF Die Textaufteilung wurde erfolgreich abgeschlossen. Dies dient zur Überprüfung, ob die textbasierte Aufteilung korrekt angewendet wurde.true
textMatchesFoundNummerPDF4me Anzahl der erkannten Textübereinstimmungen - Die Anzahl der erfolgreich gefundenen und als Aufteilungspunkte verwendeten Textübereinstimmungen in der PDF Dokument. Nützlich zur Verfolgung der Effektivität der Texterkennung und der Genauigkeit der Textaufteilung.3
Dateien generiertNummerPDF4me Anzahl der generierten Split-Dateien - Die Anzahl der Individuen PDF Die erfolgreich aus der Textaufteilungsoperation generierten Dateien. Nützlich zur Nachverfolgung der Vollständigkeit der Aufteilung und der Ergebnisse der Dokumentensegmentierung.4

N8N Maßnahmenreaktion

Der PDF4me Teilt PDF per Text API Die Antwort kann in verschiedenen Formaten angezeigt werden. Wählen Sie die Ansicht, die Ihren Bedürfnissen am besten entspricht:

JSON Antwortformat

Das Rohmaterial JSON Antwort von der API:

[
{
"success": true,
"message": "PDF split by text successfully",
"fileName": "text_split_output.pdf",
"mimeType": "application/pdf",
"fileSize": 125430,
"docName": "text_split_output.pdf",
"textSplitCompleted": true,
"textMatchesFound": 3,
"filesGenerated": 4
}
]

Anwendungsfälle

Dokumentenverarbeitung und Inhaltsmanagement

  • Teilen Sie große Dokumente an bestimmten Textmarkierungen oder Abschnittsüberschriften auf, um übersichtliche, handhabbare Dateien für verschiedene Abteilungen oder Prozesse zu erstellen.
  • Rechtsdokumente werden verarbeitet, indem sie an bestimmten Klauselmarkierungen oder Abschnittstrennern aufgeteilt werden, um für jeden Rechtsabschnitt eine separate Datei zu erstellen.
  • Automatisieren Sie die Trennung von Berichten und Handbüchern anhand von Kapiteltiteln oder Abschnittsüberschriften, um eine bessere Inhaltsorganisation zu erreichen.

Geschäftsprozessautomatisierung

  • Teilen Sie Rechnungsstapel auf, indem Sie nach bestimmten Textmustern wie „Rechnungsnr.“ oder „Zahlungsbetrag fällig“ suchen, um für jede Transaktion separate Rechnungsdateien zu erstellen.
  • Verträge und Vereinbarungen werden verarbeitet, indem sie an bestimmten Textmarkierungen wie „Abschnitt“ oder „Artikel“ aufgeteilt werden, um für jeden Abschnitt separate Dateien zu erstellen.
  • Automatisieren Sie die Organisation von Finanzdokumenten, indem Sie diese anhand von Textmustern wie „Quartalsbericht“ oder „Jahresübersicht“ für verschiedene Berichtszeiträume aufteilen.

Inhaltsverteilung und Workflow-Management

  • Vertrauliche Dokumente werden anhand bestimmter Textmarkierungen aufgeteilt, um je nach Zugriffsanforderungen separate Dateien für verschiedene Interessengruppen zu erstellen.
  • Die Schulungsmaterialien werden verarbeitet, indem Textmuster wie „Modul“ oder „Lektion“ aufgeschlüsselt werden, um individuelle Lernmodule für verschiedene Zielgruppen zu erstellen.
  • Automatisieren Sie die Organisation der technischen Dokumentation, indem Sie sie an Textmarkierungen wie „API-Referenz“ oder „Benutzerhandbuch“ für verschiedene Benutzertypen aufteilen.

Hilfe erhalten