Zum Hauptinhalt springen

Tabelle extrahieren PDF Verwendung n8n Aktion

PDF4me Tabelle extrahieren PDF identifiziert und extrahiert strukturierte Tabellendaten aus PDF Dokumente durch n8n Automatisierte Arbeitsabläufe. Prozess PDFs weg n8n Trigger, Binärdaten, Base64-Strings oder öffentliche URLs, um Tabellen automatisch zu erkennen, die Zellstruktur beizubehalten, Datenbeziehungen aufrechtzuerhalten, Überschriften und Werte zu extrahieren und strukturierte Daten auszugeben in JSON oder im Excel-Format. Diese Lösung eignet sich ideal für die Analyse von Finanzberichten, die Digitalisierung von Daten, die statistische Datenextraktion, die Rechnungsverarbeitung, die Formularanalyse und automatisierte Tabellenextraktions-Workflows, die eine genaue Tabellenerkennung mit strukturierter Ausgabe und nahtloser Integration erfordern.

Verwandte Blog-Beiträge
Zu dieser Funktion gibt es noch keinen Blogbeitrag – folgt in Kürze.
Schauen Sie sich in der Zwischenzeit im PDF4me-Blog Tutorials und Arbeitsabläufe für alle Plattformen an.
Besuchen Sie den Blog

Aufstellen

Füge die PDF4me "Tabelle extrahieren aus PDF" Knoten zu Ihrem n8n Führen Sie den Workflow durch und konfigurieren Sie die erforderlichen Parameter. Anweisungen zur Ersteinrichtung finden Sie in unserer [Website/Dokumentation/etc.]. n8n IntegrationsleitfadenDie

Voraussetzungen:

  • PDF4me API Zugangsdaten
  • n8n Workflow-Zugriff

Konfiguration:

  1. Hinzufügen PDF4me Knoten zum Workflow
  2. Wählen Sie „Tabelle extrahieren aus“ aus PDF" Aktion
  3. Eingabeparameter konfigurieren (siehe unten)
Tabelle aus PDF extrahieren

Parameter

Vollständige Liste der Parameter für die Funktion „Tabelle extrahieren aus“ PDF Aktion. Konfigurieren Sie diese Parameter, um die Tabellenextraktion zu steuern.

Wichtig: Mit einem Sternchen (***) gekennzeichnete Parameter sind erforderlich und müssen angegeben werden, damit die Aktion ordnungsgemäß funktioniert.

ParameterTypBeschreibungBeispiel
Eingabedatentyp***StringPDF Auswahl des Eingabeformats
• Wählen Sie das Format Ihrer PDF Dateneingabe
PDF4me unterstützt mehrere Eingabetypen
• Optionen: Binärdaten, Base64 Zeichenkette oder URL
Binary Data
Binäres EingabefeldBinärBinär PDF Dateieingabe (Erforderlich bei Binärdaten)
• Referenz PDF Datei von vorheriger n8n Knoten- oder Datei-Upload
PDF4me Prozesse binär PDF Dateien mit automatischer Formaterkennung
• Erforderlich, wenn der Eingabedatentyp "Binärdaten" ist
{{ $binary.data }}
Base64-DokumentinhaltStringBase64 Kodiert PDF Eingabe (Erforderlich, wenn Base64 Zeichenkette)
• Bieten PDF Daten als Base64-kodierter String
PDF4me dekodiert und verarbeitet automatisch die PDF Inhalt
• Erforderlich, wenn der Eingabedatentyp "Base64 String"
UEsDBBQABgAI...
Datei-URLStringÖffentlich PDF URL Eingabe (Erforderlich, wenn URL)
• Eine öffentliche/offene Genehmigung einholen URL zum PDF Datei
PDF4me lädt die Datei herunter und verarbeitet sie von URL
• Erforderlich, wenn der Eingabedatentyp "URL"
https://abc.com/report.pdf
Dokumentenname***StringQuelle PDF Referenz
• Geben Sie den Namen der Quelle an. PDF Datei
• Zur Referenz und Nachverfolgung bei der Tabellenextraktion
• Hilft bei der Nachverfolgung von Verarbeitungsprozessen
financial_report.pdf

Erweiterte Optionen

Folgende Parameter stehen im Abschnitt „Erweiterte Optionen“ zur Verfügung und sind optional:

ParameterTypBeschreibungBeispiel
Benutzerdefinierte ProfileStringBenutzerdefinierte Konfigurationsprofile
• Zusätzliche Optionen mithilfe benutzerdefinierter Profile festlegen
JSON-ähnliches Format mit vordefinierten Parametern
• Ermöglicht erweiterte Tabellenverarbeitungseinstellungen
• Optional für spezielle Anforderungen
{ "OutputDataFormat": "json" }

Unterstützte Tabellentypen

TabellentypBeschreibungHäufige Anwendungsfälle
FinanztabellenFinanzberichte, Budgets und BuchhaltungsdatenFinanzberichte, Rechnungen, Bilanzen
DatentabellenStatistische Daten, Kennzahlen und analytische InformationenForschungsberichte, Analysen, Leistungsdaten
ListentabellenProduktkataloge, Verzeichnisse und InventarlistenProduktlisten, Mitarbeiterverzeichnisse, Kataloge
VergleichstabellenFunktionsvergleiche, Preistabellen und SpezifikationenProduktvergleiche, Preisübersichten, Spezifikationen
ZeitplantabellenZeitpläne, Kalender und PlanungsdokumenteBesprechungspläne, Projektzeitpläne, Kalender
ZusammenfassungstabellenZusammenfassungen, wichtige Kennzahlen und ÜbersichtsdatenDashboard-Daten, KPI-Zusammenfassungen, Managementberichte

Tabellenverarbeitungsfunktionen

BesonderheitBeschreibungAnwendungsfall
TabellenerkennungAutomatische Erkennung von Tabellengrenzen und -strukturenVerarbeitung von Dokumenten mit mehreren Tabellen
ZellextraktionPräzise Extraktion einzelner Zellwerte und -inhalteDatenanalyse und -verarbeitung
Header-ErkennungIdentifizierung von Tabellenüberschriften und SpaltenbezeichnungenOrganisation strukturierter Daten
ZeilenverarbeitungExtraktion vollständiger Tabellenzeilen mit korrekter FormatierungDatenbankintegration und -speicherung
SpaltenausrichtungErhaltung der Säulenstruktur und AusrichtungPflege von Datenbeziehungen
Mehrseitige TabellenVerarbeitungstabellen, die sich über mehrere Seiten erstreckenAnalyse komplexer Dokumente

Ausgabe

Ausgabeparameter

ParameterTypBeschreibungBeispiel
DateinameStringPDF4me Name der Ausgabedatei - Name des generierten JSON Datei mit den extrahierten Tabellendaten. Die Datei enthält alle strukturierten Tabelleninformationen in JSON Formattable_extraction_results_1756997087699.json
MIME-TypStringPDF4me Datei MIME Typ - MIME Typ der Ausgabedatei, immer "application/json" für JSON Formattabellendatenapplication/json
DateigrößeNummerPDF4me Dateigröße in Bytes - Größe der generierten JSON Datei in Bytes, bereitgestellt für Speicherplanung und Übertragungsüberwachung563
ErfolgBooleanPDF4me Extraktionsstatusanzeige - Boolescher Wert, der den Erfolg oder Misserfolg des Tabellenextraktionsprozesses anzeigt. PDF4me Rückgaben true für erfolgreiche Extraktionen und false für etwaige Fehlertrue
NachrichtStringPDF4me Extraktionsstatusmeldung - Eine für Menschen lesbare Statusmeldung mit Details zum Ergebnis des Tabellenextraktionsprozesses. Enthält eine Erfolgsbestätigung oder Fehlerdetails zur Fehlerbehebung.Table extraction completed successfully
docNameStringPDF4me Referenz zum Quelldokument - Ursprünglicher Dateiname der PDF Dokument, das zur Tabellenextraktion verarbeitet wurdedocument.pdf

N8N Maßnahmenreaktion

Der PDF4me Tabelle extrahieren PDF API Die Antwort kann in verschiedenen Formaten angezeigt werden. Wählen Sie die Ansicht, die Ihren Bedürfnissen am besten entspricht:

JSON Antwortformat

Das Rohmaterial JSON Antwort von der API:

[
{
"fileName": "table_extraction_results_1756997087699.json",
"mimeType": "application/json",
"fileSize": 563,
"success": true,
"message": "Table extraction completed successfully",
"docName": "document.pdf"
}
]

Anwendungsfälle

Datenverarbeitung und -analyse

  • Automatisierter Datenimport: Herunterladen und Verarbeiten der generierten Datei JSON Datei zum automatischen Importieren tabellarischer Daten in Datenbanken, Tabellenkalkulationen oder Geschäftsanwendungen
  • Datentransformation: Verarbeite die JSON Dateiinhalt zur Umwandlung von Tabellendaten in verschiedene Formate für verschiedene Geschäftssysteme
  • Statistische Analyse: Analysieren Sie die extrahierten Tabellendaten aus dem JSON Datei zur Generierung von Erkenntnissen, Trends und statistischen Berichten

Business Intelligence und Reporting

  • BerichtsautomatisierungAutomatische Datenextraktion aus Finanzberichten, Rechnungen und Geschäftsdokumenten, anschließende Verarbeitung JSON Datei für automatisierte Berichterstattung
  • Dashboard-Integration: Parsen Sie die JSON Datei und Einspeisung extrahierter Tabellendaten in Business-Intelligence-Dashboards und Analyseplattformen
  • Datenvalidierung: Tabellendaten, die aus dem extrahiert wurden, validieren und verifizieren JSON Ablage gegen bestehende Geschäftsunterlagen

Dokumentenverarbeitung und -verwaltung

  • RechnungsverarbeitungPreistabellen, Positionen und Finanzdaten aus Rechnungen extrahieren und anschließend die generierten Daten verarbeiten JSON Datei zur automatisierten Verarbeitung
  • Vertragsanalyse: Extrahieren Sie mithilfe des herunterladbaren Tools Bedingungen, Konditionen und strukturierte Daten aus Verträgen und Rechtsdokumenten JSON Datei
  • Bestandsverwaltung: Produktkataloge, Inventarlisten und Lieferkettendaten verarbeiten von PDF Dokumente über die JSON Ausgabedatei

Unternehmensintegration

  • Systemintegration: Herunterladen und integrieren JSON Datei mit bestehenden Unternehmenssystemen einschließlich ERP, CRMund Data Warehouses
  • Workflow-Automatisierung: Automatisierte Arbeitsabläufe auslösen basierend auf JSON Dateiverarbeitung und extrahierte Tabellendaten
  • Datensynchronisierung: Verarbeite die JSON Dateiverwaltung und Synchronisierung extrahierter Daten über mehrere Systeme und Plattformen hinweg für ein konsistentes Informationsmanagement

Hilfe erhalten