Dokument klassifizieren
PDF4me Dokument klassifizieren ermöglicht es Ihnen, Dokumente anhand ihres Inhalts zu klassifizieren und zu identifizieren. API Serviceprozesse PDF Die Dateiverwaltung analysiert Dokumentenstruktur, Inhaltsmuster und Metadaten, um Dokumenttypen und -kategorien zu bestimmen. API empfängt PDF Inhalte durch REST API Anrufe, die genutzt werden Base64 Verschlüsselung für sichere Übertragung. Dank Unterstützung für Dokumententypidentifizierung und automatisierte Kategorisierung eignet sich diese Lösung ideal für Dokumentenmanagementsysteme und automatisierte Arbeitsabläufe.
Authentifizierung Ihres API Anfrage
Um auf die PDF4me REST APIJede Anfrage muss die entsprechenden Authentifizierungsdaten enthalten. Die Authentifizierung gewährleistet eine sichere Kommunikation und bestätigt Ihre Identität als autorisierter Benutzer des Systems. REST APIDie
Hauptmerkmale
- Dokumentenklassifizierung: Dokumenttypen anhand von Inhaltsanalysen identifizieren und klassifizieren
- InhaltsanalyseDokumentstruktur, Inhaltsmuster und Metadaten analysieren
- Mehrere DokumenttypenUnterstützung für verschiedene PDF Dokumentformate
- Automatisierte VerarbeitungOptimierte Dokumentenklassifizierung ohne manuelle Eingriffe
- Einfach API IntegrationRESTful API konzipiert für automatisierte Dokumentenverarbeitungs-Workflows
REST API Endpunkt
Der PDF4me REST API verwendet Standard HTTP Methoden zur Interaktion mit Ressourcen. Alle Dokumentenklassifizierungsvorgänge werden über einen einzigen Endpunkt durchgeführt:
- Verfahren: POST
- Endpunkt:
/api/v2/ClassifyDocument
REST API Parameter
Vollständige Liste der Parameter für die Dokumentenklassifizierung REST APIDie Parameter sind zur besseren Verständlichkeit und Implementierung nach Kategorien geordnet.
Wichtig: Mit einem Sternchen (*) gekennzeichnete Parameter sind erforderlich und müssen angegeben werden. API um ordnungsgemäß zu funktionieren.
Erforderliche Parameter
| Parameter | Typ | Beschreibung | Beispiel |
|---|---|---|---|
| docContent* | Base64 (String) | Der Inhalt der Eingabe PDF Datei kodiert in Base64 Format für die Dokumentenanalyse und Klassifizierungsverarbeitung | JVBERi... |
| docName* | String | Quelle PDF Dateiname mit korrekter .pdf-Erweiterung zur Dokumentenidentifizierung und -verarbeitung | output.pdf |
Optionale Parameter
| Parameter | Typ | Beschreibung | Beispiel |
|---|---|---|---|
| async | Boolean | Aktivieren Sie die asynchrone Verarbeitung. Wenn true, Die API Rückgaben 202 Accepted mit einem Location Kopfzeile zum Abfragen des Ergebnisses | true |
Ausgabe
Der PDF4me Dokument klassifizieren REST API Die Antwort hängt vom Verarbeitungsmodus ab. API gibt Klassifizierungsdaten als JSON AntwortDie
- Success Response
- Asynchronous Processing
- Error Responses
- Response Format Details
Synchrone Verarbeitung (Standard)
Wann async Ist false oder nicht bereitgestellt, die API Gibt die Klassifizierungsergebnisse sofort zurück.
Statuscode: 200 OK
Antwortformat:
{
"documentType": "invoice",
"category": "financial",
"confidence": 0.95,
"metadata": {
"pageCount": 1,
"createdDate": "2024-01-15T10:30:00Z"
}
}
Die Antwort enthält Klassifizierungsdaten wie Dokumenttyp, Kategorie, Konfidenzwert und Metadateninformationen.
Asynchrone Verarbeitung
Wann async Ist true, Die API Das Dokument wird asynchron verarbeitet.
Erste Reaktion:
Statuscode: 202 Accepted
Antwort-Header:
Location: https://api.pdf4me.com/api/v2/ParseDocumentStatus/{operationId}
Antworttext:
{
"traceId": "operation-trace-id"
}
Umfrageergebnisse:
Verwenden Sie die Location Überschrift URL zur Vervollständigung der Umfrage:
const response = await fetch(locationUrl, {
headers: { 'Authorization': 'Basic ' + apiKey }
});
// Continue polling until status code is 200
if (response.status === 200) {
const result = await response.json();
// Process classification results
}
Fehlermeldungen
| Statuscode | Beschreibung | Beispielantwort |
|---|---|---|
| 400 Bad Request | Ungültige Anfrageparameter oder fehlende Pflichtfelder | {"error": "Missing required parameter: docContent"} |
| 401 Unauthorized | Ungültig oder fehlend API Schlüssel | {"error": "Unauthorized"} |
| 408 Anfrage-Timeout | Zeitüberschreitung bei der Anfrageverarbeitung | {"error": "Request timeout"} |
| 500 Internal Server Error | Serverfehler bei der Verarbeitung | {"error": "Internal server error"} |
das Verständnis des JSON Antwort
Die Klassifizierungsantwort ist eine JSON Objekt, das strukturierte Daten über das Dokument enthält:
- Dokumenttyp: Die identifizierte Art des Dokuments (z. B. „Rechnung“, „Vertrag“, „Bericht“)
- KategorieDie Dokumentenkategorie (z. B. „Finanzen“, „Recht“, „Geschäftsdokumente“)
- Vertrauen: Ein Wert, der den Grad der Zuverlässigkeit der Klassifizierung angibt (0,0 bis 1,0)
- MetadatenZusätzliche Dokumentinformationen wie Seitenzahl, Erstellungsdatum usw.
Dekodierung Base64 Inhalt (falls vorhanden):
Wenn die Antwort Folgendes umfasst Base64-kodierten Inhalt dekodieren Sie ihn mit:
// JavaScript
const decoded = atob(base64String);
# Python
import base64
decoded = base64.b64decode(base64_string).decode('utf-8')
Beispielanfrage
Kopfzeile
Content-Type: application/json
Authorization: Basic YOUR_BASE64_ENCODED_API_KEY
Notiz:
- Hol dir deins API Schlüssel vom PDF4me Armaturenbrett
- Der API Der Schlüssel muss sein Base64 kodiert und mit "Basic" präfixiert in der Authorization Überschrift
- Beispiel: Wenn Ihr API Schlüssel ist
abc123, kodieren Sie es zu Base64 und verwendenAuthorization: Basic YWJjMTIz
Nutzlast
Grundlegende Anfrage:
{
"docContent": "JVBERi0xLjQKJeLjz9MKMSAwIG9iago8PAovVHlwZSAvQ2F0YWxvZwovUGFnZXMgMiAwIFIKPj4KZW5kb2JqCjIgMCBvYmoKPDwKL1R5cGUgL1BhZ2VzCi9LaWRzIFszIDAgUl0KL0NvdW50IDEKPD4KZW5kb2JqCjMgMCBvYmoKPDwKL1R5cGUgL1BhZ2UKL1BhcmVudCAyIDAgUgovTWVkaWFCb3ggWzAgMCA2MTIgNzkyXQovUmVzb3VyY2VzIDw8Ci9Gb250IDw8Ci9GMSA0IDAgUgo+Pgo+PgovQ29udGVudHMgNSAwIFIKPj4KZW5kb2JqCjQgMCBvYmoKPDwKL1R5cGUgL0ZvbnQKL1N1YnR5cGUgL1R5cGUxCi9CYXNlRm9udCAvSGVsdmV0aWNhCj4+CmVuZG9iago1IDAgb2JqCjw8Ci9MZW5ndGggNDQKPj4Kc3RyZWFtCkJUCi9GMSAxMiBUZgoxMDAgNzAwIFRkCihIZWxsbyBXb3JsZCkgVGoKRVQKZW5kc3RyZWFtCmVuZG9iagp4cmVmCjAgNgowMDAwMDAwMDAwIDY1NTM1IGYgCjAwMDAwMDAwMDkgMDAwMDAgbiAKMDAwMDAwMDA1NCAwMDAwMCBuIAowMDAwMDAwMTAxIDAwMDAwIG4gCjAwMDAwMDAxNzAgMDAwMDAgbiAKMDAwMDAwMDI0NCAwMDAwMCBuIAp0cmFpbGVyCjw8Ci9TaXplIDYKL1Jvb3QgMSAwIFIKPj4Kc3RhcnR4cmVmCjM0MQolJUVPRg==",
"docName": "output.pdf"
}
Mit asynchroner Verarbeitung:
{
"docContent": "JVBERi0xLjQKJeLjz9MK...",
"docName": "output.pdf",
"async": true
}
Codebeispiele
Der PDF4me Dokument klassifizieren REST API Es werden Codebeispiele in verschiedenen Programmiersprachen bereitgestellt. Wählen Sie die Sprache, die am besten zu Ihrer Entwicklungsumgebung passt:
- C#
- Java
- JavaScript
- Python
- Salesforce
- n8n
- Google Script
- AWS Lambda
Java Probe
Java Implementierung mit vollständiger Fehlerbehandlung und Antwortverarbeitung:
Python Probe
Python Implementierung mit der Requests-Bibliothek und JSON Handhabung:
Google Script Probe
Google Apps Script Implementierung für Google Workspace Integration:
Merkmale der Dokumentenklassifizierung
Klassifizierungsfähigkeiten
- DokumenttyperkennungIdentifizierung von Dokumenttypen auf Basis der Inhaltsanalyse
- InhaltskategorisierungGruppierung von Dokumenten nach Inhalt und Zweck
- VorlagenerkennungIdentifizierung von Dokumentvorlagen und Standardformaten
- KonformitätsklassifizierungKlassifizierung für regulatorische und Compliance-Anforderungen
Unternehmensfunktionen
- Stapelverarbeitung: Mehrere Dokumente mit einheitlichen Klassifizierungsstandards verarbeiten
- Qualitätssicherung: Sicherstellung der Genauigkeit und Zuverlässigkeit der Klassifizierung für Geschäftsanwendungen
- IntegrationsbereitNahtlose Integration mit bestehenden Dokumentenmanagementsystemen
- Skalierbare Verarbeitung: Große Dokumentenmengen mit Leistung auf Unternehmensniveau verarbeiten
Branchenspezifische Anwendungsfälle und Anwendungen
- Document Management & Organization
- Compliance & Regulatory
- Business Process Automation
- Financial Services
- Healthcare & Medical
- Legal & Professional Services
Anwendungsfälle für Dokumentenmanagement und -organisation
- Automatisierte AblageAutomatische Klassifizierung und Organisation von Dokumenten in digitalen Ablagesystemen
- InhaltsverwaltungErweiterte Kategorisierung für Content-Management- und Abrufsysteme
- ArchivorganisationSystematische Klassifizierung historischer Dokumente und Aufzeichnungen
- SuchmaschinenoptimierungVerbesserte Dokumentensuche durch präzise Klassifizierung und Verschlagwortung
Anwendungsfälle im Bereich Compliance und Regulierung
- Vorbereitung auf die PrüfungAutomatische Dokumentenklassifizierung für Compliance- und Prüfungszwecke
- MeldepflichtenOptimierte Dokumentenverarbeitung für behördliche Einreichungen
- RechtsermittlungEffiziente Dokumentenklassifizierung für die juristische Beweissicherung und Prozessunterstützung
- RichtlinienkonformitätAutomatisierte Überprüfung der Übereinstimmung von Dokumenten mit den Organisationsrichtlinien
Anwendungsfälle für die Automatisierung von Geschäftsprozessen
- Workflow-RoutingAutomatische Weiterleitung von Dokumenten basierend auf Klassifizierungsergebnissen
- ProzessoptimierungOptimierte Dokumentenverarbeitungs-Workflows mit erweiterter Klassifizierung
- QualitätskontrolleAutomatisierte Überprüfung von Dokumententypen und Inhaltsgenauigkeit
- RessourcenzuweisungEffiziente Zuweisung von Verarbeitungsressourcen basierend auf Dokumenttypen
Anwendungsfälle im Finanzdienstleistungssektor
- RechnungsverarbeitungAutomatische Klassifizierung von Rechnungen, Quittungen und Finanzdokumenten
- KreditdokumentationOptimierte Bearbeitung von Kreditanträgen und dazugehörigen Unterlagen
- SteuererklärungAutomatisierte Klassifizierung von steuerbezogenen Dokumenten und Formularen
- Unterstützung bei AuditsEffiziente Dokumentenorganisation für Finanzprüfungen und -überprüfungen
Anwendungsfälle im Gesundheitswesen und in der Medizin
- PatientenaktenAutomatische Klassifizierung von Krankenakten und Patientendokumentation
- VersicherungsansprücheOptimierte Bearbeitung von Versicherungsansprüchen und medizinischen Unterlagen
- KonformitätsdokumentationAutomatisierte Klassifizierung zur Einhaltung regulatorischer Vorgaben im Gesundheitswesen
- ForschungsdatenSystematische Organisation von Dokumenten aus der medizinischen Forschung und klinischen Studien
Anwendungsfälle für Rechts- und Beratungsdienstleistungen
- VertragsmanagementAutomatische Klassifizierung von Verträgen und Rechtsvereinbarungen
- FalldokumentationEffiziente Organisation von Gerichtsakten und zugehörigen Dokumenten
- Überwachung der EinhaltungAutomatisierte Klassifizierung zur Einhaltung gesetzlicher Vorschriften und zur Überwachung
- KundendokumentationOptimierte Bearbeitung von Kundendateien und professioneller Dokumentation