Anhang extrahieren PDF - Dateiwiederherstellung API
PDF4me Anhang extrahieren PDF ermöglicht es Ihnen, alle eingebetteten Dateianhänge zu extrahieren PDF Dokumente. Diese API Serviceprozesse PDF Dateien und extrahiert eingebettete Dateien, Dokumente und Ressourcen aus PDF Dokumente. Die API empfängt PDF Inhalte durch REST API Anrufe, die genutzt werden Base64 Verschlüsselung für sichere Übertragung. Mit Unterstützung für das Extrahieren mehrerer Dateitypen aus PDF Für Dokumente ist diese Lösung ideal für Dokumentenmanagementsysteme und Workflows zur Dateiextraktion.
Authentifizierung Ihres API Anfrage
Um auf die PDF4me REST APIJede Anfrage muss die entsprechenden Authentifizierungsdaten enthalten. Die Authentifizierung gewährleistet eine sichere Kommunikation und bestätigt Ihre Identität als autorisierter Benutzer des Systems. REST APIDie
Hauptmerkmale
- Dateiextraktion: Alle eingebetteten Dateien, Dokumente und Ressourcen extrahieren aus PDF Dokumente
- Mehrere DateitypenUnterstützung für verschiedene Anhangsformate, darunter Text, Bilder, Dokumente und Archive
- Batch-Extraktion: Mehrere Anhänge aus einem einzelnen PDF Dokument in einem Arbeitsgang
- Base64 Kodierung: Sichere Übertragung von Dateiinhalten mithilfe von Base64 Kodierung
- Einfach API IntegrationRESTful API Entwickelt für automatisierte Dokumentenextraktions-Workflows
REST API Endpunkt
Der PDF4me REST API verwendet Standard HTTP Methoden zur Interaktion mit Ressourcen. Alle Operationen zum Extrahieren von Anhängen werden über einen einzigen Endpunkt durchgeführt:
- Verfahren: POST
- Endpunkt:
/api/v2/ExtractAttachmentFromPdf
REST API Parameter
Vollständige Liste der Parameter für „Anhang extrahieren von“ PDF REST APIDie Parameter sind zur besseren Verständlichkeit und Implementierung nach Kategorien geordnet.
Wichtig: Mit einem Sternchen (*) gekennzeichnete Parameter sind erforderlich und müssen angegeben werden. API um ordnungsgemäß zu funktionieren.
Erforderliche Parameter
| Parameter | Typ | Beschreibung | Beispiel |
|---|---|---|---|
| docContent* | Base64 (String) | Der Inhalt der Eingabe PDF Datei kodiert in Base64 Format für die Extraktion von Anhängen und die Verarbeitung der Dateiwiederherstellung | JVBERi... |
| docName* | String | Quelle PDF Dateiname mit korrekter .pdf-Erweiterung zur Dokumentenidentifizierung und Verarbeitung der Anhänge. | output.pdf |
Optionale Parameter
| Parameter | Typ | Beschreibung | Beispiel |
|---|---|---|---|
| async | Boolean | Aktivieren Sie die asynchrone Verarbeitung. Wenn true, Die API Rückgaben 202 Accepted mit einem Location Kopfzeile zum Abfragen des Ergebnisses | true |
Ausgabe
Der PDF4me Anhang extrahieren PDF REST API Die Antwort hängt vom Verarbeitungsmodus ab. API gibt extrahierte Anhangsdaten als JSON Antwort oder als ZIP Datei enthält alle extrahierten Anhänge.
- Success Response
- Asynchronous Processing
- Error Responses
- Response Format Details
Synchrone Verarbeitung (Standard)
Wann async Ist false oder nicht bereitgestellt, die API Gibt die extrahierten Anhangsergebnisse sofort zurück.
Statuscode: 200 OK
Antwortformat:
{
"outputDocuments": [
{
"fileName": "attachment1.txt",
"streamFile": "base64-encoded-file-content..."
},
{
"fileName": "attachment2.pdf",
"streamFile": "base64-encoded-file-content..."
}
]
}
Die Antwort enthält ein Array extrahierter Anhänge, von denen jeder eine fileName Und streamFile (Base64(kodierter Inhalt).
Asynchrone Verarbeitung
Wann async Ist true, Die API Das Dokument wird asynchron verarbeitet.
Erste Reaktion:
Statuscode: 202 Accepted
Antwort-Header:
Location: https://api.pdf4me.com/api/v2/ExtractAttachmentFromPdfStatus/{operationId}
Antworttext:
{
"traceId": "operation-trace-id"
}
Umfrageergebnisse:
Verwenden Sie die Location Überschrift URL zur Vervollständigung der Umfrage:
const response = await fetch(locationUrl, {
headers: { 'Authorization': 'Basic ' + apiKey }
});
// Continue polling until status code is 200
if (response.status === 200) {
const result = await response.json();
// Process extracted attachments
}
Fehlermeldungen
| Statuscode | Beschreibung | Beispielantwort |
|---|---|---|
| 400 Bad Request | Ungültige Anfrageparameter oder fehlende Pflichtfelder | {"error": "Missing required parameter: docContent"} |
| 401 Unauthorized | Ungültig oder fehlend API Schlüssel | {"error": "Unauthorized"} |
| 408 Anfrage-Timeout | Zeitüberschreitung bei der Anfrageverarbeitung | {"error": "Request timeout"} |
| 500 Internal Server Error | Serverfehler während der Verarbeitung | {"error": "Internal server error"} |
das Verständnis des JSON Antwort
Die Extraktionsantwort ist eine JSON Objekt, das ein Array extrahierter Anhänge enthält:
- Ausgabedokumente: Array extrahierte Anhangsobjekte
- DateinameDer Name der extrahierten Datei
- streamFile: Base64-kodierter Inhalt der extrahierten Datei
Alternative: ZIP Dateiantwort
In einigen Fällen API kann zurückgeben ZIP Datei, die alle extrahierten Anhänge enthält, anstatt JSON. Der ZIP Die Datei kann heruntergeladen und extrahiert werden, um auf die einzelnen Dateien zuzugreifen.
Dekodierung Base64 Inhalt:
Um den Code zu entschlüsseln Base64-kodierter Dateiinhalt von streamFile:
// JavaScript
const decoded = atob(base64String);
const blob = new Blob([decoded], { type: 'application/octet-stream' });
# Python
import base64
decoded = base64.b64decode(base64_string)
with open('extracted_file.txt', 'wb') as f:
f.write(decoded)
Beispielanfrage
Kopfzeile
Content-Type: application/json
Authorization: Basic YOUR_BASE64_ENCODED_API_KEY
Notiz:
- Hol dir deins API Schlüssel vom PDF4me Armaturenbrett
- Der API Der Schlüssel muss sein Base64 kodiert und mit "Basic" präfixiert in der Authorization Überschrift
- Beispiel: Wenn Ihr API Schlüssel ist
abc123, kodieren Sie es zu Base64 und verwendenAuthorization: Basic YWJjMTIz
Nutzlast
Grundlegende Anfrage:
{
"docContent": "JVBERi0xLjQKJeLjz9MKMSAwIG9iago8PAovVHlwZSAvQ2F0YWxvZwovUGFnZXMgMiAwIFIKPj4KZW5kb2JqCjIgMCBvYmoKPDwKL1R5cGUgL1BhZ2VzCi9LaWRzIFszIDAgUl0KL0NvdW50IDEKPD4KZW5kb2JqCjMgMCBvYmoKPDwKL1R5cGUgL1BhZ2UKL1BhcmVudCAyIDAgUgovTWVkaWFCb3ggWzAgMCA2MTIgNzkyXQovUmVzb3VyY2VzIDw8Ci9Gb250IDw8Ci9GMSA0IDAgUgo+Pgo+PgovQ29udGVudHMgNSAwIFIKPj4KZW5kb2JqCjQgMCBvYmoKPDwKL1R5cGUgL0ZvbnQKL1N1YnR5cGUgL1R5cGUxCi9CYXNlRm9udCAvSGVsdmV0aWNhCj4+CmVuZG9iago1IDAgb2JqCjw8Ci9MZW5ndGggNDQKPj4Kc3RyZWFtCkJUCi9GMSAxMiBUZgoxMDAgNzAwIFRkCihIZWxsbyBXb3JsZCkgVGoKRVQKZW5kc3RyZWFtCmVuZG9iagp4cmVmCjAgNgowMDAwMDAwMDAwIDY1NTM1IGYgCjAwMDAwMDAwMDkgMDAwMDAgbiAKMDAwMDAwMDA1NCAwMDAwMCBuIAowMDAwMDAwMTAxIDAwMDAwIG4gCjAwMDAwMDAxNzAgMDAwMDAgbiAKMDAwMDAwMDI0NCAwMDAwMCBuIAp0cmFpbGVyCjw8Ci9TaXplIDYKL1Jvb3QgMSAwIFIKPj4Kc3RhcnR4cmVmCjM0MQolJUVPRg==",
"docName": "output.pdf"
}
Mit asynchroner Verarbeitung:
{
"docContent": "JVBERi0xLjQKJeLjz9MK...",
"docName": "output.pdf",
"async": true
}
Codebeispiele
Der PDF4me Anhang extrahieren PDF REST API Es werden Codebeispiele in verschiedenen Programmiersprachen bereitgestellt. Wählen Sie die Sprache, die am besten zu Ihrer Entwicklungsumgebung passt:
- C#
- Java
- JavaScript
- Python
- Salesforce
- n8n
- Google Script
- AWS Lambda
C# (CSharp) Beispiel
Vollständig C# Implementierung zum Extrahieren von Anhängen aus PDF:
Java Probe
Java Implementierung mit vollständiger Fehlerbehandlung und Antwortverarbeitung:
Python Probe
Python Implementierung mit der Requests-Bibliothek und JSON Handhabung:
Google Script Probe
Google Apps Script Implementierung für Google Workspace Integration:
Funktionen zum Entfernen von Anbauteilen
Funktionen zur Dateiwiederherstellung
- Vollständige Extraktion: Alle eingebetteten Dateien und Ressourcen extrahieren aus PDF Dokumente
- DateityperkennungAutomatische Erkennung eingebetteter Dateitypen und -formate
- Metadatenerhaltung: Beibehalten der ursprünglichen Dateinamen, Erstellungsdaten und Eigenschaften
- Qualitätssicherung: Sicherstellen der Dateiintegrität und ordnungsgemäßen Extraktion ohne Datenbeschädigung.
Dokumentenverarbeitung
- PDF Analyse: Tiefgehende Analyse von PDF Struktur zur Lokalisierung eingebetteter Anbauteile
- RessourcenidentifizierungIntelligente Erkennung verschiedener eingebetteter Dateitypen
- Batch-Extraktion: Mehrere Anhänge von einem einzigen PDF in einem Vorgang
- Sichere VerarbeitungSichere Extraktion mit Dateiintegritätsprüfung
Erweiterte Funktionen
- Unterstützung mehrerer Formate: Dokumente, Bilder, Archive und Multimediadateien extrahieren
- Dateiorganisation: Achten Sie während der Extraktion auf eine korrekte Dateibenennung und -organisation.
- Inhaltsvalidierung: Überprüfen Sie die Integrität und Vollständigkeit der extrahierten Datei
- Professionelle ErgebnisseHochwertige Extraktion, geeignet für Unternehmensanwendungen
Branchenspezifische Anwendungsfälle und Anwendungen
- Document Management & Recovery
- Legal & Compliance
- Business & Finance
- Technical & Engineering
- Healthcare & Medical
Anwendungsfälle für Dokumentenmanagement und -wiederherstellung
- Archivwiederherstellung: Dateien aus archivierten PDF-Dokumenten zur Datenwiederherstellung extrahieren
- Inhaltsverwaltung: Eingebettete Ressourcen aus Dokumentenmanagementsystemen abrufen
- Dateiorganisation: Dateien aus komplexen PDF-Paketen extrahieren und organisieren
- Datenmigration: Anhänge während der Dokumentenmigration extrahieren
Anwendungsfälle im Bereich Recht und Compliance
- Beweissicherung: Belege und Beweismittel aus juristischen PDFs extrahieren
- Konformitätsdokumentation: Abruf von behördlichen Dokumenten und Zertifikaten
- Unterstützung bei Audits: Prüfprotokolle und Begleitmaterialien extrahieren
- RechtsermittlungWiederherstellung eingebetteter Dateien für rechtliche Ermittlungsverfahren
Anwendungsfälle im Bereich Wirtschaft und Finanzen
- Rechnungsverarbeitung: Belege aus Rechnungs-PDFs extrahieren
- Vertragsmanagement: Vertragsanlagen und -änderungen abrufen
- Finanzberichterstattung: Unterstützende Tabellen und Berichte extrahieren
- Dokumentenanalyse: Analyse eingebetteter Inhalte für Business Intelligence
Technische und ingenieurwissenschaftliche Anwendungsfälle
- Technische Dokumentation: Codebeispiele, Spezifikationen und Diagramme extrahieren
- Projektdateien: Projektressourcen und Begleitmaterialien abrufen
- Design-Assets: Bilder, CAD-Dateien und Designressourcen extrahieren
- Forschungsdaten: Datensätze und Forschungsmaterialien aus PDFs wiederherstellen
Anwendungsfälle im Gesundheitswesen und in der Medizin
- Krankenakten: Patientenakten und medizinische Dokumentation extrahieren
- Forschungsdaten: Abrufen von Daten aus klinischen Studien und Forschungsmaterialien
- Konformitätsdateien: Regulatorische Dokumente und Zertifizierungen extrahieren
- Patientenversorgung: Medizinische Bilder und Berichte als Unterstützung wiederherstellen