Ekstrak Lampiran dari PDF - Pemulihan File API
PDF4me Ekstrak Lampiran Dari PDF memungkinkan Anda untuk mengekstrak semua lampiran file yang tertanam di dalamnya PDF dokumen. Ini API proses layanan PDF mengambil dan mengekstrak file, dokumen, dan sumber daya yang tertanam dari PDF dokumen. Itu API menerima PDF konten melalui REST API panggilan, memanfaatkan Base64 Pengkodean untuk transmisi yang aman. Dengan dukungan untuk mengekstrak berbagai jenis file dari PDF Untuk dokumen, solusi ini ideal untuk sistem manajemen dokumen dan alur kerja ekstraksi file.
Memverifikasi Identitas Anda API Meminta
Untuk mengakses PDF4me REST APISetiap permintaan harus menyertakan kredensial otentikasi yang tepat. Otentikasi memastikan komunikasi yang aman dan memvalidasi identitas Anda sebagai pengguna yang berwenang. REST API.
Fitur Utama
- Ekstraksi FileEkstrak semua file, dokumen, dan sumber daya yang tertanam dari PDF dokumen
- Berbagai Jenis File: Mendukung berbagai format lampiran termasuk teks, gambar, dokumen, dan arsip
- Ekstraksi BatchEkstrak beberapa lampiran dari satu file PDF dokumen dalam satu operasi
- Base64 Pengkodean: Transmisi konten file yang aman menggunakan Base64 pengkodean
- Sederhana API Integrasi: RESTful API dirancang untuk alur kerja ekstraksi dokumen otomatis
REST API Titik akhir
Yang PDF4me REST API menggunakan standar HTTP Metode untuk berinteraksi dengan sumber daya. Semua operasi ekstraksi lampiran dilakukan melalui satu titik akhir:
- Metode: POST
- Titik akhir:
/api/v2/ExtractAttachmentFromPdf
REST API Parameter
Daftar lengkap parameter untuk Ekstrak Lampiran Dari PDF REST APIParameter-parameter tersebut diorganisir berdasarkan kategori untuk pemahaman dan implementasi yang lebih baik.
Penting: Parameter yang ditandai dengan tanda bintang (*) wajib diisi dan harus diberikan agar dapat digunakan. API agar berfungsi dengan benar.
Parameter yang Diperlukan
| Parameter | Jenis | Keterangan | Contoh |
|---|---|---|---|
| docContent* | Base64 (String) | Isi dari input PDF berkas yang dikodekan dalam Base64 format untuk ekstraksi lampiran dan pemrosesan pemulihan file | JVBERi... |
| docName* | String | Sumber PDF Nama file dengan ekstensi .pdf yang tepat untuk identifikasi dokumen dan pemrosesan ekstraksi lampiran. | output.pdf |
Parameter Opsional
| Parameter | Jenis | Keterangan | Contoh |
|---|---|---|---|
| async | Boolean | Aktifkan pemrosesan asinkron. Saat true, itu API pengembalian 202 Accepted dengan Location header untuk mengambil hasil polling | true |
Keluaran
Yang PDF4me Ekstrak Lampiran Dari PDF REST API Mengembalikan respons yang berbeda berdasarkan mode pemrosesan. API mengembalikan data lampiran yang diekstrak sebagai JSON tanggapan atau sebagai ZIP berkas berisi semua lampiran yang diekstrak.
- Success Response
- Asynchronous Processing
- Error Responses
- Response Format Details
Pemrosesan Sinkron (Default)
Kapan async adalah false atau tidak disediakan, maka API Mengembalikan hasil lampiran yang diekstrak secara langsung.
Kode Status: 200 OK
Format Tanggapan:
{
"outputDocuments": [
{
"fileName": "attachment1.txt",
"streamFile": "base64-encoded-file-content..."
},
{
"fileName": "attachment2.pdf",
"streamFile": "base64-encoded-file-content..."
}
]
}
Respons tersebut berisi serangkaian lampiran yang diekstrak, masing-masing dengan sebuah fileName Dan streamFile (Base64-konten yang dikodekan).
Pemrosesan Asinkron
Kapan async adalah true, itu API memproses dokumen secara asinkron.
Tanggapan Awal:
Kode Status: 202 Accepted
Header Respons:
Location: https://api.pdf4me.com/api/v2/ExtractAttachmentFromPdfStatus/{operationId}
Isi Tanggapan:
{
"traceId": "operation-trace-id"
}
Jajak Pendapat untuk Mendapatkan Hasil:
Gunakan Location judul URL untuk melakukan jajak pendapat guna memastikan kelengkapannya:
const response = await fetch(locationUrl, {
headers: { 'Authorization': 'Basic ' + apiKey }
});
// Continue polling until status code is 200
if (response.status === 200) {
const result = await response.json();
// Process extracted attachments
}
Respons Kesalahan
| Kode Status | Keterangan | Contoh Jawaban |
|---|---|---|
| 400 Bad Request | Parameter permintaan tidak valid atau kolom wajib hilang. | {"error": "Missing required parameter: docContent"} |
| 401 Unauthorized | Tidak valid atau hilang API kunci | {"error": "Unauthorized"} |
| 408 Permintaan Habis Waktu | Batas waktu pemrosesan permintaan | {"error": "Request timeout"} |
| 500 Internal Server Error | Terjadi kesalahan server selama pemrosesan. | {"error": "Internal server error"} |
Memahami JSON Tanggapan
Respons ekstraksi adalah JSON objek yang berisi array lampiran yang diekstrak:
- dokumen keluaran: Array dari objek lampiran yang diekstrak
- nama file: Nama file yang diekstrak
- streamFile: Base64-konten yang dikodekan dari file yang diekstrak
Alternatif: ZIP Respons File
Dalam beberapa kasus, API mungkin mengembalikan ZIP berkas yang berisi semua lampiran yang diekstrak, bukan JSON. Itu ZIP File dapat diunduh dan diekstrak untuk mengakses file individual.
Mendekode Base64 Isi:
Untuk mendekode Base64-konten file yang dikodekan dari streamFile:
// JavaScript
const decoded = atob(base64String);
const blob = new Blob([decoded], { type: 'application/octet-stream' });
# Python
import base64
decoded = base64.b64decode(base64_string)
with open('extracted_file.txt', 'wb') as f:
f.write(decoded)
Contoh Permintaan
Judul
Content-Type: application/json
Authorization: Basic YOUR_BASE64_ENCODED_API_KEY
Catatan:
- Dapatkan milikmu API kunci dari PDF4me Dasbor
- Yang API kunci harus Base64 dikodekan dan diawali dengan "Basic" di dalam Authorization judul
- Contoh: Jika Anda API kuncinya adalah
abc123, mengkodekannya menjadi Base64 dan menggunakanAuthorization: Basic YWJjMTIz
Muatan
Permintaan Dasar:
{
"docContent": "JVBERi0xLjQKJeLjz9MKMSAwIG9iago8PAovVHlwZSAvQ2F0YWxvZwovUGFnZXMgMiAwIFIKPj4KZW5kb2JqCjIgMCBvYmoKPDwKL1R5cGUgL1BhZ2VzCi9LaWRzIFszIDAgUl0KL0NvdW50IDEKPD4KZW5kb2JqCjMgMCBvYmoKPDwKL1R5cGUgL1BhZ2UKL1BhcmVudCAyIDAgUgovTWVkaWFCb3ggWzAgMCA2MTIgNzkyXQovUmVzb3VyY2VzIDw8Ci9Gb250IDw8Ci9GMSA0IDAgUgo+Pgo+PgovQ29udGVudHMgNSAwIFIKPj4KZW5kb2JqCjQgMCBvYmoKPDwKL1R5cGUgL0ZvbnQKL1N1YnR5cGUgL1R5cGUxCi9CYXNlRm9udCAvSGVsdmV0aWNhCj4+CmVuZG9iago1IDAgb2JqCjw8Ci9MZW5ndGggNDQKPj4Kc3RyZWFtCkJUCi9GMSAxMiBUZgoxMDAgNzAwIFRkCihIZWxsbyBXb3JsZCkgVGoKRVQKZW5kc3RyZWFtCmVuZG9iagp4cmVmCjAgNgowMDAwMDAwMDAwIDY1NTM1IGYgCjAwMDAwMDAwMDkgMDAwMDAgbiAKMDAwMDAwMDA1NCAwMDAwMCBuIAowMDAwMDAwMTAxIDAwMDAwIG4gCjAwMDAwMDAxNzAgMDAwMDAgbiAKMDAwMDAwMDI0NCAwMDAwMCBuIAp0cmFpbGVyCjw8Ci9TaXplIDYKL1Jvb3QgMSAwIFIKPj4Kc3RhcnR4cmVmCjM0MQolJUVPRg==",
"docName": "output.pdf"
}
Dengan Pemrosesan Asinkron:
{
"docContent": "JVBERi0xLjQKJeLjz9MK...",
"docName": "output.pdf",
"async": true
}
Contoh Kode
Yang PDF4me Ekstrak Lampiran Dari PDF REST API Menyediakan contoh kode dalam berbagai bahasa pemrograman. Pilih bahasa yang paling sesuai dengan lingkungan pengembangan Anda:
- C#
- Java
- JavaScript
- Python
- Salesforce
- n8n
- Google Script
- AWS Lambda
Java Contoh
Java Implementasi dengan penanganan kesalahan dan pemrosesan respons yang lengkap:
JavaScript Contoh
Node.js dan kompatibel dengan browser JavaScript implementasi:
Google Script Contoh
Google Apps Script implementasi untuk Google Workspace integrasi:
Fitur Ekstraksi Lampiran
Kemampuan Pemulihan File
- Ekstraksi LengkapEkstrak semua file dan sumber daya yang tertanam dari PDF dokumen
- Deteksi Jenis FileIdentifikasi otomatis tipe dan format file yang disematkan
- Pelestarian MetadataPertahankan nama file asli, tanggal pembuatan, dan properti.
- Jaminan MutuPastikan integritas file dan ekstraksi yang tepat tanpa kerusakan.
Pemrosesan Dokumen
- PDF AnalisisAnalisis mendalam tentang PDF struktur untuk menemukan lampiran yang tertanam
- Identifikasi Sumber DayaDeteksi cerdas berbagai jenis file tersemat
- Ekstraksi Batch: Memproses beberapa lampiran dari satu PDF dalam satu operasi
- Pemrosesan AmanEkstraksi aman dengan verifikasi integritas file.
Fitur Lanjutan
- Dukungan Berbagai FormatEkstrak dokumen, gambar, arsip, dan file multimedia.
- Pengorganisasian File: Pertahankan penamaan dan pengorganisasian file yang tepat selama ekstraksi
- Validasi KontenVerifikasi integritas dan kelengkapan file yang diekstrak.
- Hasil ProfesionalEkstraksi berkualitas tinggi yang cocok untuk aplikasi perusahaan.
Studi Kasus & Aplikasi Industri
- Document Management & Recovery
- Legal & Compliance
- Business & Finance
- Technical & Engineering
- Healthcare & Medical
Studi Kasus Manajemen & Pemulihan Dokumen
- Pemulihan ArsipEkstrak file dari dokumen PDF yang diarsipkan untuk pemulihan data.
- Manajemen KontenMengambil sumber daya tersemat dari sistem manajemen dokumen.
- Pengorganisasian FileEkstrak dan atur file dari paket PDF yang kompleks.
- Migrasi DataEkstrak lampiran selama proses migrasi dokumen.
Studi Kasus Hukum & Kepatuhan
- Pemulihan BuktiEkstrak dokumen pendukung dan bukti dari PDF hukum.
- Dokumentasi KepatuhanMengambil dokumen dan sertifikat peraturan.
- Dukungan AuditEkstrak jejak audit dan materi pendukung.
- Penemuan Hukum: Memulihkan file tersemat untuk proses penemuan hukum
Studi Kasus Bisnis & Keuangan
- Pemrosesan FakturEkstrak dokumen pendukung dari PDF faktur.
- Manajemen KontrakMengambil lampiran dan amandemen kontrak
- Pelaporan KeuanganEkstrak spreadsheet dan laporan pendukung.
- Analisis DokumenAnalisis konten tersemat untuk intelijen bisnis.
Kasus Penggunaan Teknis & Rekayasa
- Dokumentasi TeknisEkstrak contoh kode, spesifikasi, dan diagram.
- Berkas ProyekMengambil sumber daya proyek dan materi pendukung
- Aset DesainEkstrak gambar, file CAD, dan sumber daya desain.
- Data Penelitian: Memulihkan kumpulan data dan materi penelitian dari PDF
Kasus Penggunaan di Bidang Kesehatan & Medis
- Rekam medis: Mengekstrak berkas pasien dan dokumentasi medis
- Data PenelitianMengambil data uji klinis dan materi penelitian.
- Berkas Kepatuhan: Mengekstrak dokumen dan sertifikasi peraturan
- Perawatan Pasien: Memulihkan gambar dan laporan medis pendukung