Ekstrak Sumber Daya dari PDF menggunakan n8n tindakan
PDF4me Ekstrak Sumber Daya mengekstrak konten teks dan gambar yang disematkan dari PDF dokumen melalui n8n Alur kerja otomatisasi. Proses PDFpergi n8n pemicu, data biner, string base64, atau publik URLSolusi ini secara otomatis mengekstrak teks, gambar, grafik, dan elemen visual dengan penargetan khusus halaman, opsi ekstraksi selektif (hanya teks, hanya gambar, atau keduanya), dan format output terstruktur. Solusi ini ideal untuk alur kerja penggunaan kembali konten, ekstraksi gambar, analisis teks, digitalisasi dokumen, migrasi konten, dan pemulihan sumber daya yang membutuhkan ekstraksi konten yang akurat dengan penargetan yang fleksibel dan integrasi yang mulus.
Pengaturan
Tambahkan PDF4me Tambahkan node "Ekstrak Sumber Daya" ke n8n alur kerja dan konfigurasikan parameter yang diperlukan. Untuk petunjuk pengaturan awal, lihat halaman kami. n8n Panduan Integrasi.
Prasyarat:
- PDF4me API kredensial
- n8n akses alur kerja
Konfigurasi:
- Menambahkan PDF4me simpul ke alur kerja
- Pilih tindakan "Ekstrak Sumber Daya"
- Konfigurasikan parameter input (lihat di bawah)

Parameter
Daftar lengkap parameter untuk tindakan Ekstraksi Sumber Daya. Konfigurasikan parameter ini untuk mengontrol ekstraksi sumber daya.
Penting: Parameter yang ditandai dengan tanda bintang (***) wajib diisi dan harus diberikan agar tindakan dapat berfungsi dengan benar.
| Parameter | Jenis | Keterangan | Contoh |
|---|---|---|---|
| Tipe Data Masukan*** | String | PDF Pemilihan Format Input • Pilih format Anda PDF masukan data • PDF4me mendukung berbagai tipe input • Opsi: Data Biner, Base64 Tali, atau URL | Binary Data |
| Bidang Biner Masukan | Biner | Biner PDF Masukan Berkas (Diperlukan jika Data Biner) • Referensi PDF berkas dari sebelumnya n8n unggahan node atau file • PDF4me proses biner PDF file dengan deteksi format otomatis • Diperlukan jika Tipe Data Input adalah "Data Biner" | {{ $binary.data }} |
| Konten PDF Base64 | String | Base64 Dikodekan PDF Masukan (Diperlukan jika) Base64 Rangkaian) • Menyediakan PDF konten sebagai string yang dikodekan base64 • PDF4me secara otomatis mendekode dan memproses PDF isi • Diperlukan ketika Tipe Data Input adalah "Base64 Rangkaian" | JVBERi0x... |
| URL PDF | String | Publik PDF URL Masukan (Diperlukan jika) URL) • Berikan izin publik/terbuka URL ke PDF berkas • PDF4me mengunduh dan memproses file dari URL • Diperlukan ketika Tipe Data Input adalah "URL" | https://abc.com/xyz.pdf |
| Nama Dokumen*** | String | Nama File Masukan • Tentukan nama input PDF berkas • Digunakan untuk deteksi format dan optimasi pemrosesan • Harus menyertakan ekstensi .pdf | document.pdf |
| Kutipan Teks | Boolean | Tombol Pengaktifan Ekstraksi Teks • Mengaktifkan atau menonaktifkan ekstraksi konten teks • Saat diaktifkan, mengekstrak semua konten teks yang dapat dibaca. • Mempertahankan informasi format | true |
| Ekstrak Gambar | Boolean | Tombol Pengaktifan Ekstraksi Gambar • Mengaktifkan atau menonaktifkan ekstraksi gambar • Saat diaktifkan, mengekstrak semua gambar dan grafik yang tertanam • Elemen visual disimpan sebagai file terpisah | true |
Opsi Lanjutan
Parameter berikut tersedia di bagian Opsi Lanjutan dan bersifat opsional:
| Parameter | Jenis | Keterangan | Contoh |
|---|---|---|---|
| Halaman | String | Spesifikasi Rentang Halaman • Tentukan halaman mana yang akan diproses untuk ekstraksi sumber daya. • Gunakan "all" untuk seluruh dokumen, nomor tertentu, atau rentang nomor. • Contoh: "1,3,5" (halaman tertentu), "1-5,10-15" (rentang) | all |
| Profil Kustom | String | Profil Konfigurasi Kustom • Atur opsi tambahan menggunakan profil khusus • JSONformat seperti yang berisi parameter yang telah ditentukan sebelumnya • Mengaktifkan pengaturan pemrosesan ekstraksi tingkat lanjut • Opsional untuk kebutuhan khusus | { "outputDataFormat": "json" } |
Keluaran
Parameter Keluaran
| Parameter | Jenis | Keterangan | Contoh |
|---|---|---|---|
| nama file | String | PDF4me nama file yang dihasilkan - Nama file lengkap dari dokumen yang berhasil diproses beserta ekstensi dan stempel waktu yang tepat. PDF4me Memastikan penamaan yang unik dan memvalidasi kepatuhan format file untuk integrasi yang lancar dengan proses selanjutnya. | extracted_resources_1756999816629.json |
| mimeType | String | PDF4me MIME pengidentifikasi tipe - Standarisasi MIME tipe untuk file konten yang diekstrak, biasanya application/json untuk data terstruktur atau application/zip untuk beberapa file. Ini memastikan penanganan dan pengenalan file yang tepat di semua sistem dan aplikasi. | application/json |
| Ukuran berkas | Nomor | PDF4me ukuran file dalam byte - Ukuran pasti file konten yang diekstrak dalam byte, disediakan untuk perencanaan penyimpanan, optimasi bandwidth, dan pemantauan transfer file. Penting untuk manajemen dokumen perusahaan dan otomatisasi alur kerja. | 1945 |
| kesuksesan | Boolean | PDF4me indikator status ekstraksi - Bendera Boolean yang menunjukkan keberhasilan atau kegagalan proses ekstraksi sumber daya. Mengembalikan true untuk keberhasilan ekstraksi dan false untuk setiap kesalahan, memungkinkan penanganan kesalahan yang andal dalam alur kerja otomatis. | true |
| pesan | String | PDF4me pesan status ekstraksi - Pesan deskriptif yang menunjukkan hasil proses ekstraksi sumber daya. Memberikan pesan status yang jelas untuk ekstraksi yang berhasil dan informasi kesalahan terperinci untuk tujuan pemecahan masalah. | Resource extraction completed successfully |
| Nama dokumen | String | PDF4me referensi nama dokumen asli - Nama file asli dari input PDF berkas yang telah diproses. Referensi ini dipelihara untuk jejak audit, tujuan debugging, dan pelacakan sumber konten yang diekstrak dalam alur kerja perusahaan. | document.pdf |
N8N Tindakan dan Respons
Yang PDF4me Ekstrak Sumber Daya API Mengembalikan respons yang dapat dilihat dalam berbagai format. Pilih tampilan yang paling sesuai dengan kebutuhan Anda:
- JSON
- Table
- Schema
- Binary
JSON Format Respons
Mentah JSON tanggapan dari API:
{
"fileName": "extracted_resources_1756999816629.json",
"mimeType": "application/json",
"fileSize": 1945,
"success": true,
"message": "Resource extraction completed successfully",
"docName": "document.pdf"
}
Tampilan Tabel
Data respons dalam format tabel terstruktur:
| Parameter | Nilai |
|---|---|
| fileName | extracted_resources_1756999816629.json |
| mimeType | application/json |
| fileSize | 1945 |
| success | true |
| docName | document.pdf |
| message | Resource extraction completed successfully |
Tampilan Skema
Struktur data dan tipe respons:
fileName: AB extracted_resources_1756999816629.json
mimeType: AB application/json
fileSize: # 1945
success: ✓ true
docName: AB document.pdf
message: AB Resource extraction completed successfully
Indikator Tipe:
AB= String#= Angka✓= Boolean
Tampilan Data Biner
Data konten dan metadata yang sebenarnya diekstrak:
data
─────────────────────────────────────────
File Name: extracted_resources_1756999816629.json
File Extension: json
Mime Type: application/json
File Size: 1.9 KB
Kasus Penggunaan
Sistem Manajemen KontenEkstrak teks dan gambar dari PDF dokumen untuk repositori konten terpusat, memungkinkan basis data konten dokumen yang dapat dicari.
Saluran Pemrosesan DataEkstrak data terstruktur secara otomatis dari PDF Laporan, faktur, dan formulir untuk integrasi dengan alat intelijen bisnis dan platform analitik.
Analisis Dokumen: Memproses volume besar PDF dokumen untuk mengekstrak informasi spesifik untuk pemantauan kepatuhan, penelitian, dan pelaporan otomatis.
Digitalisasi ArsipKonversi warisan PDF Mengarsipkan data terstruktur yang dapat dicari untuk sistem manajemen konten dan penemuan pengetahuan modern.