Lewati ke konten utama

Ekstrak Sumber Daya dari PDF menggunakan n8n tindakan

PDF4me Ekstrak Sumber Daya mengekstrak konten teks dan gambar yang disematkan dari PDF dokumen melalui n8n Alur kerja otomatisasi. Proses PDFpergi n8n pemicu, data biner, string base64, atau publik URLSolusi ini secara otomatis mengekstrak teks, gambar, grafik, dan elemen visual dengan penargetan khusus halaman, opsi ekstraksi selektif (hanya teks, hanya gambar, atau keduanya), dan format output terstruktur. Solusi ini ideal untuk alur kerja penggunaan kembali konten, ekstraksi gambar, analisis teks, digitalisasi dokumen, migrasi konten, dan pemulihan sumber daya yang membutuhkan ekstraksi konten yang akurat dengan penargetan yang fleksibel dan integrasi yang mulus.

Postingan Blog Terkait
Belum ada postingan blog untuk fitur ini — akan segera hadir.
Sementara itu, jelajahi blog PDF4me untuk menemukan tutorial dan alur kerja di berbagai platform.
Kunjungi blog ini

Pengaturan

Tambahkan PDF4me Tambahkan node "Ekstrak Sumber Daya" ke n8n alur kerja dan konfigurasikan parameter yang diperlukan. Untuk petunjuk pengaturan awal, lihat halaman kami. n8n Panduan Integrasi.

Prasyarat:

  • PDF4me API kredensial
  • n8n akses alur kerja

Konfigurasi:

  1. Menambahkan PDF4me simpul ke alur kerja
  2. Pilih tindakan "Ekstrak Sumber Daya"
  3. Konfigurasikan parameter input (lihat di bawah)
Konfigurasi Ekstrak Sumber Daya

Parameter

Daftar lengkap parameter untuk tindakan Ekstraksi Sumber Daya. Konfigurasikan parameter ini untuk mengontrol ekstraksi sumber daya.

Penting: Parameter yang ditandai dengan tanda bintang (***) wajib diisi dan harus diberikan agar tindakan dapat berfungsi dengan benar.

ParameterJenisKeteranganContoh
Tipe Data Masukan***StringPDF Pemilihan Format Input
• Pilih format Anda PDF masukan data
PDF4me mendukung berbagai tipe input
• Opsi: Data Biner, Base64 Tali, atau URL
Binary Data
Bidang Biner MasukanBinerBiner PDF Masukan Berkas (Diperlukan jika Data Biner)
• Referensi PDF berkas dari sebelumnya n8n unggahan node atau file
PDF4me proses biner PDF file dengan deteksi format otomatis
• Diperlukan jika Tipe Data Input adalah "Data Biner"
{{ $binary.data }}
Konten PDF Base64StringBase64 Dikodekan PDF Masukan (Diperlukan jika) Base64 Rangkaian)
• Menyediakan PDF konten sebagai string yang dikodekan base64
PDF4me secara otomatis mendekode dan memproses PDF isi
• Diperlukan ketika Tipe Data Input adalah "Base64 Rangkaian"
JVBERi0x...
URL PDFStringPublik PDF URL Masukan (Diperlukan jika) URL)
• Berikan izin publik/terbuka URL ke PDF berkas
PDF4me mengunduh dan memproses file dari URL
• Diperlukan ketika Tipe Data Input adalah "URL"
https://abc.com/xyz.pdf
Nama Dokumen***StringNama File Masukan
• Tentukan nama input PDF berkas
• Digunakan untuk deteksi format dan optimasi pemrosesan
• Harus menyertakan ekstensi .pdf
document.pdf
Kutipan TeksBooleanTombol Pengaktifan Ekstraksi Teks
• Mengaktifkan atau menonaktifkan ekstraksi konten teks
• Saat diaktifkan, mengekstrak semua konten teks yang dapat dibaca.
• Mempertahankan informasi format
true
Ekstrak GambarBooleanTombol Pengaktifan Ekstraksi Gambar
• Mengaktifkan atau menonaktifkan ekstraksi gambar
• Saat diaktifkan, mengekstrak semua gambar dan grafik yang tertanam
• Elemen visual disimpan sebagai file terpisah
true

Opsi Lanjutan

Parameter berikut tersedia di bagian Opsi Lanjutan dan bersifat opsional:

ParameterJenisKeteranganContoh
HalamanStringSpesifikasi Rentang Halaman
• Tentukan halaman mana yang akan diproses untuk ekstraksi sumber daya.
• Gunakan "all" untuk seluruh dokumen, nomor tertentu, atau rentang nomor.
• Contoh: "1,3,5" (halaman tertentu), "1-5,10-15" (rentang)
all
Profil KustomStringProfil Konfigurasi Kustom
• Atur opsi tambahan menggunakan profil khusus
JSONformat seperti yang berisi parameter yang telah ditentukan sebelumnya
• Mengaktifkan pengaturan pemrosesan ekstraksi tingkat lanjut
• Opsional untuk kebutuhan khusus
{ "outputDataFormat": "json" }

Keluaran

Parameter Keluaran

ParameterJenisKeteranganContoh
nama fileStringPDF4me nama file yang dihasilkan - Nama file lengkap dari dokumen yang berhasil diproses beserta ekstensi dan stempel waktu yang tepat. PDF4me Memastikan penamaan yang unik dan memvalidasi kepatuhan format file untuk integrasi yang lancar dengan proses selanjutnya.extracted_resources_1756999816629.json
mimeTypeStringPDF4me MIME pengidentifikasi tipe - Standarisasi MIME tipe untuk file konten yang diekstrak, biasanya application/json untuk data terstruktur atau application/zip untuk beberapa file. Ini memastikan penanganan dan pengenalan file yang tepat di semua sistem dan aplikasi.application/json
Ukuran berkasNomorPDF4me ukuran file dalam byte - Ukuran pasti file konten yang diekstrak dalam byte, disediakan untuk perencanaan penyimpanan, optimasi bandwidth, dan pemantauan transfer file. Penting untuk manajemen dokumen perusahaan dan otomatisasi alur kerja.1945
kesuksesanBooleanPDF4me indikator status ekstraksi - Bendera Boolean yang menunjukkan keberhasilan atau kegagalan proses ekstraksi sumber daya. Mengembalikan true untuk keberhasilan ekstraksi dan false untuk setiap kesalahan, memungkinkan penanganan kesalahan yang andal dalam alur kerja otomatis.true
pesanStringPDF4me pesan status ekstraksi - Pesan deskriptif yang menunjukkan hasil proses ekstraksi sumber daya. Memberikan pesan status yang jelas untuk ekstraksi yang berhasil dan informasi kesalahan terperinci untuk tujuan pemecahan masalah.Resource extraction completed successfully
Nama dokumenStringPDF4me referensi nama dokumen asli - Nama file asli dari input PDF berkas yang telah diproses. Referensi ini dipelihara untuk jejak audit, tujuan debugging, dan pelacakan sumber konten yang diekstrak dalam alur kerja perusahaan.document.pdf

N8N Tindakan dan Respons

Yang PDF4me Ekstrak Sumber Daya API Mengembalikan respons yang dapat dilihat dalam berbagai format. Pilih tampilan yang paling sesuai dengan kebutuhan Anda:

JSON Format Respons

Mentah JSON tanggapan dari API:

{
"fileName": "extracted_resources_1756999816629.json",
"mimeType": "application/json",
"fileSize": 1945,
"success": true,
"message": "Resource extraction completed successfully",
"docName": "document.pdf"
}

Kasus Penggunaan

Sistem Manajemen KontenEkstrak teks dan gambar dari PDF dokumen untuk repositori konten terpusat, memungkinkan basis data konten dokumen yang dapat dicari.

Saluran Pemrosesan DataEkstrak data terstruktur secara otomatis dari PDF Laporan, faktur, dan formulir untuk integrasi dengan alat intelijen bisnis dan platform analitik.

Analisis Dokumen: Memproses volume besar PDF dokumen untuk mengekstrak informasi spesifik untuk pemantauan kepatuhan, penelitian, dan pelaporan otomatis.

Digitalisasi ArsipKonversi warisan PDF Mengarsipkan data terstruktur yang dapat dicari untuk sistem manajemen konten dan penemuan pengetahuan modern.

Dapatkan Bantuan