Mengubah PDF menjadi Dapat Diedit PDF Menggunakan OCR menggunakan n8n tindakan
PDF4me Mengubah PDF menjadi Dapat Diedit PDF Menggunakan OCR transformasi yang dipindai PDFmengubah dokumen berbasis gambar dan teks menjadi dokumen yang dapat dicari dan diedit. PDFmelalui n8n Alur kerja otomatisasi. Proses PDFpergi n8n pemicu, data biner, string base64, atau publik URLuntuk melamar OCR teknologi dengan dukungan multibahasa, pemilihan tingkat kualitas (Draf/Tinggi), bersyarat OCR Pemrosesan, pembuatan lapisan teks, pelestarian tata letak, dan pembuatan konten yang dapat dicari. Solusi ini ideal untuk digitalisasi dokumen, pemrosesan dokumen hasil pemindaian, dan pembuatan faktur. OCR, konversi arsip, dapat dicari PDF pembuatan, dan otomatis OCR alur kerja yang membutuhkan pengenalan teks yang akurat dengan format yang terjaga dan integrasi yang mulus.
Pengaturan
Tambahkan PDF4me "Mengubah PDF menjadi Dapat Diedit PDF Menggunakan OCR" simpul untuk Anda n8n alur kerja dan konfigurasikan parameter yang diperlukan. Untuk petunjuk pengaturan awal, lihat halaman kami. n8n Panduan Integrasi.
Prasyarat:
- PDF4me API kredensial
- n8n akses alur kerja
Konfigurasi:
- Menambahkan PDF4me simpul ke alur kerja
- Pilih "Konversi" PDF menjadi Dapat Diedit PDF Menggunakan OCR" tindakan
- Konfigurasikan parameter input (lihat di bawah)

Parameter
Daftar lengkap parameter untuk Konversi PDF menjadi Dapat Diedit PDF Menggunakan OCR tindakan. Konfigurasikan parameter ini untuk mengontrol OCR konversi.
Penting: Parameter yang ditandai dengan tanda bintang (***) wajib diisi dan harus diberikan agar tindakan dapat berfungsi dengan benar.
| Parameter | Jenis | Keterangan | Contoh |
|---|---|---|---|
| Tipe Data Masukan*** | String | PDF Pemilihan Format Input • Pilih format Anda PDF masukan dokumen • PDF4me mendukung berbagai tipe input untuk OCR konversi • Opsi: Data Biner, Base64 Tali, atau URL | Binary Data |
| Bidang Biner Masukan | Biner | Biner PDF Masukan Berkas (Diperlukan jika Data Biner) • Referensi PDF berkas dari sebelumnya n8n unggahan node atau file • Bekerja dengan hasil pemindaian PDFs, berbasis gambar PDFs, dan konten campuran • Diperlukan jika Tipe Data Input adalah "Data Biner" | {{ $binary.data }} |
| Konten PDF Base64 | String | Base64 Dikodekan PDF Masukan (Diperlukan jika) Base64 Rangkaian) • Menyediakan PDF konten sebagai string yang dikodekan base64 • Mendukung berbagai PDF format termasuk dokumen yang dipindai • Diperlukan ketika Tipe Data Input adalah "Base64 Rangkaian" | JVBE... |
| URL PDF | String | Publik PDF URL Masukan (Diperlukan jika) URL) • Berikan izin publik/terbuka URL ke PDF berkas • Mengunduh dan memproses dokumen untuk OCR konversi • Diperlukan ketika Tipe Data Input adalah "URL" | https://abc.com/scanned.pdf |
| Nama Dokumen*** | String | Nama File Masukan • Tentukan nama input PDF berkas • Penting untuk OCR kualitas dan akurasi pengenalan teks • Harus menyertakan ekstensi .pdf | scanned_document.pdf |
| Jenis Kualitas*** | String | OCR Seleksi Berkualitas • Pilih OCR tingkat kualitas pemrosesan • Draf: cocok untuk penggunaan normal PDFs (1 API (panggilan per file) • Tinggi: cocok untuk gambar/dokumen hasil pindai (2 API panggilan per halaman) | Draft |
| OCR Hanya Jika Diperlukan*** | Boolean | Bersyarat OCR Pemrosesan • Benar: terapkan OCR hanya ketika PDF berbasis gambar atau tidak dapat dicari • Salah: terapkan OCR untuk semua konten tanpa memandang lapisan teks yang ada. • Mengoptimalkan pemrosesan dan API konsumsi | True |
| Bahasa*** | String | OCR Pengaturan Bahasa • Tentukan bahasa utama teks tersebut di dalam PDF • Mengoptimalkan OCR akurasi untuk pengenalan teks yang lebih baik • Bahasa Inggris adalah bahasa default, bahasa lain tersedia. | English |
| Format Output*** | Boolean | Kontrol Format Keluaran • Benar: aktifkan opsi pemformatan lanjutan untuk yang dapat diedit PDF • Memastikan pelestarian tata letak dan struktur yang lebih baik • Disarankan untuk menjaga format dokumen | true |
| Gabungkan Semua Lembar*** | Boolean | Kontrol Penggabungan Lembar • Benar: gabungkan semua lembar/halaman menjadi satu dokumen berkelanjutan. • Salah: mempertahankan struktur dan format halaman individual • Pilih berdasarkan struktur keluaran yang diinginkan | True |
| Nama File Output*** | String | Nama File Keluaran • Tentukan nama untuk file yang dapat diedit yang dihasilkan. PDF berkas • Harus menyertakan ekstensi .pdf • PDF4me Memastikan penamaan unik dan validasi format. | editable_pdf_output.pdf |
| Nama Bidang Biner Keluaran*** | String | Pemetaan Data Biner • Tentukan nama variabel untuk mengakses konten yang dapat diedit yang dihasilkan. PDF data • Digunakan dalam tindakan alur kerja selanjutnya • Penting untuk alur data alur kerja | data |
Opsi Lanjutan
Parameter berikut tersedia di bagian Opsi Lanjutan dan bersifat opsional:
| Parameter | Jenis | Keterangan | Contoh |
|---|---|---|---|
| Profil Kustom | String | Profil Konfigurasi Kustom • Atur opsi tambahan menggunakan profil khusus • JSON- format seperti yang berisi yang telah ditentukan sebelumnya OCR parameter • Mencakup deteksi bahasa, akurasi pengenalan teks, dan pelestarian format. • Opsional untuk kebutuhan khusus | { "language": "auto", "accuracy": "high", "preserveFormatting": true } |
Keluaran
Parameter Keluaran
| Parameter | Jenis | Keterangan | Contoh |
|---|---|---|---|
| kesuksesan | Boolean | PDF4me OCR indikator status konversi - Bendera Boolean yang menunjukkan keberhasilan atau kegagalan OCR Proses konversi. Pengembalian true untuk konversi yang sukses dan false untuk setiap kesalahan, memungkinkan penanganan kesalahan yang andal dalam alur kerja otomatis. | true |
| pesan | String | PDF4me OCR pesan status konversi - Pesan deskriptif yang menunjukkan hasil dari OCR Proses konversi. Memberikan pesan status yang jelas untuk konversi yang berhasil dan informasi kesalahan terperinci untuk tujuan pemecahan masalah. | PDF converted to editable PDF using OCR successfully |
| nama file | String | PDF4me nama file yang dihasilkan - Nama file lengkap dari file yang dapat diedit yang berhasil diproses PDF dokumen dengan ekstensi yang tepat. PDF4me Memastikan penamaan yang unik dan memvalidasi kepatuhan format file untuk integrasi yang lancar dengan proses selanjutnya. | editable_pdf_output.pdf |
| mimeType | String | PDF4me MIME pengidentifikasi tipe - Standarisasi MIME ketik untuk yang dapat diedit yang dihasilkan PDF berkas, selalu diatur ke application/pdf oleh PDF4me'S OCR mesin pemrosesan. Ini memastikan penanganan dan pengenalan file yang tepat di semua sistem dan aplikasi. | application/pdf |
| Ukuran berkas | Nomor | PDF4me ukuran file dalam byte - Ukuran pasti dari file yang dapat diedit yang dihasilkan PDF File dalam byte, disediakan untuk perencanaan penyimpanan, optimasi bandwidth, dan pemantauan transfer file. Penting untuk manajemen dokumen perusahaan dan otomatisasi alur kerja. | 121875 |
| Jenis kualitas | String | PDF4me OCR pengaturan kualitas yang digunakan - Pengaturan kualitas yang diterapkan selama OCR Proses konversi. Menunjukkan tingkat kualitas aktual yang digunakan untuk pengenalan teks dan pemrosesan dokumen. Nilai umum meliputi "Draf", "Tinggi", dan "Arsip". | Draft |
| ocrSaatDibutuhkan | String | PDF4me OCR pengaturan pemrosesan bersyarat - Menunjukkan apakah OCR Diterapkan secara kondisional (hanya bila diperlukan) atau ke semua konten. Menunjukkan pengaturan aktual yang digunakan selama pemrosesan untuk tujuan verifikasi dan debugging. | true |
| bahasa | String | PDF4me OCR pengaturan bahasa yang digunakan - Pengaturan bahasa yang diterapkan selama OCR Proses konversi. Menunjukkan bahasa sebenarnya yang digunakan untuk pengenalan teks guna mengoptimalkan akurasi dan pemrosesan. | English |
| gabungkan semua lembar | Boolean | PDF4me pengaturan penggabungan lembar yang digunakan - Menunjukkan apakah semua lembar atau halaman digabungkan menjadi satu dokumen selama pemrosesan. Menunjukkan pengaturan aktual yang diterapkan untuk penanganan struktur dokumen. | false |
N8N Tindakan dan Respons
Yang PDF4me Mengubah PDF menjadi Dapat Diedit PDF Menggunakan OCR API Mengembalikan respons yang dapat dilihat dalam berbagai format. Pilih tampilan yang paling sesuai dengan kebutuhan Anda:
- JSON
- Table
- Schema
- Binary
JSON Format Respons
Mentah JSON tanggapan dari API:
{
"success": true,
"message": "PDF converted to editable PDF using OCR successfully",
"fileName": "editable_pdf_output.pdf",
"mimeType": "application/pdf",
"fileSize": 121875,
"qualityType": "Draft",
"ocrWhenNeeded": "true",
"language": "English",
"mergeAllSheets": false
}
Tampilan Tabel
Data respons dalam format tabel terstruktur:
| Parameter | Nilai |
|---|---|
| success | true |
| message | PDF diubah menjadi dapat diedit PDF menggunakan OCR berhasil |
| fileName | editable_pdf_output.pdf |
| mimeType | application/pdf |
| fileSize | 121875 |
| qualityType | Draft |
| ocrWhenNeeded | true |
| language | English |
| mergeAllSheets | false |
Tampilan Skema
Struktur data dan tipe respons:
success: ✓ true
message: AB PDF converted to editable PDF using OCR successfully
fileName: AB editable_pdf_output.pdf
mimeType: AB application/pdf
fileSize: # 121875
qualityType: AB Draft
ocrWhenNeeded: AB true
language: AB English
mergeAllSheets: ✓ false
Indikator Tipe:
AB= String#= Angka✓= Boolean
Tampilan Data Biner
Yang sebenarnya dapat diedit PDF data dan metadata file:
data
─────────────────────────────────────────
File Name: editable_pdf_output.pdf
File Extension: pdf
Mime Type: application/pdf
File Size: 119.0 KB
Kasus Penggunaan
Digitalisasi dan Pengarsipan Dokumen
- Konversikan dokumen kertas dan file hasil pemindaian ke dalam format digital yang dapat dicari dan diedit.
- Digitalisasikan arsip sejarah dan dokumen warisan untuk akses dan pelestarian modern.
- Ubah formulir dan dokumen fisik menjadi versi digital yang dapat diedit.
Manajemen Konten dan Kemampuan Pencarian
- Jadikan dokumen hasil pemindaian dapat dicari dalam sistem manajemen konten.
- Aktifkan kemampuan pencarian teks lengkap pada dokumen yang sebelumnya tidak dapat dicari.
- Konversi berbasis gambar PDFmengubah konten menjadi konten yang mudah diakses dan diedit untuk pengalaman pengguna yang lebih baik.
Otomatisasi dan Pemrosesan Alur Kerja
- Otomatiskan konversi dokumen hasil pemindaian dalam alur kerja pemrosesan dokumen.
- Memproses dokumen kertas yang masuk untuk ekstraksi dan analisis data otomatis.
- Aktifkan pemrosesan hilir untuk konten dokumen yang sebelumnya statis.