Lewati ke konten utama

Mengubah PDF menjadi Dapat Diedit PDF Menggunakan OCR menggunakan n8n tindakan

PDF4me Mengubah PDF menjadi Dapat Diedit PDF Menggunakan OCR transformasi yang dipindai PDFmengubah dokumen berbasis gambar dan teks menjadi dokumen yang dapat dicari dan diedit. PDFmelalui n8n Alur kerja otomatisasi. Proses PDFpergi n8n pemicu, data biner, string base64, atau publik URLuntuk melamar OCR teknologi dengan dukungan multibahasa, pemilihan tingkat kualitas (Draf/Tinggi), bersyarat OCR Pemrosesan, pembuatan lapisan teks, pelestarian tata letak, dan pembuatan konten yang dapat dicari. Solusi ini ideal untuk digitalisasi dokumen, pemrosesan dokumen hasil pemindaian, dan pembuatan faktur. OCR, konversi arsip, dapat dicari PDF pembuatan, dan otomatis OCR alur kerja yang membutuhkan pengenalan teks yang akurat dengan format yang terjaga dan integrasi yang mulus.

Postingan Blog Terkait
Belum ada postingan blog untuk fitur ini — akan segera hadir.
Sementara itu, jelajahi blog PDF4me untuk menemukan tutorial dan alur kerja di berbagai platform.
Kunjungi blog ini

Pengaturan

Tambahkan PDF4me "Mengubah PDF menjadi Dapat Diedit PDF Menggunakan OCR" simpul untuk Anda n8n alur kerja dan konfigurasikan parameter yang diperlukan. Untuk petunjuk pengaturan awal, lihat halaman kami. n8n Panduan Integrasi.

Prasyarat:

  • PDF4me API kredensial
  • n8n akses alur kerja

Konfigurasi:

  1. Menambahkan PDF4me simpul ke alur kerja
  2. Pilih "Konversi" PDF menjadi Dapat Diedit PDF Menggunakan OCR" tindakan
  3. Konfigurasikan parameter input (lihat di bawah)
Konversi PDF ke PDF yang Dapat Diedit Menggunakan Konfigurasi OCR

Parameter

Daftar lengkap parameter untuk Konversi PDF menjadi Dapat Diedit PDF Menggunakan OCR tindakan. Konfigurasikan parameter ini untuk mengontrol OCR konversi.

Penting: Parameter yang ditandai dengan tanda bintang (***) wajib diisi dan harus diberikan agar tindakan dapat berfungsi dengan benar.

ParameterJenisKeteranganContoh
Tipe Data Masukan***StringPDF Pemilihan Format Input
• Pilih format Anda PDF masukan dokumen
PDF4me mendukung berbagai tipe input untuk OCR konversi
• Opsi: Data Biner, Base64 Tali, atau URL
Binary Data
Bidang Biner MasukanBinerBiner PDF Masukan Berkas (Diperlukan jika Data Biner)
• Referensi PDF berkas dari sebelumnya n8n unggahan node atau file
• Bekerja dengan hasil pemindaian PDFs, berbasis gambar PDFs, dan konten campuran
• Diperlukan jika Tipe Data Input adalah "Data Biner"
{{ $binary.data }}
Konten PDF Base64StringBase64 Dikodekan PDF Masukan (Diperlukan jika) Base64 Rangkaian)
• Menyediakan PDF konten sebagai string yang dikodekan base64
• Mendukung berbagai PDF format termasuk dokumen yang dipindai
• Diperlukan ketika Tipe Data Input adalah "Base64 Rangkaian"
JVBE...
URL PDFStringPublik PDF URL Masukan (Diperlukan jika) URL)
• Berikan izin publik/terbuka URL ke PDF berkas
• Mengunduh dan memproses dokumen untuk OCR konversi
• Diperlukan ketika Tipe Data Input adalah "URL"
https://abc.com/scanned.pdf
Nama Dokumen***StringNama File Masukan
• Tentukan nama input PDF berkas
• Penting untuk OCR kualitas dan akurasi pengenalan teks
• Harus menyertakan ekstensi .pdf
scanned_document.pdf
Jenis Kualitas***StringOCR Seleksi Berkualitas
• Pilih OCR tingkat kualitas pemrosesan
• Draf: cocok untuk penggunaan normal PDFs (1 API (panggilan per file)
• Tinggi: cocok untuk gambar/dokumen hasil pindai (2 API panggilan per halaman)
Draft
OCR Hanya Jika Diperlukan***BooleanBersyarat OCR Pemrosesan
• Benar: terapkan OCR hanya ketika PDF berbasis gambar atau tidak dapat dicari
• Salah: terapkan OCR untuk semua konten tanpa memandang lapisan teks yang ada.
• Mengoptimalkan pemrosesan dan API konsumsi
True
Bahasa***StringOCR Pengaturan Bahasa
• Tentukan bahasa utama teks tersebut di dalam PDF
• Mengoptimalkan OCR akurasi untuk pengenalan teks yang lebih baik
• Bahasa Inggris adalah bahasa default, bahasa lain tersedia.
English
Format Output***BooleanKontrol Format Keluaran
• Benar: aktifkan opsi pemformatan lanjutan untuk yang dapat diedit PDF
• Memastikan pelestarian tata letak dan struktur yang lebih baik
• Disarankan untuk menjaga format dokumen
true
Gabungkan Semua Lembar***BooleanKontrol Penggabungan Lembar
• Benar: gabungkan semua lembar/halaman menjadi satu dokumen berkelanjutan.
• Salah: mempertahankan struktur dan format halaman individual
• Pilih berdasarkan struktur keluaran yang diinginkan
True
Nama File Output***StringNama File Keluaran
• Tentukan nama untuk file yang dapat diedit yang dihasilkan. PDF berkas
• Harus menyertakan ekstensi .pdf
PDF4me Memastikan penamaan unik dan validasi format.
editable_pdf_output.pdf
Nama Bidang Biner Keluaran***StringPemetaan Data Biner
• Tentukan nama variabel untuk mengakses konten yang dapat diedit yang dihasilkan. PDF data
• Digunakan dalam tindakan alur kerja selanjutnya
• Penting untuk alur data alur kerja
data

Opsi Lanjutan

Parameter berikut tersedia di bagian Opsi Lanjutan dan bersifat opsional:

ParameterJenisKeteranganContoh
Profil KustomStringProfil Konfigurasi Kustom
• Atur opsi tambahan menggunakan profil khusus
JSON- format seperti yang berisi yang telah ditentukan sebelumnya OCR parameter
• Mencakup deteksi bahasa, akurasi pengenalan teks, dan pelestarian format.
• Opsional untuk kebutuhan khusus
{ "language": "auto", "accuracy": "high", "preserveFormatting": true }

Keluaran

Parameter Keluaran

ParameterJenisKeteranganContoh
kesuksesanBooleanPDF4me OCR indikator status konversi - Bendera Boolean yang menunjukkan keberhasilan atau kegagalan OCR Proses konversi. Pengembalian true untuk konversi yang sukses dan false untuk setiap kesalahan, memungkinkan penanganan kesalahan yang andal dalam alur kerja otomatis.true
pesanStringPDF4me OCR pesan status konversi - Pesan deskriptif yang menunjukkan hasil dari OCR Proses konversi. Memberikan pesan status yang jelas untuk konversi yang berhasil dan informasi kesalahan terperinci untuk tujuan pemecahan masalah.PDF converted to editable PDF using OCR successfully
nama fileStringPDF4me nama file yang dihasilkan - Nama file lengkap dari file yang dapat diedit yang berhasil diproses PDF dokumen dengan ekstensi yang tepat. PDF4me Memastikan penamaan yang unik dan memvalidasi kepatuhan format file untuk integrasi yang lancar dengan proses selanjutnya.editable_pdf_output.pdf
mimeTypeStringPDF4me MIME pengidentifikasi tipe - Standarisasi MIME ketik untuk yang dapat diedit yang dihasilkan PDF berkas, selalu diatur ke application/pdf oleh PDF4me'S OCR mesin pemrosesan. Ini memastikan penanganan dan pengenalan file yang tepat di semua sistem dan aplikasi.application/pdf
Ukuran berkasNomorPDF4me ukuran file dalam byte - Ukuran pasti dari file yang dapat diedit yang dihasilkan PDF File dalam byte, disediakan untuk perencanaan penyimpanan, optimasi bandwidth, dan pemantauan transfer file. Penting untuk manajemen dokumen perusahaan dan otomatisasi alur kerja.121875
Jenis kualitasStringPDF4me OCR pengaturan kualitas yang digunakan - Pengaturan kualitas yang diterapkan selama OCR Proses konversi. Menunjukkan tingkat kualitas aktual yang digunakan untuk pengenalan teks dan pemrosesan dokumen. Nilai umum meliputi "Draf", "Tinggi", dan "Arsip".Draft
ocrSaatDibutuhkanStringPDF4me OCR pengaturan pemrosesan bersyarat - Menunjukkan apakah OCR Diterapkan secara kondisional (hanya bila diperlukan) atau ke semua konten. Menunjukkan pengaturan aktual yang digunakan selama pemrosesan untuk tujuan verifikasi dan debugging.true
bahasaStringPDF4me OCR pengaturan bahasa yang digunakan - Pengaturan bahasa yang diterapkan selama OCR Proses konversi. Menunjukkan bahasa sebenarnya yang digunakan untuk pengenalan teks guna mengoptimalkan akurasi dan pemrosesan.English
gabungkan semua lembarBooleanPDF4me pengaturan penggabungan lembar yang digunakan - Menunjukkan apakah semua lembar atau halaman digabungkan menjadi satu dokumen selama pemrosesan. Menunjukkan pengaturan aktual yang diterapkan untuk penanganan struktur dokumen.false

N8N Tindakan dan Respons

Yang PDF4me Mengubah PDF menjadi Dapat Diedit PDF Menggunakan OCR API Mengembalikan respons yang dapat dilihat dalam berbagai format. Pilih tampilan yang paling sesuai dengan kebutuhan Anda:

JSON Format Respons

Mentah JSON tanggapan dari API:

{
"success": true,
"message": "PDF converted to editable PDF using OCR successfully",
"fileName": "editable_pdf_output.pdf",
"mimeType": "application/pdf",
"fileSize": 121875,
"qualityType": "Draft",
"ocrWhenNeeded": "true",
"language": "English",
"mergeAllSheets": false
}

Kasus Penggunaan

Digitalisasi dan Pengarsipan Dokumen

  • Konversikan dokumen kertas dan file hasil pemindaian ke dalam format digital yang dapat dicari dan diedit.
  • Digitalisasikan arsip sejarah dan dokumen warisan untuk akses dan pelestarian modern.
  • Ubah formulir dan dokumen fisik menjadi versi digital yang dapat diedit.

Manajemen Konten dan Kemampuan Pencarian

  • Jadikan dokumen hasil pemindaian dapat dicari dalam sistem manajemen konten.
  • Aktifkan kemampuan pencarian teks lengkap pada dokumen yang sebelumnya tidak dapat dicari.
  • Konversi berbasis gambar PDFmengubah konten menjadi konten yang mudah diakses dan diedit untuk pengalaman pengguna yang lebih baik.

Otomatisasi dan Pemrosesan Alur Kerja

  • Otomatiskan konversi dokumen hasil pemindaian dalam alur kerja pemrosesan dokumen.
  • Memproses dokumen kertas yang masuk untuk ekstraksi dan analisis data otomatis.
  • Aktifkan pemrosesan hilir untuk konten dokumen yang sebelumnya statis.

Dapatkan Bantuan