Membelah PDF dengan Teks menggunakan n8n tindakan
PDF4me Membelah PDF melalui Teks membagi PDF dokumen berdasarkan pola teks dan konten yang terdeteksi melalui n8n Alur kerja otomatisasi. Proses PDFs melalui n8n pemicu, data biner, string base64, atau publik URLs Untuk secara otomatis menemukan string teks tertentu, memisahkan dokumen pada lokasi teks, dan mengatur file menggunakan konten yang terdeteksi untuk penamaan file yang cerdas. Solusi ini ideal untuk pemisahan faktur, pemisahan kontrak, pemrosesan dokumen secara massal, pengorganisasian berbasis konten, pengarsipan otomatis, dan alur kerja penyortiran dokumen berbasis teks yang membutuhkan deteksi teks yang akurat dengan pemisahan dokumen yang cerdas dan integrasi yang mulus.
Pengaturan
Tambahkan PDF4me "Membelah PDF dengan node "Teks" ke milik Anda n8n alur kerja dan konfigurasikan parameter yang diperlukan. Untuk petunjuk pengaturan awal, lihat halaman kami. n8n Panduan Integrasi.
Prasyarat:
- PDF4me API kredensial
- n8n akses alur kerja
Konfigurasi:
- Menambahkan PDF4me simpul ke alur kerja
- Pilih "Pisahkan" PDF tindakan "dengan Teks"
- Konfigurasikan parameter input (lihat di bawah)

Parameter
Daftar lengkap parameter untuk Split PDF Melalui tindakan Teks. Konfigurasikan parameter ini untuk mengontrol tindakan berbasis teks. PDF pemisahan.
Penting: Parameter yang ditandai dengan tanda bintang (***) wajib diisi dan harus diberikan agar tindakan dapat berfungsi dengan benar.
| Parameter | Jenis | Keterangan | Contoh |
|---|---|---|---|
| Tipe Data Masukan*** | String | PDF Pemilihan Format Input • Pilih format Anda PDF masukan data • PDF4me mendukung berbagai tipe input • Opsi: Data Biner, String Base64, atau URL | Binary Data |
| Nama Properti Biner | String | Biner PDF Masukan Berkas (Diperlukan jika Data Biner) • Referensi PDF berkas dari sebelumnya n8n unggahan node atau file • PDF4me proses biner PDF file dengan deteksi format otomatis • Diperlukan jika Tipe Data Input adalah "Data Biner" | data |
| Konten Dokumen Base64 | String | Base64 Dikodekan PDF Masukan (Diperlukan jika berupa String Base64) • Menyediakan PDF data sebagai string yang dikodekan base64 • PDF4me secara otomatis mendekode dan memproses PDF isi • Diperlukan ketika Tipe Data Input adalah "Base64 Rangkaian" | UEsDBBQABgAI... |
| URL berkas | String | Publik PDF URL Masukan (Wajib diisi jika berupa URL) • Berikan izin publik/terbuka URL ke PDF berkas • PDF4me mengunduh dan memproses file dari URL • Diperlukan ketika Tipe Data Input adalah "URL" | https://abc.com/sample.pdf |
| Teks untuk Pencarian*** | String | Spesifikasi Pencarian Teks • Tentukan string teks yang tepat untuk dicari di dalam PDF • PDF4me menggunakan teks ini sebagai titik pemisah untuk membagi dokumen. • Pencocokan peka huruf besar/kecil untuk deteksi teks yang tepat | page 1, line 10. |
| Halaman Teks Terpisah*** | String | Pemilihan Posisi Terpisah • Pilih di mana akan membagi PDF relatif terhadap teks yang terdeteksi • Pilihan: Setelah (dipisahkan setelah halaman), Sebelum (dipisahkan sebelum halaman) • PDF4me menyediakan posisi terpisah yang fleksibel | After |
| Penamaan File*** | String | Konvensi Penamaan File Keluaran • Pilih cara pembagian yang dihasilkan PDF file harus diberi nama • Pilihan: Nama Sesuai Urutan (berurutan), Nama Sesuai Halaman (dengan nomor halaman) • Membantu mengatur file keluaran | Name As Per Order |
| Nama File*** | String | Spesifikasi Nama File Keluaran • Tentukan nama untuk pemisahan yang dihasilkan PDF berkas • Harus menyertakan ekstensi .pdf • PDF4me Memastikan penamaan unik dan validasi format. | output.pdf |
| Nama Bidang Biner Keluaran*** | String | Pemetaan Data Biner • Tentukan nama variabel untuk mengakses hasil pemisahan yang dihasilkan PDF data • Digunakan dalam tindakan alur kerja selanjutnya • Penting untuk alur data alur kerja | data |
Opsi Lanjutan
Parameter berikut tersedia di bagian Opsi Lanjutan dan bersifat opsional:
| Parameter | Jenis | Keterangan | Contoh |
|---|---|---|---|
| Profil Kustom | String | Profil Konfigurasi Kustom • Atur opsi tambahan menggunakan profil khusus • JSONformat seperti yang berisi parameter yang telah ditentukan sebelumnya • Mendukung outputDataFormat, preserveMetadata, dll. • Opsional untuk kebutuhan khusus | { "outputDataFormat": "base64", "preserveMetadata": true, "optimizeForPrinting": false, "compressionLevel": "medium" } |
Keluaran
Parameter Keluaran
| Parameter | Jenis | Keterangan | Contoh |
|---|---|---|---|
| kesuksesan | Boolean | PDF4me indikator status operasi pemisahan teks - Boolean bendera yang menunjukkan keberhasilan atau kegagalan PDF proses pemisahan teks. PDF4me pengembalian true untuk operasi yang sukses dan false untuk setiap kesalahan, memungkinkan penanganan kesalahan yang andal dalam alur kerja otomatis. | true |
| pesan | String | PDF4me pesan status operasi pemisahan teks - Pesan status yang mudah dibaca manusia yang memberikan detail tentang hasil proses pemisahan teks. Termasuk konfirmasi keberhasilan atau detail kesalahan untuk pemecahan masalah. | PDF split by text successfully |
| nama file | String | PDF4me pemisahan yang dihasilkan PDF nama file - Nama file lengkap dari hasil pemisahan yang berhasil dibuat PDF dokumen dengan ekstensi .pdf yang sesuai. PDF4me Memastikan penamaan yang unik dan memvalidasi kepatuhan format file untuk integrasi yang lancar dengan proses selanjutnya. | text_split_output.pdf |
| mimeType | String | PDF4me keluaran MIME jenis - MIME jenis yang dihasilkan PDF file, selalu "application/pdf" untuk PDF Dokumen. Berguna untuk validasi tipe konten dan penanganan file yang tepat dalam aplikasi web. | application/pdf |
| Ukuran berkas | Nomor | PDF4me membelah PDF ukuran file dalam byte - Ukuran pasti dari pembagian yang dihasilkan PDF berkas dalam byte, disediakan oleh PDF4me untuk perencanaan penyimpanan, optimasi bandwidth, dan pemantauan transfer file. Penting untuk manajemen dokumen perusahaan dan otomatisasi alur kerja. | 125430 |
| Nama dokumen | String | PDF4me referensi nama dokumen - Nama dokumen terpisah yang telah diproses untuk tujuan referensi dan pelacakan. Ini sesuai dengan fileName untuk konsistensi dalam alur kerja manajemen dokumen | text_split_output.pdf |
| TeksTerpisahSelesai | Boolean | PDF4me konfirmasi penyelesaian pemisahan teks - Boolean bendera yang menegaskan bahwa PDF Operasi pemisahan teks telah berhasil diselesaikan. Berguna untuk memverifikasi bahwa pemisahan berbasis teks telah diterapkan dengan benar. | true |
| textMatchesFound | Nomor | PDF4me Jumlah kecocokan teks yang terdeteksi - Jumlah kecocokan teks yang berhasil ditemukan dan digunakan sebagai titik pemisah dalam PDF Dokumen. Berguna untuk melacak efektivitas deteksi teks dan akurasi pemisahan. | 3 |
| file yang dihasilkan | Nomor | PDF4me Jumlah file yang dipisahkan dihasilkan - Jumlah individu PDF File-file yang berhasil dihasilkan dari operasi pemisahan teks. Berguna untuk melacak kelengkapan pemisahan dan hasil segmentasi dokumen. | 4 |
N8N Tindakan dan Respons
Yang PDF4me Membelah PDF melalui Teks API Mengembalikan respons yang dapat dilihat dalam berbagai format. Pilih tampilan yang paling sesuai dengan kebutuhan Anda:
- JSON
- Table
- Schema
- Binary
JSON Format Respons
Mentah JSON tanggapan dari API:
[
{
"success": true,
"message": "PDF split by text successfully",
"fileName": "text_split_output.pdf",
"mimeType": "application/pdf",
"fileSize": 125430,
"docName": "text_split_output.pdf",
"textSplitCompleted": true,
"textMatchesFound": 3,
"filesGenerated": 4
}
]
Tampilan Tabel
Data respons dalam format tabel terstruktur:
| Parameter | Nilai |
|---|---|
| success | true |
| message | PDF split by text successfully |
| fileName | text_split_output.pdf |
| mimeType | application/pdf |
| fileSize | 125430 |
| docName | text_split_output.pdf |
| textSplitCompleted | true |
| textMatchesFound | 3 |
| filesGenerated | 4 |
Tampilan Skema
Struktur data dan tipe respons:
1 item
success: ☑ true
message: AB PDF split by text successfully
fileName: AB text_split_output.pdf
mimeType: AB application/pdf
fileSize: # 125430
docName: AB text_split_output.pdf
textSplitCompleted: ☑ true
textMatchesFound: # 3
filesGenerated: # 4
Indikator Tipe:
AB= String#= Angka☑= Boolean
Tampilan Data Biner
Data dan metadata file PDF terpisah yang sebenarnya:
data
─────────────────────────────
File Name: text_split_output.pdf
File Extension: pdf
Mime Type: application/pdf
File Size: 122.5 KB
Akses Data Biner:
- n8n Objek Biner:
$binary.data.data - Base64 Isi: Tersedia untuk penggunaan langsung
- Operasi FileSiap untuk diunduh, dikirim melalui email, atau disimpan.
Kasus Penggunaan
Pemrosesan Dokumen dan Manajemen Konten
- Pisahkan dokumen besar pada penanda teks atau judul bagian tertentu untuk membuat file yang terorganisir dan mudah dikelola untuk departemen atau proses yang berbeda.
- Olah dokumen hukum dengan memisahkannya berdasarkan penanda klausa atau pembatas bagian tertentu untuk membuat berkas individual untuk setiap bagian hukum.
- Otomatiskan pemisahan laporan dan manual berdasarkan judul bab atau judul bagian untuk pengorganisasian konten yang lebih baik.
Otomatisasi Proses Bisnis
- Pisahkan kumpulan faktur dengan mencari pola teks tertentu seperti "Nomor Faktur" atau "Jumlah Pembayaran" untuk membuat file faktur individual untuk setiap transaksi.
- Proses kontrak dan perjanjian dengan memisahkannya berdasarkan penanda teks tertentu seperti "Bagian" atau "Pasal" untuk membuat file terpisah untuk setiap bagian.
- Otomatiskan pengorganisasian dokumen keuangan dengan memisahkannya berdasarkan pola teks seperti "Laporan Triwulanan" atau "Ringkasan Tahunan" untuk periode pelaporan yang berbeda.
Distribusi Konten dan Manajemen Alur Kerja
- Pisahkan dokumen rahasia pada penanda teks tertentu untuk membuat file terpisah bagi pemangku kepentingan yang berbeda berdasarkan persyaratan akses.
- Olah materi pelatihan dengan memisahkannya berdasarkan pola teks seperti "Modul" atau "Pelajaran" untuk membuat modul pembelajaran individual bagi audiens yang berbeda.
- Otomatiskan pengorganisasian dokumentasi teknis dengan memisahkannya berdasarkan penanda teks seperti "Referensi API" atau "Panduan Pengguna" untuk berbagai jenis pengguna.