Lewati ke konten utama

Ekstrak Halaman Dari PDF di dalam n8n

Ekstrak Halaman Dari PDF adalah sebuah PDF4me tindakan node di n8n yang membangun yang baru PDF hanya berisi pages Anda membuat daftar. Gunakan untuk mengambil halaman tanda tangan dari sebuah kontrak, mengisolasi satu bab dari manual, atau memberikan ringkasan kepada langkah-langkah selanjutnya. pages alih-alih seluruh dokumen.

Fungsi node ini

PDF4me: Ekstrak Halaman Dari PDF mengambil PDF dari Data Biner, sebuah Base64 String, atau sebuah URL dan mengembalikan berkas baru yang hanya berisi pages disebutkan dalam Nomor HalamanKolom itu adalah keseluruhan aksi: kolom itu menerima satu nilai saja. pages, rentang yang dipisahkan tanda hubung, daftar campuran, dan rentang terbuka yang berlanjut hingga akhir dokumen. Karena dijalankan sebagai langkah alur kerja, aturan ekstraksi yang sama berlaku untuk setiap file yang tiba tanpa ada yang membuka editor.

Postingan Blog Terkait
Belum ada postingan blog untuk fitur ini — akan segera hadir.
Sementara itu, jelajahi blog PDF4me untuk menemukan tutorial dan alur kerja di berbagai platform.
Kunjungi blog ini

Memverifikasi Identitas Anda API Meminta

Setiap PDF4me simpul di n8n memerlukan validitas Kredensial untuk terhubung denganBuat atau pilih salah satu yang sesuai dengan kebutuhan Anda. PDF4me API kunci agar alur kerja dapat mengautentikasi permintaan ekstraksi dengan aman.

Fakta Penting yang Tidak Boleh Anda Lewatkan

Nomor Halaman adalah satu-satunya kolom yang penting.
Ini diperlukan dan telah divalidasi. Biarkan kosong dan n8n menandai kolom sebelum node dijalankan.
Rentang terbuka menangani jumlah halaman yang bervariasi
Menulis 10- artinya halaman 10 sampai akhir, jadi satu pengaturan berlaku untuk dokumen dengan panjang yang berbeda.
Halaman-halaman diberi nomor mulai dari 1.
Halaman pertama adalah 1, bukan 0. Perhatikan ini ketika node kode sebelumnya menghasilkan daftar halaman secara terprogram.
Node PDF4me di n8n diatur ke Aksi Ekstrak Halaman Dari PDF, Tipe Data Masukan Data Biner, Bidang Biner Masukan data, Nama Dokumen output.pdf, bidang Nomor Halaman yang wajib diisi kosong, dan Nama Bidang Biner Keluaran data.

PDF4me Ekstrak Halaman Dari PDF panel parameter di n8n

Ekstrak Halaman vs Pisahkan PDF

Keduanya menghasilkan dokumen yang lebih kecil, tetapi menjawab pertanyaan yang berbeda. Ekstraksi menanyakan yang mana pages Anda ingin menyimpan bagian yang ingin dipisahkan; pemisahan menentukan bagaimana keseluruhan dokumen harus dibagi.

PertanyaanEkstrak Halaman Dari PDFMembelah PDF
How many files come backOne PDF holding the pages you listedSeveral PDFs covering the whole document
What happens to unlisted pagesThey are absent from the outputThey still appear, in another output file
Typical usePull the signature page, one chapter, or a summary sectionBreak a bundle into per-invoice or per-section files
Driven byAn explicit page list you supplyA split rule such as page count, text, or barcode

Parameter apa yang digunakan untuk mengekstrak halaman? PDF Membutuhkan?

Diperlukan: Aksi, Tipe Data Masukan, kolom yang sesuai dengan tipe masukan tersebut, Nama Dokumen, dan Nomor Halaman. Nama Kolom Biner Keluaran memiliki nilai default yang berfungsi sebagai data, dan Opsi Lanjutan awalnya kosong.

ParameterDiperlukanApa fungsinya?Contoh
ActionRequiredSelects the PDF4me node action to run. Choose Extract Pages From PDF.Extract Pages From PDF
Input Data TypeRequiredFormat of the source PDF input. Choose Binary Data (from a previous node), Base64 String, or URL.Binary Data
Input Binary FieldConditionalName of the binary property on the incoming n8n item that holds the PDF. Required when Input Data Type is Binary Data. Defaults to data.data
Base64 Document ContentConditionalBase64-encoded content of the source PDF. Required when Input Data Type is Base64 String.JVBERi0xLjQK...
File URLConditionalPublicly reachable HTTPS URL to the source PDF. Required when Input Data Type is URL.https://example.com/report.pdf
Document NameRequiredFilename used for the document on the request, for reference and tracking. Include the .pdf extension.output.pdf
Page NumbersRequiredThe pages to keep. Accepts a comma-separated list, a hyphenated range, a mixed list, or an open range that runs to the end of the document. Pages are numbered from 1.1,3,5-8
Output Binary Field NameOptionalName of the binary property the output item exposes. Defaults to data.data
Advanced OptionsOptionalA collection that starts empty, shown as No properties with an Add Option button. Leave it alone unless you have a specific option to add.No properties

Cara Menulis Kolom Nomor Halaman

PolaContohApa yang kembali
Single page5Just page 5, as a one page PDF.
Comma-separated list1,3,5Pages 1, 3, and 5 in one PDF, with pages 2 and 4 absent.
Hyphenated range2-5Pages 2, 3, 4, and 5, with both ends included.
Mixed list1,3,5-8Page 1, page 3, then the block from 5 to 8.
Open range10-Page 10 through the last page, whatever the document length turns out to be.

Bidang Keluaran

Satu kali lari yang sukses akan menghasilkan satu n8n barang yang membawa yang diekstrak PDF.

BidangJenisIsi di dalamnya
Binary (data)BinaryThe extracted PDF, under Output Binary Field Name (default data).
fileNameStringGenerated filename of the extracted PDF.
mimeTypeStringMIME type of the output, always application/pdf.
fileSizeNumberSize of the returned PDF in bytes.
pagesExtractedNumberHow many pages ended up in the output. Compare it against the length of your requested list as a cheap sanity check.
originalPageCountNumberPage count of the source document before extraction.
extractedPageNumbersArrayThe page numbers that were actually extracted, useful for verifying the result against what you asked for.
successBooleanTrue when the extraction completed, false on failure. Use it to branch error handling.
messageStringHuman-readable status message, carrying success confirmation or error detail.

Bagaimana Cara Mengatur Ekstraksi Halaman Dari PDF di dalam n8n?

  1. Menambahkan PDF4me untuk Anda n8n alur kerja dan pilih Ekstrak Halaman Dari PDF tindakan.
  2. Di dalam Kredensial untuk terhubung dengan, pilih milikmu PDF4me kredensial atau klik Buat Kredensial Baru dan tempelkan milik Anda API kunci.
  3. Mengatur Tipe Data Masukan ke Data Biner (bawaan), Base64 String, atau URL dan menyediakan sumber yang sesuai PDF bidang.
  4. Mengatur Nama Dokumen untuk file sumber, termasuk .pdf Ekstensi.
  5. Memasuki Nomor Halaman menggunakan daftar, rentang, daftar campuran, atau rentang terbuka.
  6. Meninggalkan Nama Bidang Biner Keluaran sebagai data kecuali jika node selanjutnya mengharapkan properti yang berbeda.
  7. Eksekusi node dan arahkan nilai yang dikembalikan. PDF ke langkah selanjutnya, seperti penyimpanan, email, atau antrian peninjauan.

Pengaturan Umum

Contoh Alur KerjaCommon n8n workflow patterns using Extract Pages From PDF.
Ambil halaman tanda tangan dari sebuah kontrak.
  1. Kontrak yang telah ditandatangani akan dikirim sebagai lampiran email.
  2. Ekstrak Halaman Dari PDF mengambil halaman terakhir menggunakan rentang terbuka.
  3. Halaman tunggal tersebut disimpan bersama catatan pelanggan untuk referensi cepat.
Kirimkan hanya ringkasannya kepada peninjau.
  1. Laporan panjang dibuat sesuai jadwal.
  2. Ekstrak Halaman Dari PDF menyimpan beberapa yang pertama pages dengan berbagai macam seperti 1-3.
  3. Para peninjau menerima ringkasan, sedangkan laporan lengkapnya masuk ke arsip.
Pisahkan satu bab dari sebuah buku panduan.
  1. Permintaan dukungan merujuk pada satu bagian dari manual produk.
  2. Ekstrak Halaman Dari PDF mengambil bab itu dengan rentang yang diberi tanda hubung.
  3. Pelanggan mendapatkan informasi yang relevan. pages alih-alih lampiran yang besar.
Ekstrak kemudian gabungkan menjadi ringkasan.
  1. Beberapa dokumen sumber masing-masing berisi satu halaman yang layak disimpan.
  2. Ekstrak Halaman Dari PDF dijalankan per dokumen untuk mengambil halaman tersebut.
  3. Gabungkan Beberapa PDFs Menggabungkan hasil-hasil tersebut menjadi satu ringkasan tunggal.

Tips Praktis

Use an open range for variable documents
When the page count differs between files, 10- keeps everything from page 10 onward without knowing the total.
Check pagesExtracted against your request
Comparing the returned count with the number of pages you asked for catches a malformed page list before it reaches the customer.
Remember pages start at 1
A code node that builds the list from a zero-based array will be off by one on every document. Add one when generating the string.
Extract before you merge
Pulling the wanted pages from each source first keeps the merge step small and the final document free of filler.
Branch on the success field
Test the returned success boolean before sending the file onward so a failed extraction raises an alert instead of forwarding an empty result.
Reuse one source for several subsets
The original is untouched, so the same PDF can feed two extraction nodes to produce an internal copy and a customer copy in one run.

Lembar Panduan Singkat

BidangNilai
ActionExtract Pages From PDF
Input Data TypeBinary Data
Input Binary Fielddata
Document Nameoutput.pdf
Page Numbers1,3,5-8
Output Binary Field Namedata
Advanced OptionsNo properties
CredentialsPDF4me API credential

Pertanyaan Umum

How do I write the Page Numbers field to extract a range?+
Page Numbers accepts four shapes. A comma-separated list such as 1,3,5 pulls individual pages. A hyphenated range such as 2-5 pulls everything between and including those pages. A mixed list such as 1,3,5-8 combines both. An open range such as 10- runs from page 10 to the end of the document, which is useful when the page count varies between files.
Is extracting pages the same as splitting a PDF?+
No. Extract Pages From PDF returns one new PDF containing only the pages you listed, and the pages you did not list are simply absent. Splitting divides a document into multiple output files covering the whole document. Choose extraction when you want a specific subset, and choose Split PDF when you want every page distributed across several files.
Does extracting pages change the original PDF?+
No. The node reads the source PDF you supply and returns a new file. The original document is untouched, so the same source can be run through several extractions in one workflow to produce different subsets.
What happens if I ask for a page number that does not exist?+
Page Numbers is a required field and is validated when the node runs. Requesting a page beyond the end of the document is an error case rather than a silent skip, so branch on the returned success field before passing the result downstream, especially when the page list is built dynamically from earlier workflow data.
Are the page numbers counted from one or from zero?+
Page numbers start at 1, matching what a reader sees in a PDF viewer. The first page of the document is 1, not 0. This matters most when the page list is generated by an earlier node in n8n code, where zero-based indexing is a common source of off-by-one output.

Tindakan Terkait

Tugas yang Sama di Platform Lain

Dapatkan Bantuan