Lewati ke konten utama

AI - Pengurai Dokumen di n8n

Fungsi node ini

PDF4me Pengurai Dokumen AI mengekstrak data terstruktur dari dokumen apa pun dengan menjalankan perintah yang tersimpan. AI Penganalisis dari Anda PDF4me akun terhadap file tersebut. Tidak seperti parser tetap (AI-Invoice Parser, AI-Process Contract), Anda memilih AI ID Penganalisis dari daftar pilihan penganalisis yang dikonfigurasi di PDF4me dasbor, jadi node yang sama menangani faktur, pesanan pembelian, tanda terima, formulir khusus, laporan laboratorium, templat internal, apa pun yang Anda deskripsikan dalam skema. Gunakan Menguraikan Penganalisis untuk skema tunggal atau Menggolongkan Penganalisis untuk banyak varian dokumen dalam satu panggilan. Mengembalikan nilai dinamis. JSON dikunci oleh skema Anda ditambah metadata blok, tidak ada file biner.

Postingan Blog Terkait
Belum ada postingan blog untuk fitur ini — akan segera hadir.
Sementara itu, jelajahi blog PDF4me untuk menemukan tutorial dan alur kerja di berbagai platform.
Kunjungi blog ini

Contoh Faktur untuk Pengujian

Gunakan contoh faktur vendor ini untuk memastikan node berfungsi secara menyeluruh sebelum mengarahkan alur kerja Anda ke data langsung. Petakan sebagai input biner dan pilih default_invoice_extraction sebagai AI ID Penganalisis.

Memverifikasi Identitas Anda API Meminta

Setiap PDF4me simpul di n8n memerlukan validitas Kredensial untuk terhubung denganBuat atau pilih salah satu yang sesuai dengan kebutuhan Anda. PDF4me API kunci agar alur kerja dapat melakukan autentikasi AI permintaan ekstraksi secara aman. Kredensial yang sama juga mendukung AI ID Penganalisis menu tarik-turun melalui GetAnalyzerId API.

Siapkan Analyzer Anda terlebih dahulu.

URL dasbor yang akan Anda gunakan dalam panduan ini:
Buatlah Analyzer Anda terlebih dahulu (diperlukan untuk setiap platform)
AI - Document Parser menjalankan Analyzer yang telah disimpan dari dasbor pengembang PDF4me. Pilih "Parse" untuk satu skema dokumen, atau "Classify" untuk mengarahkan berbagai varian (Klien ABC, Klien XYZ, faktur umum) dalam satu panggilan. ID Analyzer yang sama dapat digunakan di Make, Zapier, Power Automate, n8n, dan REST API.

Fakta Penting yang Tidak Boleh Anda Lewatkan

Anda mengatur Analyzer di dasbor, node hanya merujuk ke Analyzer tersebut.
Tentukan skema, kolom, dan perintah sekali saja di dalam Daftar penganalisis Dan Detail penganalisis halaman (Uraikan untuk satu skema, Klasifikasikan untuk banyak varian). The n8n node memuat Analyzer Anda ke dalam AI ID Penganalisis Menu tarik-turun akan menjalankan pilihan mana pun yang Anda pilih. Mengedit skema di kemudian hari tidak memerlukan perubahan pada alur kerja.
Output bersifat dinamis JSON, tidak ada file biner
Kunci tingkat atas cocok dengan nama kolom yang Anda definisikan pada Analyzer (string, angka, tanggal, atau baris tabel). A metadata Objek selalu ditambahkan dengan informasi sukses, pesan, stempel waktu, nama file sumber, ID penganalisis, dan operasi. Tidak ada Nama Bidang Biner Keluaran.
Keputusan antara parse dan classify ditentukan oleh Analyzer, bukan oleh node.
Node yang sama, dua mode penganalisis. A Menguraikan Analyzer mengembalikan field dari skema tunggalnya. A Menggolongkan Analyzer mengarahkan dokumen ke Skema yang paling cocok dan mengembalikan Nama Klasifikasinya. plus Bidang yang diekstrak dari Skema yang cocok. Ubah perilaku dengan mengubah ID.
Node n8n AI Document Parser menampilkan Credential Pdf4me, Resource Extract, Extract Operations AI Document Parser, Input Data Type Binary Data, Input Binary Field data, Document Name document.pdf, dan dropdown AI Analyzer Id tidak diatur (disorot sebagai wajib)

Panel node lengkap: Ekstrak → AI Pengurai Dokumen dengan input Data Biner. Pilih sebuah AI ID Penganalisis sebelum berlari.

Parameter

URL dasbor yang akan Anda gunakan dalam panduan ini:

Diperlukan dalam n8n UI: Kredensial untuk terhubung, Tipe Data Masukan, Nama Dokumen, AI ID Penganalisis. Kolom wajib bersyarat (Kolom Biner Input, Konten Dokumen Base64, atau URL Dokumen) hanya muncul jika Tipe Data Input yang sesuai dipilih. Tidak ada Nama Bidang Biner Keluaran dan tidak Opsi Lanjutan / Profil Kustom pada operasi ini.

ParameterDiperlukanApa fungsinya?Contoh
Input Data TypeYesHow the document is supplied. Binary Data reads from a previous node (default, most common). Base64 String accepts an encoded document. URL downloads the document from a public link.Binary Data
Input Binary FieldConditionalName of the binary property on the incoming n8n item that holds the document. Required when Input Data Type is Binary Data. Defaults to data. Error reports which property was missing when the name is wrong.data
Base64 Document ContentConditionalBase64-encoded document. Required when Input Data Type is Base64 String. Data-URL style prefixes (text before the comma) are stripped automatically.JVBERi0xLjQK...
Document URLConditionalPublicly reachable HTTPS URL to the document. Required when Input Data Type is URL. Must be a valid full URL.https://example.com/document.pdf
Document NameYesFilename used by PDF4me for processing. Default document.pdf. With Binary Data, the uploaded file name is used for upload but your explicit Document Name value takes precedence in the API call when set. Use a real extension (.pdf, .png, .jpg, etc.) so PDF4me handles the file correctly.document.pdf
AI Analyzer IdYesThe saved Analyzer that controls extraction. Create Analyzers at https://dev.pdf4me.com/dashboard/#/ai-document-parser/ (+ Add), then edit schemas on https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>. Dropdown populated via GetAnalyzerId API. Sent as customisationNote. Pick Parse for one schema or Classify for many variants.aaaa133

Opsi Tipe Data Input

Pilih bagaimana dokumen masuk ke dalam node. Kolom selanjutnya akan berubah sesuai pilihan ini.

Menu tarik-turun Tipe Data Input pada node n8n PDF4me AI Document Parser menampilkan tiga opsi: Data Biner (disorot) dengan deskripsi Gunakan file dokumen dari node sebelumnya, String Base64 dengan deskripsi Berikan konten dokumen sebagai string yang dikodekan base64, URL dengan deskripsi Berikan URL ke file dokumen

Tipe Data Masukan. Data Biner (default), String Base64, atau URL.

Data BinerDefault: file dari node sebelumnya
Membaca dokumen langsung dari node sebelumnya seperti Google Drive Download, HTTP Permintaan, Baca File Biner, atau node lampiran email. Atur Bidang Biner Masukan ke nama bidang biner (default) dataNama file yang diunggah akan digunakan kecuali Anda menggantinya dengan Nama Dokumen.
String Base64Dokumen terenkode sebaris
Tempel atau petakan string base64 ke dalam Konten Dokumen Base64Awalan gaya Data-URL (teks sebelum koma) akan dihilangkan secara otomatis. Nama Dokumen dengan deteksi format drive ekstensi yang tepat.
URLUnduh dari tautan publik
Menyediakan layanan publik HTTPS URL di dalam URL Dokumen. PDF4me mengambil dokumen secara langsung. Nama file untuk diproses diambil dari URL Jika memungkinkan, jalankan dari Nama Dokumen.

AI Dropdown ID Penganalisis

Menu tarik-turun diisi dari data Anda. PDF4me akun melalui DapatkanIdAnalyzer API Saat Anda membuka kolom tersebut. Setiap opsi adalah Analyzer yang telah Anda simpan di PDF4me Dasbor. Pilih yang skemanya sesuai dengan tipe dokumen yang sedang Anda proses.

Dropdown ID Penganalisis AI terbuka di node n8n PDF4me AI Document Parser yang menampilkan tiga contoh opsi Penganalisis: aaaa133, TestTenantProject, TestTenant

AI Dropdown ID Analyzer dimuat dari Anda PDF4me akun.

Penganalisis Parse
Skema Satu Dokumen. Node ini mengembalikan persis bidang-bidang yang didefinisikan dalam skema tersebut. Paling baik digunakan ketika setiap dokumen yang Anda proses memiliki keluarga tata letak yang sama. Lihat Panduan pengaturan Parse untuk aturan skema termasuk fieldType: "table" untuk baris bersarang dan Metode lapangan (ekstrak nilai default, hasilkan untuk mendapatkan/menormalisasi).
Klasifikasi Penganalisis
Banyak Skema, satu untuk setiap varian dokumen. Skema tersebut AI Mengarahkan dokumen yang masuk ke Skema yang paling cocok menggunakan Prompt Klasifikasi setiap Skema, kemudian mengembalikan Nama Klasifikasi yang cocok beserta kolom-kolomnya. Lihat Panduan pengaturan klasifikasi.

Dropdown kosong? Simpul tersebut menunjukkan "GetAnalyzerId tidak mengembalikan opsi analyzer" ketika akun Anda tidak memiliki Analyzer atau ketika kredensial tidak dapat menjangkau APIBuka Daftar penganalisis dan tambahkan setidaknya satu Analyzer pada Detail penganalisis halaman, lalu verifikasi API masukkan n8n kredensial.

Bidang Keluaran

Satu kali lari yang sukses akan menghasilkan satu n8n barang dengan JSON hanya, tidak ada file biner. Kunci tingkat atas sesuai dengan skema Analyzer Anda; sebuah _metadata Objek selalu ditambahkan.

BidangJenisIsi di dalamnya
Top-level extracted fieldsDynamicOne key per field defined in your Analyzer schema (string, number, date, or nested table rows). Names match fieldName exactly.
_metadata.successBooleantrue on a successful parse.
_metadata.messageString"Document parsed successfully using AI Document Parser".
_metadata.processingTimestampStringISO timestamp of the parse.
_metadata.sourceFileNameStringDocument name used for processing.
_metadata.aiAnalyzerIdStringThe Analyzer Id you selected (sent as customisationNote to the API).
_metadata.operationString"aiDocumentParser".
rawContent (fallback only)StringIf the API returns plain text instead of JSON and parsing fails, the node wraps the response as { "rawContent": "<api response string>" } at the top level.

Pengaturan Cepat

  1. Bangun Analyzer Anda terlebih dahulu. Buka Daftar penganalisis, klik + Tambahkan, ketik ID Analyzer yang jelas, pilih Menguraikan atau Menggolongkan, simpan baris tersebut, lalu tambahkan Skema Dokumen pada Detail penganalisis halaman. Lihat Panduan pengaturan Parse atau Panduan pengaturan klasifikasi untuk aturan skema lengkap, termasuk fieldType: "table" untuk baris bersarang dan fieldMethod (ekstraksi atau pembuatan).
  2. Di dalam dirimu n8n alur kerja, klik + dan mencari PDF4me. Mengatur Sumber ke Ekstrak Dan Operasi Ekstraksi ke Pengurai Dokumen AI.
  3. Di dalam Kredensial untuk terhubung dengan, pilih milikmu PDF4me kredensial atau tempelkan API kunci.
  4. Mengatur Tipe Data MasukanData Biner (default) membaca dari node sebelumnya dan merupakan yang paling umum.
  5. Isi kolom input yang sesuai (Bidang Biner Masukan, Konten Dokumen Base64, atau URL Dokumen).
  6. Nama Dokumen. Ganti pengaturan default document.pdf untuk menggunakan nama file sebenarnya dengan ekstensi yang tepat.
  7. Pilih salah satu AI ID Penganalisis dari menu tarik-turun (dimuat dari akun Anda).
  8. Jalankan node tersebut. Item output membawa field yang telah diurai di level teratas ditambah _metadata. Arahkan ke Set, Kode, Google Sheets, Airtable, basis data, email, atau node hilir lainnya.

Pengaturan Umum

Contoh Alur KerjaCommon n8n workflow patterns using AI Document Parser.
Lampiran email ke Google Sheets
  1. Pemicu Email (IMAP) aktif saat ada pesan baru dengan PDF lampiran.
  2. AI Document Parser berjalan dengan Tipe Data Masukan Data Biner, Nama Dokumen diatur ke nama file lampiran, AI ID Analyzer diatur ke milik Anda pengurai faktur Penganalisis.
  3. Google Sheets Menambahkan Menuliskan invoiceNumber, vendorName, totalAmount, dueDate ke dalam pelacak AP.
Kotak masuk multi-vendor dengan Classify
  1. Folder yang dipantau menerima tanggapan beragam. PDFs dari Klien ABC, Klien XYZ, dan ekor panjang.
  2. AI Document Parser diatur ke Classify Analyzer Id (satu Skema per vendor).
  3. Node Switch akan bercabang berdasarkan Nama Klasifikasi yang cocok yang dikembalikan dalam respons, mengirimkan setiap hasil ke tabel hilir yang sesuai.
Dokumen yang dihosting oleh URL
  1. Webhook menerima tautan dokumen dari portal Anda.
  2. AI Pengurai Dokumen berjalan dengan Tipe Data Masukan URL dan ID Analyzer formulir kustom Anda.
  3. Keluaran JSON dipetakan ke dalam operasi penulisan Dataverse / Airtable / Postgres untuk membuat catatan baru.
Pindai, pangkas otomatis, lalu uraikan
  1. Hasil pemindaian masuk ke dalam folder dengan batas yang lebar.
  2. AI Memotong Dokumen Secara Otomatis (Sumber daya) AI) memangkas bagian tepinya.
  3. AI Document Parser berjalan pada data biner yang telah dipotong dengan ID Analyzer yang sesuai.
  4. Diuraikan JSON mengalir ke hilir seperti biasa.
Validasi lalu perkaya
  1. AI Pengurai Dokumen mengembalikan bidang terstruktur.
  2. Node Kode memvalidasi kolom yang wajib diisi dan menerapkan aturan bisnis.
  3. Jika valid, sebuah HTTP Permintaan diperkaya dengan data vendor dari CRM Anda; jika tidak, peringatan akan dikirim ke Slack untuk ditinjau secara manual.

Tips Praktis

Set up the Analyzer in PDF4me first
The node does not define extraction rules. It runs whatever your selected Analyzer specifies. Build it in the dashboard before configuring the node.
Use Document Name with the real extension
PDF4me uses the extension for format detection. Even on Binary Data, an explicit Document Name with the correct extension is safest.
No Output Binary Field Name and no Advanced Options
Unlike AI Auto Crop Document, this operation has neither. The output is JSON only; there is nothing to write back as a binary file.
Plain-text fallback wraps as rawContent
If the API returns plain text instead of JSON and parsing fails, the node wraps the response as { "rawContent": "<string>" } so the workflow does not break.
Combine with AI Auto Crop Document for scans
Scans with wide borders parse better after cropping. Chain AI Auto Crop Document (Resource AI) before this node.
Use AI-Invoice Parser / AI-Process Contract for built-in schemas
When you only need standard invoice or contract fields, the dedicated nodes are simpler. AI Document Parser shines when you have a custom schema.

Penyelesaian Masalah

"AI ID Analyzer diperlukan"

Pilih Analyzer dari menu tarik-turun sebelum menjalankan. Kolom ini tidak boleh kosong.

"Tidak ditemukan data biner pada properti '…'"

Sejajarkan Bidang Biner Masukan dengan node sebelumnya (seringkali data). Laporan kesalahan tersebut menyebutkan properti mana yang hilang.

"Isi dokumen wajib diisi"

Base64 kosong atau file hilang. Berikan konten pada kolom Tipe Data Input yang sesuai.

"Tidak sah URL format"

Memeriksa URL Dokumen adalah dokumen lengkap dan valid. URL (skema + host + jalur).

"GetAnalyzerId tidak mengembalikan opsi analyzer"

Tidak ada Analyzer di akun, atau ada masalah kredensial. Buat Analyzer di sini. PDF4me dasbor atau verifikasi API kunci di n8n kredensial.

Lembar Panduan Singkat

BidangNilai
ResourceExtract
OperationAI Document Parser
Input Data TypeBinary Data
Input Binary Fielddata
Document Nameform.pdf (with the real extension)
AI Analyzer Id(pick from the dropdown loaded from your account)
CredentialsPDF4me API credential

Pertanyaan yang Sering Diajukan

Where does the AI Analyzer Id list come from?+
The dropdown is populated from your PDF4me account via the GetAnalyzerId API. Each option is an Analyzer you created at https://dev.pdf4me.com/dashboard/#/ai-document-parser/ with schemas on https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>. The node sends the selected value as customisationNote to the AiDocumentParser API.
What does "GetAnalyzerId returned no analyzer options" mean?+
The account has no Analyzers configured, or the credentials cannot reach the GetAnalyzerId endpoint. Open https://dev.pdf4me.com/dashboard/#/ai-document-parser/ and create at least one Analyzer (Parse or Classify) on the Analyzer detail page, or verify the API key in your n8n credential.
How is this different from AI-Invoice Parser, AI-Process Contract, AI-Process Bank Cheque?+
Those nodes use fixed schemas tuned to those document types. AI Document Parser is schema-driven: it runs whatever Analyzer you select, so the same node handles invoices, purchase orders, receipts, custom forms, lab reports, anything you describe in a schema. Pick AI Document Parser whenever you need a custom layout or document type.
What shape does the output have?+
Top-level keys match the field names in your Analyzer schema (for example customerName, invoiceNumber, totalAmount, lineItems). Nested objects and table arrays follow the same shape you defined. A _metadata object is always appended with success, message, processingTimestamp, sourceFileName, aiAnalyzerId, and operation. No binary file is returned.
Does this work on scanned PDFs?+
Yes. The AI engine handles OCR internally, so scanned PDFs and image formats work the same as native PDFs. If borders are large, chain AI Auto Crop Document (Resource AI) before this node for cleaner extraction.
Can I change the Analyzer schema without rebuilding the workflow?+
Yes. The workflow only references the Analyzer Id. Edit the schema in the PDF4me dashboard and the next run picks up the new shape automatically. Output keys follow your latest schema, so any downstream Set / Code / Sheets nodes that assume specific keys may need updating after a breaking schema change.
Can I switch between Parse and Classify Analyzers without rewiring the node?+
Yes. Both Analyzer types are listed in the AI Analyzer Id dropdown. Pick a Classify Analyzer when you want one node to handle several document variants; pick a Parse Analyzer for a single fixed schema. The output shape adapts to whichever you choose.
What happens when the API returns plain text instead of JSON?+
The node tries to parse it; if parsing fails, the response is wrapped as { "rawContent": "<api response string>" } at the top level so the workflow does not break. Useful for inspecting unexpected responses during development.

Tindakan Terkait

Tugas yang Sama di Platform Lain

Dapatkan Bantuan