Lewati ke konten utama

Pengurai Dokumen AI menggunakan Classify

Apa yang dibahas dalam panduan ini?

Pengurai Dokumen AI. Klasifikasi Memungkinkan satu Analyzer untuk menangani beberapa varian dokumen dalam satu panggilan. Anda mendefinisikan sebuah ID Penganalisis, lalu tambahkan satu Diagram per varian (Klien ABC, Klien XYZ, faktur umum, pesanan pembelian umum). Setiap Skema membawa Nama Klasifikasi, A Petunjuk Klasifikasi dalam bahasa alami, dan sebuah Skema Dokumen Menjelaskan bidang-bidang yang akan diekstrak. Saat dijalankan, AI mencocokkan data yang masuk. PDF terhadap setiap Prompt Klasifikasi Skema, memilih yang paling sesuai, dan mengembalikan Nama Klasifikasi yang cocok serta bidang yang diekstrak. ID Analyzer yang sama berlaku dari REST API dan setiap platform otomatisasi yang didukung.

Postingan Blog Terkait(4)
Ekstraksi AI dan Penggantian Nama Cerdas untuk PDF Apa Pun di Make: Alur Kerja Dropbox 4 Modul dengan PDF4me AI - Pengurai Dokumen
Skenario pembuatan empat modul: ambil PDF vendor dari Dropbox, jalankan AI - Document Parser dengan default_invoice_extraction, uraikan JSON untuk menampilkan vendorName, lalu unggah ulang dengan nama file vendorName.pdf. Tangkapan layar asli, nilai bidang yang tepat, tanpa entri data manual.
Baca postingan
AI-Rename Vendor Factories in Zapier: Alur Kerja 5 Langkah Dropbox + PDF4me
Proses Zap lima langkah: Dropbox File Baru di Folder → Dropbox Cari File → PDF4me AI - Pengurai Dokumen → Kode oleh Zapier Jalankan JavaScript → Dropbox Unggah File. Mengekstrak Nama Pelanggan dengan AI dan menggunakannya sebagai nama file keluaran. Tangkapan layar asli, nilai bidang yang tepat, tanpa kode selain JSON.parse 2 baris.
Baca postingan
Mengubah Nama Setiap Faktur Vendor menjadi Nama Pemasok di Zapier: Alur Kerja 5 Langkah Dropbox + AI PDF4me
Lima langkah praktis untuk tim pembayaran utang. Dropbox memantau folder penerimaan faktur Anda, PDF4me AI - Document Parser mengekstrak Nama Vendor dari setiap PDF, Code by Zapier mengubah output parser menjadi token yang dapat dipetakan, dan Dropbox mengunggah kembali file tersebut dengan nama pemasok sebagai nama file. Tangkapan layar asli, nilai bidang yang tepat, dan file sample-vendor-invoice.pdf yang sama yang digunakan dalam panduan ini dapat diunduh.
Baca postingan

Memverifikasi Pengaturan Anda

Penganalisis Klasifikasi dibuat di PDF4me Dasbor pengembang. Masuk dengan akun Anda, lalu buat atau salin sebuah API kunci untuk AI Parser API panggilan yang merujuk pada Analyzer yang Anda buat di sini.

URL dasbor yang akan Anda gunakan dalam panduan ini:

Fakta Penting yang Tidak Boleh Anda Lewatkan

Satu Penganalisis, banyak Skema (satu per varian)
Classify dirancang untuk dunia nyata di mana faktur Klien ABC terlihat berbeda dari faktur Klien XYZ. Tambahkan Skema sebanyak varian yang Anda miliki. Setiap Skema merupakan bundel mandiri yang berisi Nama Klasifikasi + Prompt + Skema Dokumen.
Perintah Klasifikasi adalah otak dari proses perutean.
Tuliskan dalam bahasa Inggris yang sederhana. Sebutkan penanda konkret seperti nama perusahaan di bagian atas, alamat email kontak, petunjuk tata letak, kata-kata yang hanya digunakan dalam varian ini. Semakin jelas petunjuknya, semakin lancar pengalihannya.
Fungsi Classify mengembalikan label dan data.
Tidak seperti pengklasifikasi murni, responsnya mencakup Nama Klasifikasi yang cocok. Dan Semua field dari Skema Dokumen Skema tersebut. Satu panggilan akan memberikan Anda keputusan perutean dan data yang diekstrak. JSON bersama.

Langkah 1: Buka AI Document Parser di dasbor

  1. Masuk di dev.pdf4me.com.
  2. Dari bilah sisi dasbor, klik Pengurai Dokumen AI.
  3. Halaman daftar menampilkan setiap Analyzer yang ada dengan tiga kolom: ID Penganalisis, Jenis Penganalisis (Menguraikan atau Mengklasifikasikan), dan Tindakan.
  4. Klik yang berwarna biru + Tambahkan tombol untuk memulai Analyzer baru.
Tampilan daftar dasbor PDF4me AI Document Parser dengan item sidebar AI Document Parser yang disorot merah, tombol Tambah berwarna biru di bagian atas panel utama, dan tabel kosong dengan judul kolom ID Analyzer, Tipe Analyzer, dan Tindakan.

Tampilan daftar AI Document Parser. Klik + Tambah untuk memulai Analyzer baru.

Langkah 2: Buat Penganalisis Klasifikasi

Baris baru muncul dengan tiga kontrol:

  1. Input ID PenganalisisKetikkan pengenal yang jelas dan mudah diingat, misalnya... client_invoices, Vendor Documents, atau incoming-ordersTidak ada batasan format penamaan. snake_case, camelCase, kebab-case, kata biasa dengan spasi, semuanya berfungsi sama. Contoh di bawah ini menggunakan client_invoices.
  2. Menu tarik-turun Tipe Penganalisis. memilih Menggolongkan (panduan ini) atau Menguraikan (lihat Panduan parse).
  3. Simpan / Batal Tombol. Simpan akan membuat Analyzer; Batal akan menghapus baris tersebut.
PDF4me AI Document Parser Tambahkan baris yang terbuka dengan kolom ID Analyzer terisi dengan client_invoices, dropdown Tipe Analyzer menunjukkan Klasifikasi disorot di atas Parse, dan nilai Klasifikasi dipilih di baris tersebut, dengan tombol Simpan dan Batal di sebelah kanan.

Tambahkan baris: masukkan ID Analyzer (di sini) faktur_klien), memilih Menggolongkan, lalu Simpan.

Langkah 3: Buka Analyzer dan tambahkan Skema pertama

Klik baris baru untuk membuka halaman detail. Pola URL-nya adalah:

https://dev.pdf4me.com/ai-document-parser/?id=<your-analyzer-guid>

Dasbor akan menampilkan GUID untuk setiap Analyzer saat pertama kali Anda membukanya. Tandai URL ini untuk langsung kembali ke Classify Analyzer yang sama di lain waktu.

Halaman detail menampilkan:

  • Klasifikasikan Informasi (kiri). menunjukkan ID Analyzer yang Anda ketik di Langkah 2 (di sini) client_invoicesPanel ini hanya dapat dibaca.
  • Skema (kanan). Kosong secara default. Setiap Skema adalah satu varian dokumen. Klik + Klik tombol di pojok kanan atas untuk menambahkan Skema pertama.
  • Simpan Perubahan (kiri atas). akan tetap ada setiap perubahan yang Anda buat di halaman ini.
  • Kembali. kembali ke Daftar penganalisis.
Halaman detail PDF4me AI Document Parser untuk Classify Analyzer. Banner biru utama bertuliskan AI Document Parser dengan subjudul Ekstrak data faktur secara otomatis menggunakan AI dengan output yang cepat, akurat, dan terstruktur. Di bawahnya terdapat tombol Kembali dan tombol Simpan Perubahan berwarna biru. Panel Info Klasifikasi di sebelah kiri menampilkan ID Analyzer client_invoices. Bagian Skema di sebelah kanan kosong, dengan tombol plus biru di paling kanan untuk menambahkan Skema baru.

Halaman detail. Klasifikasikan Informasi Di sebelah kiri terdapat ID Analyzer. Klik tombol + berwarna biru untuk menambahkan Skema.

Langkah 4: Isi Nama Klasifikasi, Petunjuk, dan Skema Dokumen

Setiap Skema merupakan satu varian dokumen yang harus ditangani oleh Analyzer. Setiap Skema memiliki tiga input yang wajib diisi dan baris pengisian cepat yang sudah dikenal di bagian bawah.

Kolom skema (wajib diisi)

BidangTujuanContoh
Classification NameThe label returned by the API when this Schema matches. Use a short, business-friendly name.Client ABC
Classification PromptNatural-language description of how to recognise this variant. Mention company name, email, layout cues, distinguishing phrases. This is what the AI uses to route.The invoice has the company name ABC at the top, followed by the contact email [email protected].
Document SchemaJSON object with a description and a fields array. Each field has fieldName, fieldType, and fieldDescription, plus an optional fieldMethod such as generate for derived values.{ "description": "Extract invoice detail for ABC invoices", "fields": [ ... ] }

Contoh Skema: Klien ABC

PDF4me AI Document Parser Classify Schema editor menampilkan Skema pertama berjudul Klien ABC. Panel Info Klasifikasi di sebelah kiri berisi ID Penganalisis client_invoices. Kartu Skema memiliki ikon tempat sampah merah untuk menghapus, kolom Nama Klasifikasi dengan nilai Klien ABC, kolom Prompt Klasifikasi dengan teks Nama Faktur di bagian atas akan berisi nama perusahaan ABC dan setelah itu email akan berada di bagian atas untuk faktur klien di abc.com, dan editor JSON Skema Dokumen yang menampilkan deskripsi Ekstrak detail faktur untuk faktur ABC dan array bidang yang dimulai dengan string invoiceNumber Nomor faktur, nomor tagihan, nomor tanda terima, dan invoiceDate tanggal pembuatan. Di bawah editor terdapat tombol pengisian cepat Faktur dan Pesanan Pembelian.

Skema Pertama. Nama Klasifikasi, Petunjuk Klasifikasi, dan Skema Dokumen bersama-sama menjelaskan satu varian dokumen.

Client ABC. Document Schema
{
"description": "Extract invoice detail for ABC invoices",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldMethod": "generate",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4-digit year not found then consider 2-digit year at the end of extracted date."
}
]
}

Perintah Klasifikasi untuk Klien ABC adalah petunjuk bahasa alami yang mengarahkan AI ke Skema ini:

"Faktur tersebut memuat nama perusahaan ABC di bagian atas, diikuti oleh alamat email kontak." [email protected]."

Langkah 5: Tambahkan Skema Lainnya dan Simpan Perubahan

Klik yang berwarna biru + Tekan tombol lagi untuk menambahkan Skema untuk varian berikutnya. Setiap Skema baru mendapatkan Nama Klasifikasi, Petunjuk Klasifikasi, dan Skema Dokumennya sendiri. Kolom-kolomnya dapat berbeda sepenuhnya antar Skema. Klien ABC mungkin tidak memiliki kolom referensi pelanggan sementara Klien XYZ memilikinya.

Contoh Skema kedua: Klien XYZ

PDF4me AI Document Parser mengklasifikasikan kartu Skema kedua berjudul Klien XYZ. Nama Klasifikasi Klien XYZ, Petunjuk Klasifikasi Dokumen tersebut adalah faktur dengan nama perusahaan XYZ di bagian atas, kemudian email support at xyz.com diikuti oleh alamat, dan editor JSON Skema Dokumen yang menunjukkan deskripsi Ekstrak data Faktur dari faktur perusahaan XYZ dengan array bidang yang dimulai dengan invoiceNumber dan invoiceDate. Di bawah editor terdapat tombol pengisian cepat Faktur dan Pesanan Pembelian.

Skema kedua untuk Analyzer yang sama. Kedua skema tersebut sekarang berada di bawah [lokasi yang sama]. faktur_klien.

Client XYZ. Document Schema
{
"description": "Extract Invoice data from company XYZ's Invoice",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldMethod": "generate",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4-digit year not found then consider 2-digit year at the end of extracted date."
}
]
}

Daftar Skema akan tertutup setelah Anda Menyimpan

Setelah kedua Skema dimasukkan, daftar akan menampilkan masing-masing sebagai kartu yang dapat dilipat dengan Nama Klasifikasi di sebelah kiri dan tanda panah untuk memperluas di sebelah kanan. Klik kartu untuk mengeditnya lagi nanti.

Halaman detail PDF4me AI Document Parser untuk Classify Analyzer yang menampilkan kedua Skema dalam tampilan daftar yang diperkecil. Panel Info Klasifikasi di sebelah kiri menampilkan ID Analyzer client_invoices. Bagian Skema di sebelah kanan mencantumkan Klien ABC dan Klien XYZ sebagai dua kartu akordeon yang diperkecil dengan panah perluasan berbentuk chevron. Tombol plus berwarna biru terletak di pojok kanan atas untuk menambahkan lebih banyak Skema.

Kedua skema telah tersimpan. Klik kartu mana pun untuk memperluas dan mengedit; gunakan tanda + untuk menambahkan varian lainnya.

Klik Simpan Perubahan Di pojok kiri atas, Anda dapat menyimpan setiap Skema yang telah Anda tambahkan. Analyzer kini aktif dan siap menerima data. PDFs.

Opsi tingkat bidang di dalam Skema Dokumen

AtributDiperlukan?Apa fungsinya?
fieldNameRequiredThe name of the field and how it will appear in the response JSON.
fieldTypeRequiredThe type of data to extract. One of string, number, date, or table.
fieldDescriptionRequiredNatural-language description of what needs to be extracted and where to find it. Include alternate labels and example formats so the AI matches correctly.
fieldMethodOptional (default extract)How the AI fills the value. extract takes the value verbatim from the document. generate tells the AI to derive or normalise it (useful for dates, computed totals, or cleaned-up IDs). Omit for default extract behaviour.
fieldsRequired when fieldType is tableNested array describing the columns of the table. Each entry takes the same attributes as a top-level field (fieldName, fieldType, fieldDescription, fieldMethod). Cannot itself be table.

Skema dengan kolom tabel (baris bersarang)

Menggunakan fieldType: "table" Ketika sebuah Skema perlu mengekstrak baris yang berulang seperti item baris faktur. Setiap kolom tabel memiliki kolom bersarangnya sendiri. ladang array yang menjelaskan kolom-kolom tersebut.

{
"description": "Invoice data extractor",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4 digit year not found then consider 2 digit year at the end of extracted date.",
"fieldMethod": "generate"
},
{
"fieldName": "lineItems",
"fieldType": "table",
"fieldDescription": "All product / service rows from the invoice table. Be careful, sometimes a row can be part of the next item like when description goes over one line, but it's of a single item.",
"fields": [
{
"fieldName": "itemNumber",
"fieldType": "string",
"fieldDescription": "Product number, product id number or product code"
},
{
"fieldName": "hsnCode",
"fieldType": "string",
"fieldDescription": "HSN / SAC code (4 to 8 digit)"
}
]
}
]
}

Tombol pengisian cepat (gunakan sebagai titik awal)

Editor Skema menawarkan Faktur Dan Pesanan Pembelian tombol preset di bagian bawah kartu Skema Dokumen. Gunakanlah sebagai titik awal. Hanya itu. Klik salah satu untuk mengisi skema tipikal untuk keluarga dokumen tersebut, lalu sesuaikan nama bidang, tipe, metode, dan deskripsi agar sesuai dengan varian spesifik yang Anda konfigurasi. Preset tersebut hanyalah kerangka, bukan bentuk akhir.

Gunakan Penganalisis Klasifikasi di API atau panggilan otomatisasi

Setelah disimpan, ID Analyzer yang sama dapat dijalankan di mana saja melalui referensi. Anda tidak perlu membuat ulang Skema di setiap platform.

BidangSumberTujuan
AnalyzerIdString yang Anda ketik di Langkah 2 (client_invoices)Pengidentifikasi stabil untuk Classify Analyzer.
docNameSumber PDF nama fileDigunakan untuk pelacakan dan pesan kesalahan.
docContentSumber PDF dikodekan sebagai Base64Dokumen yang akan diklasifikasikan dan diekstrak.
asyncfalse untuk sinkron, true untuk jajak pendapatMengontrol penyampaian respons.

Contoh REST Isi permintaan:

{
"docName": "incoming_invoice.pdf",
"docContent": "BASE64_ENCODED_PDF_CONTENT",
"AnalyzerId": "client_invoices",
"async": false
}

Respons tersebut membawa Nama Klasifikasi yang cocok ditambah bidang-bidang yang didefinisikan dalam Skema Dokumen Skema tersebut. Dokumen yang dikenali sebagai Klien ABC mengembalikan bidang-bidang Klien ABC; dokumen yang dikenali sebagai Klien XYZ mengembalikan bidang-bidang Klien XYZ. Satu panggilan, kedua keputusan.

Alur kerja umum

Pola Penganalisis Klasifikasi KhasHow a Classify Analyzer with multiple Schemas runs in production.
Kotak masuk AP multi-klien
  1. Faktur vendor dari Klien ABC, Klien XYZ, dan beberapa lainnya tiba di satu kotak surat.
  2. Make, Zapier, Power Automate, atau n8n memanggil AI Parser dengan ID Penganalisis: faktur_klien.
  3. Respons tersebut berisi Nama Klasifikasi (Klien ABC, Klien XYZ, dll.) dan bidang-bidang yang diekstrak.
  4. Langkah peralihan mengarahkan setiap hasil ke yang sesuai. ERP Catatan pelanggan menggunakan Nama Klasifikasi; kolom yang diekstrak langsung mengisi catatan faktur.
Proses pendaftaran vendor tanpa perlu membangun ulang sistem.
  1. Vendor baru mengirimkan faktur dengan tata letak yang berbeda untuk pertama kalinya.
  2. Operasi membuka yang sudah ada faktur_klien Analisis di dasbor dan klik +.
  3. Skema baru ditambahkan dengan Nama Klasifikasi (nama vendor), Petunjuk Klasifikasi yang menjelaskan tata letak, dan Skema Dokumen untuk bidang-bidang yang penting.
  4. Panggilan masuk berikutnya PDF Dialihkan ke Skema baru secara otomatis. Tidak diperlukan pengkabelan ulang otomatisasi.
Penyaringan dokumen campuran
  1. One Analyzer mencakup faktur, pesanan pembelian, dan nota kredit.
  2. Setiap Petunjuk Klasifikasi Skema menjelaskan penanda pembeda ("berisi Tagihan Kepada dan total yang harus dibayar" vs. "berisi nomor PO dan alamat Pengiriman").
  3. Skema Dokumen per Skema mengekstrak bidang-bidang yang relevan dengan tipe dokumen tersebut.
  4. Cabang perutean hilir berdasarkan Nama Klasifikasi; setiap cabang menulis ke sistem yang sesuai.

Praktik terbaik skema untuk Klasifikasi

  • Satu Skema untuk setiap varian dokumen yang stabil. Dua vendor dengan tata letak yang sangat berbeda seharusnya menggunakan dua Skema, bukan satu dengan aturan yang tumpang tindih.
  • Prompt Klasifikasi adalah aturan pengarahan Anda. Tulis dalam bahasa Inggris yang sederhana dan sertakan penanda konkret (nama perusahaan, email, frasa khas, petunjuk tata letak).
  • Gunakan Nama Klasifikasi yang singkat, mudah dipahami oleh kalangan bisnis, dan stabil. Nama inilah yang menjadi acuan percabangan perutean hilir Anda.
  • Gunakan tombol pengisian cepat Faktur dan Pesanan Pembelian sebagai titik awal, lalu perketat deskripsi kolom untuk setiap varian.
  • Menambahkan fieldMethod: "generate" pada tanggal, total yang dihitung, atau kolom di mana AI harus menormalkan nilainya alih-alih menyalinnya apa adanya.
  • Uji setiap Skema terhadap sampel nyata sebelum ditayangkan: faktur Klien ABC yang jelas harus selalu diarahkan ke Skema Klien ABC, bukan Klien XYZ.
  • Klik Simpan Perubahan Setelah setiap putaran pengeditan; Skema yang belum disimpan akan hilang saat navigasi.

Tindakan terkait

Pengurai Dokumen AI menggunakan Parse
Dasbor yang sama, satu Skema per Penganalisis. Gunakan saat setiap dokumen yang Anda proses memiliki satu keluarga tata letak yang sama.
AI - Pengurai Dokumen di Make
Gunakan ID Classify Analyzer yang telah Anda simpan dari Make skenario. Pasangkan dengan modul sumber data dan penyimpanan apa pun untuk memperluas perutean dan ekstraksi dalam alur kerja visual.
AI - Pengurai Dokumen di Power Automate
Jalankan Classify Analyzer yang sama dari sebuah Power Automate mengalir. Terhubung secara alami ke SharePoint, Excel, Dataverse, Dan Outlook.
AI - Pengurai Dokumen di n8n
Dihosting sendiri atau berbasis cloud n8n alur kerja. Menu tarik-turun ID AI Analyzer memuat Analyzer yang Anda simpan langsung dari akun Anda.
AI - Pengurai Dokumen di Zapier
Picu ekstraksi AI dari salah satu dari 6.000+ data. SaaS aplikasi dan webhook. Ketik ID Classify Analyzer yang telah Anda simpan di kolom Nama AI Analyzer.

Pertanyaan yang Sering Diajukan

How is Classify different from Parse in AI Document Parser?+
Parse holds a single Document Schema and returns its extracted fields. Classify holds multiple Schemas, one per document variant, each with its own Classification Prompt and Document Schema. At runtime the AI picks the best-matching Schema and returns its fields plus the Classification Name. Use Classify when one Analyzer must handle several layouts.
What is the Classification Prompt?+
A natural-language description of the markers that identify this document variant. Mention the company name printed at the top, the contact email, layout cues, anything distinctive. The AI compares every Schema Classification Prompt against the incoming PDF to pick the best match.
Can each Schema have different fields?+
Yes. Each Schema has its own Document Schema, so Client ABC can extract invoiceNumber and invoiceDate while Client XYZ extracts invoiceNumber, customerRef, and PONumber. The response contains exactly the fields defined in the matched Schema.
What does fieldMethod: generate do?+
Inside a Document Schema, fieldMethod controls how the AI fills the value. generate tells the AI to derive or normalize the value rather than copy a substring verbatim. Useful for dates (normalize multiple formats), totals (compute or normalize), and identifiers that may need cleanup. Omit fieldMethod for straight extraction.
How many Schemas can I add to one Analyzer?+
No hard cap published. In practice, 5 to 20 well-described Schemas per Analyzer perform best. If you need dozens, group similar variants under broader Classification Names and let the Document Schema handle the small differences.
Does the Analyzer Id change after Save Changes?+
No. The Analyzer Id is the string you typed in the Add row in Step 2 (for example client_invoices). It stays stable across edits and is the value every API call and automation module uses.
Do I need to upload a sample PDF when setting up the Analyzer?+
No. The AI Analyzer does not need a sample for setup. You describe each variant in natural language via the Classification Prompt; the AI engine applies the prompts to whatever document you send at runtime.
What happens if the incoming PDF does not match any Schema confidently?+
The AI still returns its best guess. To handle ambiguous cases, add a catch-all Schema with a generic Classification Prompt and a minimal Document Schema, or route low-confidence responses to a manual review queue in your automation.

Dapatkan Bantuan