Pengurai Dokumen AI menggunakan Classify
Apa yang dibahas dalam panduan ini?
Pengurai Dokumen AI. Klasifikasi Memungkinkan satu Analyzer untuk menangani beberapa varian dokumen dalam satu panggilan. Anda mendefinisikan sebuah ID Penganalisis, lalu tambahkan satu Diagram per varian (Klien ABC, Klien XYZ, faktur umum, pesanan pembelian umum). Setiap Skema membawa Nama Klasifikasi, A Petunjuk Klasifikasi dalam bahasa alami, dan sebuah Skema Dokumen Menjelaskan bidang-bidang yang akan diekstrak. Saat dijalankan, AI mencocokkan data yang masuk. PDF terhadap setiap Prompt Klasifikasi Skema, memilih yang paling sesuai, dan mengembalikan Nama Klasifikasi yang cocok serta bidang yang diekstrak. ID Analyzer yang sama berlaku dari REST API dan setiap platform otomatisasi yang didukung.
Memverifikasi Pengaturan Anda
Penganalisis Klasifikasi dibuat di PDF4me Dasbor pengembang. Masuk dengan akun Anda, lalu buat atau salin sebuah API kunci untuk AI Parser API panggilan yang merujuk pada Analyzer yang Anda buat di sini.
- Daftar alat analisis (Langkah-langkah 1, 2):
https://dev.pdf4me.com/dashboard/#/ai-document-parser/ - Rincian alat analisis (Langkah-langkah 3, 4, 5):
https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>
Fakta Penting yang Tidak Boleh Anda Lewatkan
Langkah 1: Buka AI Document Parser di dasbor
- Masuk di dev.pdf4me.com.
- Dari bilah sisi dasbor, klik Pengurai Dokumen AI.
- Halaman daftar menampilkan setiap Analyzer yang ada dengan tiga kolom: ID Penganalisis, Jenis Penganalisis (Menguraikan atau Mengklasifikasikan), dan Tindakan.
- Klik yang berwarna biru + Tambahkan tombol untuk memulai Analyzer baru.

Tampilan daftar AI Document Parser. Klik + Tambah untuk memulai Analyzer baru.
Langkah 2: Buat Penganalisis Klasifikasi
Baris baru muncul dengan tiga kontrol:
- Input ID PenganalisisKetikkan pengenal yang jelas dan mudah diingat, misalnya...
client_invoices,Vendor Documents, atauincoming-ordersTidak ada batasan format penamaan. snake_case, camelCase, kebab-case, kata biasa dengan spasi, semuanya berfungsi sama. Contoh di bawah ini menggunakanclient_invoices. - Menu tarik-turun Tipe Penganalisis. memilih Menggolongkan (panduan ini) atau Menguraikan (lihat Panduan parse).
- Simpan / Batal Tombol. Simpan akan membuat Analyzer; Batal akan menghapus baris tersebut.

Tambahkan baris: masukkan ID Analyzer (di sini) faktur_klien), memilih Menggolongkan, lalu Simpan.
Langkah 3: Buka Analyzer dan tambahkan Skema pertama
Klik baris baru untuk membuka halaman detail. Pola URL-nya adalah:
https://dev.pdf4me.com/ai-document-parser/?id=<your-analyzer-guid>
Dasbor akan menampilkan GUID untuk setiap Analyzer saat pertama kali Anda membukanya. Tandai URL ini untuk langsung kembali ke Classify Analyzer yang sama di lain waktu.
Halaman detail menampilkan:
- Klasifikasikan Informasi (kiri). menunjukkan ID Analyzer yang Anda ketik di Langkah 2 (di sini)
client_invoicesPanel ini hanya dapat dibaca. - Skema (kanan). Kosong secara default. Setiap Skema adalah satu varian dokumen. Klik + Klik tombol di pojok kanan atas untuk menambahkan Skema pertama.
- Simpan Perubahan (kiri atas). akan tetap ada setiap perubahan yang Anda buat di halaman ini.
- Kembali. kembali ke Daftar penganalisis.

Halaman detail. Klasifikasikan Informasi Di sebelah kiri terdapat ID Analyzer. Klik tombol + berwarna biru untuk menambahkan Skema.
Langkah 4: Isi Nama Klasifikasi, Petunjuk, dan Skema Dokumen
Setiap Skema merupakan satu varian dokumen yang harus ditangani oleh Analyzer. Setiap Skema memiliki tiga input yang wajib diisi dan baris pengisian cepat yang sudah dikenal di bagian bawah.
Kolom skema (wajib diisi)
| Bidang | Tujuan | Contoh |
|---|---|---|
| Classification Name | The label returned by the API when this Schema matches. Use a short, business-friendly name. | Client ABC |
| Classification Prompt | Natural-language description of how to recognise this variant. Mention company name, email, layout cues, distinguishing phrases. This is what the AI uses to route. | The invoice has the company name ABC at the top, followed by the contact email [email protected]. |
| Document Schema | JSON object with a description and a fields array. Each field has fieldName, fieldType, and fieldDescription, plus an optional fieldMethod such as generate for derived values. | { "description": "Extract invoice detail for ABC invoices", "fields": [ ... ] } |
Contoh Skema: Klien ABC

Skema Pertama. Nama Klasifikasi, Petunjuk Klasifikasi, dan Skema Dokumen bersama-sama menjelaskan satu varian dokumen.
{
"description": "Extract invoice detail for ABC invoices",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldMethod": "generate",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4-digit year not found then consider 2-digit year at the end of extracted date."
}
]
}
Perintah Klasifikasi untuk Klien ABC adalah petunjuk bahasa alami yang mengarahkan AI ke Skema ini:
"Faktur tersebut memuat nama perusahaan ABC di bagian atas, diikuti oleh alamat email kontak."
[email protected]."
Langkah 5: Tambahkan Skema Lainnya dan Simpan Perubahan
Klik yang berwarna biru + Tekan tombol lagi untuk menambahkan Skema untuk varian berikutnya. Setiap Skema baru mendapatkan Nama Klasifikasi, Petunjuk Klasifikasi, dan Skema Dokumennya sendiri. Kolom-kolomnya dapat berbeda sepenuhnya antar Skema. Klien ABC mungkin tidak memiliki kolom referensi pelanggan sementara Klien XYZ memilikinya.
Contoh Skema kedua: Klien XYZ

Skema kedua untuk Analyzer yang sama. Kedua skema tersebut sekarang berada di bawah [lokasi yang sama]. faktur_klien.
{
"description": "Extract Invoice data from company XYZ's Invoice",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldMethod": "generate",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4-digit year not found then consider 2-digit year at the end of extracted date."
}
]
}
Daftar Skema akan tertutup setelah Anda Menyimpan
Setelah kedua Skema dimasukkan, daftar akan menampilkan masing-masing sebagai kartu yang dapat dilipat dengan Nama Klasifikasi di sebelah kiri dan tanda panah untuk memperluas di sebelah kanan. Klik kartu untuk mengeditnya lagi nanti.

Kedua skema telah tersimpan. Klik kartu mana pun untuk memperluas dan mengedit; gunakan tanda + untuk menambahkan varian lainnya.
Klik Simpan Perubahan Di pojok kiri atas, Anda dapat menyimpan setiap Skema yang telah Anda tambahkan. Analyzer kini aktif dan siap menerima data. PDFs.
Opsi tingkat bidang di dalam Skema Dokumen
| Atribut | Diperlukan? | Apa fungsinya? |
|---|---|---|
fieldName | Required | The name of the field and how it will appear in the response JSON. |
fieldType | Required | The type of data to extract. One of string, number, date, or table. |
fieldDescription | Required | Natural-language description of what needs to be extracted and where to find it. Include alternate labels and example formats so the AI matches correctly. |
fieldMethod | Optional (default extract) | How the AI fills the value. extract takes the value verbatim from the document. generate tells the AI to derive or normalise it (useful for dates, computed totals, or cleaned-up IDs). Omit for default extract behaviour. |
fields | Required when fieldType is table | Nested array describing the columns of the table. Each entry takes the same attributes as a top-level field (fieldName, fieldType, fieldDescription, fieldMethod). Cannot itself be table. |
Skema dengan kolom tabel (baris bersarang)
Menggunakan fieldType: "table" Ketika sebuah Skema perlu mengekstrak baris yang berulang seperti item baris faktur. Setiap kolom tabel memiliki kolom bersarangnya sendiri. ladang array yang menjelaskan kolom-kolom tersebut.
{
"description": "Invoice data extractor",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4 digit year not found then consider 2 digit year at the end of extracted date.",
"fieldMethod": "generate"
},
{
"fieldName": "lineItems",
"fieldType": "table",
"fieldDescription": "All product / service rows from the invoice table. Be careful, sometimes a row can be part of the next item like when description goes over one line, but it's of a single item.",
"fields": [
{
"fieldName": "itemNumber",
"fieldType": "string",
"fieldDescription": "Product number, product id number or product code"
},
{
"fieldName": "hsnCode",
"fieldType": "string",
"fieldDescription": "HSN / SAC code (4 to 8 digit)"
}
]
}
]
}
Tombol pengisian cepat (gunakan sebagai titik awal)
Editor Skema menawarkan Faktur Dan Pesanan Pembelian tombol preset di bagian bawah kartu Skema Dokumen. Gunakanlah sebagai titik awal. Hanya itu. Klik salah satu untuk mengisi skema tipikal untuk keluarga dokumen tersebut, lalu sesuaikan nama bidang, tipe, metode, dan deskripsi agar sesuai dengan varian spesifik yang Anda konfigurasi. Preset tersebut hanyalah kerangka, bukan bentuk akhir.
Gunakan Penganalisis Klasifikasi di API atau panggilan otomatisasi
Setelah disimpan, ID Analyzer yang sama dapat dijalankan di mana saja melalui referensi. Anda tidak perlu membuat ulang Skema di setiap platform.
| Bidang | Sumber | Tujuan |
|---|---|---|
AnalyzerId | String yang Anda ketik di Langkah 2 (client_invoices) | Pengidentifikasi stabil untuk Classify Analyzer. |
docName | Sumber PDF nama file | Digunakan untuk pelacakan dan pesan kesalahan. |
docContent | Sumber PDF dikodekan sebagai Base64 | Dokumen yang akan diklasifikasikan dan diekstrak. |
async | false untuk sinkron, true untuk jajak pendapat | Mengontrol penyampaian respons. |
Contoh REST Isi permintaan:
{
"docName": "incoming_invoice.pdf",
"docContent": "BASE64_ENCODED_PDF_CONTENT",
"AnalyzerId": "client_invoices",
"async": false
}
Respons tersebut membawa Nama Klasifikasi yang cocok ditambah bidang-bidang yang didefinisikan dalam Skema Dokumen Skema tersebut. Dokumen yang dikenali sebagai Klien ABC mengembalikan bidang-bidang Klien ABC; dokumen yang dikenali sebagai Klien XYZ mengembalikan bidang-bidang Klien XYZ. Satu panggilan, kedua keputusan.
Alur kerja umum
Pola Penganalisis Klasifikasi KhasHow a Classify Analyzer with multiple Schemas runs in production.
- Faktur vendor dari Klien ABC, Klien XYZ, dan beberapa lainnya tiba di satu kotak surat.
- Make, Zapier, Power Automate, atau n8n memanggil AI Parser dengan
ID Penganalisis: faktur_klien. - Respons tersebut berisi Nama Klasifikasi (Klien ABC, Klien XYZ, dll.) dan bidang-bidang yang diekstrak.
- Langkah peralihan mengarahkan setiap hasil ke yang sesuai. ERP Catatan pelanggan menggunakan Nama Klasifikasi; kolom yang diekstrak langsung mengisi catatan faktur.
- Vendor baru mengirimkan faktur dengan tata letak yang berbeda untuk pertama kalinya.
- Operasi membuka yang sudah ada
faktur_klienAnalisis di dasbor dan klik +. - Skema baru ditambahkan dengan Nama Klasifikasi (nama vendor), Petunjuk Klasifikasi yang menjelaskan tata letak, dan Skema Dokumen untuk bidang-bidang yang penting.
- Panggilan masuk berikutnya PDF Dialihkan ke Skema baru secara otomatis. Tidak diperlukan pengkabelan ulang otomatisasi.
- One Analyzer mencakup faktur, pesanan pembelian, dan nota kredit.
- Setiap Petunjuk Klasifikasi Skema menjelaskan penanda pembeda ("berisi Tagihan Kepada dan total yang harus dibayar" vs. "berisi nomor PO dan alamat Pengiriman").
- Skema Dokumen per Skema mengekstrak bidang-bidang yang relevan dengan tipe dokumen tersebut.
- Cabang perutean hilir berdasarkan Nama Klasifikasi; setiap cabang menulis ke sistem yang sesuai.
Praktik terbaik skema untuk Klasifikasi
- Satu Skema untuk setiap varian dokumen yang stabil. Dua vendor dengan tata letak yang sangat berbeda seharusnya menggunakan dua Skema, bukan satu dengan aturan yang tumpang tindih.
- Prompt Klasifikasi adalah aturan pengarahan Anda. Tulis dalam bahasa Inggris yang sederhana dan sertakan penanda konkret (nama perusahaan, email, frasa khas, petunjuk tata letak).
- Gunakan Nama Klasifikasi yang singkat, mudah dipahami oleh kalangan bisnis, dan stabil. Nama inilah yang menjadi acuan percabangan perutean hilir Anda.
- Gunakan tombol pengisian cepat Faktur dan Pesanan Pembelian sebagai titik awal, lalu perketat deskripsi kolom untuk setiap varian.
- Menambahkan
fieldMethod: "generate"pada tanggal, total yang dihitung, atau kolom di mana AI harus menormalkan nilainya alih-alih menyalinnya apa adanya. - Uji setiap Skema terhadap sampel nyata sebelum ditayangkan: faktur Klien ABC yang jelas harus selalu diarahkan ke Skema Klien ABC, bukan Klien XYZ.
- Klik Simpan Perubahan Setelah setiap putaran pengeditan; Skema yang belum disimpan akan hilang saat navigasi.