Ana içeriğe geç

Classify kullanan yapay zeka destekli belge ayrıştırıcı

Bu kılavuz neleri kapsıyor?

Yapay Zeka Belge Ayrıştırıcısı. Sınıflandır Bu, tek bir analiz aracının tek bir çağrıda birden fazla belge varyantını işlemesine olanak tanır. Bir analiz aracı tanımlarsınız. Analizör Kimliğisonra bir tane ekleyin Varyant başına diyagram (Müşteri ABC, Müşteri XYZ, genel fatura, genel satın alma siparişi). Her şema bir Sınıflandırma Adı, A Sınıflandırma İstemi doğal dilde ve bir Belge Şeması Çıkarılacak alanları tanımlar. Çalışma zamanında yapay zeka gelen verilerle eşleştirme yapar. PDF Her şemanın Sınıflandırma İstemine karşı en uygun olanı seçer ve hem eşleşen Sınıflandırma Adını hem de çıkarılan alanları döndürür. Aynı Analizci Kimliği, REST API ve desteklenen tüm otomasyon platformları.

İlgili Blog Yazıları(4)
Make'te Herhangi Bir PDF Dosyasını Yapay Zeka Destekli Olarak Çıkarın ve Akıllıca Yeniden Adlandırın: PDF4me Yapay Zeka ile 4 Modüllü Dropbox İş Akışı - Belge Ayrıştırıcı
Dört modüllü Make senaryosu: Dropbox'tan bir tedarikçi PDF'ini çekin, varsayılan fatura çıkarma işlemiyle AI - Document Parser'ı çalıştırın, JSON'u ayrıştırarak vendorName'i ortaya çıkarın, ardından dosya adı olarak vendorName.pdf ile yeniden yükleyin. Gerçek ekran görüntüleri, tam alan değerleri, manuel veri girişi yok.
Yazıyı oku
Zapier'da Tedarikçi Faturalarını Yapay Zeka ile Yeniden Adlandırma: 5 Adımlı Dropbox + PDF4me İş Akışı
Beş Adımlı Zap: Dropbox Klasöründe Yeni Dosya Oluştur → Dropbox Dosya Bul → PDF4me Yapay Zeka - Belge Ayrıştırıcı → Zapier Tarafından Yazılmış Kod, JavaScript Çalıştır → Dropbox Dosya Yükle. Yapay zeka ile müşteri adını çıkarır ve çıktı dosya adı olarak kullanır. Gerçek ekran görüntüleri, tam alan değerleri, 2 satırlık JSON.parse'dan öte kod yok.
Yazıyı oku
Zapier'da Her Tedarikçi Faturasını Tedarikçi Adına Göre Yeniden Adlandırma: 5 Adımlı Dropbox + PDF4me Yapay Zeka İş Akışı
Muhasebe ekipleri için beş adımlı Zap çözümü. Dropbox fatura giriş klasörünüzü izler, PDF4me AI - Belge Ayrıştırıcı her PDF dosyasından Tedarikçi Adını çıkarır, Zapier tarafından geliştirilen kod ayrıştırıcı çıktısını eşlenebilir belirteçlere dönüştürür ve Dropbox dosyayı tedarikçi adıyla dosya adı olarak geri yükler. Gerçek ekran görüntüleri, tam alan değerleri, bu kılavuzda kullanılan örnek-tedarikçi-faturası.pdf dosyası indirilebilir.
Yazıyı oku

Kurulumunuzun Kimlik Doğrulaması

Sınıflandırma Analizörleri şu şekilde oluşturulur: PDF4me Geliştirici paneli. Hesabınızla giriş yapın, ardından bir geliştirici paneli oluşturun veya kopyalayın. API Yapay Zeka Ayrıştırıcısı için anahtar API Burada oluşturduğunuz Analizleyiciye referans veren çağrılar.

Bu kılavuzda kullanacağınız kontrol paneli URL’leri:

Kaçırmamanız Gereken Önemli Bilgiler

Tek bir analizleyici, birçok şema (her varyant için bir tane)
Classify, gerçek dünyada ABC müşterisinin faturalarının XYZ müşterisinin faturalarından farklı görünmesi durumuna göre tasarlanmıştır. Varyant sayınız kadar şema ekleyebilirsiniz. Her şema, kendi içinde bağımsız bir Sınıflandırma Adı + İstemi + Belge Şeması paketidir.
Sınıflandırma İstemi, yönlendirme beynidir.
Açık ve anlaşılır bir dille yazın. Şirket adını en üstte, iletişim e-postasını, sayfa düzeni ipuçlarını, yalnızca bu varyantta kullanılan kelimeleri gibi somut işaretlerden bahsedin. Talimat ne kadar net olursa, yönlendirme o kadar sorunsuz olur.
Sınıflandırma hem etiketi hem de veriyi döndürür.
Saf bir sınıflandırıcıdan farklı olarak, yanıt eşleşen Sınıflandırma Adını da içerir. Ve Bu şemanın belge şemasındaki tüm alanlar. Tek bir çağrı size yönlendirme kararını ve çıkarılan verileri verir. JSON birlikte.

Adım 1: Kontrol panelinde AI Document Parser'ı açın.

  1. Giriş yap dev.pdf4me.com.
  2. Kontrol panelinin kenar çubuğundan tıklayın. Yapay Zeka Belge Ayrıştırıcısı.
  3. Liste sayfası, mevcut tüm Analizcileri üç sütun halinde gösterir: Analizör Kimliği, Analizör Tipi (Ayrıştırma veya Sınıflandırma) ve Eylemler.
  4. Maviye tıklayın + Ekle Yeni bir analiz aracı başlatmak için düğmeye tıklayın.
PDF4me Yapay Zeka Belge Ayrıştırıcı kontrol paneli liste görünümü; kenar çubuğundaki Yapay Zeka Belge Ayrıştırıcı öğesi kırmızı renkle vurgulanmış, ana panelin üst kısmında mavi bir Ekle düğmesi ve sütun başlıkları olarak Analizör Kimliği, Analizör Türü ve İşlemler bulunan boş bir tablo yer almaktadır.

Yapay Zeka Belge Ayrıştırıcısı liste görünümü. Yeni bir Analizleyici başlatmak için + Ekle'ye tıklayın.

Adım 2: Bir Sınıflandırma Analizcisi Oluşturun

Üç kontrol düğmesi içeren yeni bir satır belirir:

  1. Analizör Kimliği girişiHatırlayacağınız herhangi bir açık tanımlayıcı yazın, örneğin client_invoices, Vendor Documents, veya incoming-ordersİsimlendirme biçimi konusunda herhangi bir kısıtlama yoktur. snake_case, camelCase, kebab-case, boşluklu düz kelimeler, hepsi aynı şekilde çalışır. Aşağıdaki örnekte kullanılmıştır. client_invoices.
  2. Analizör Türü açılır menüsü. seçmek Sınıflandırmak (bu kılavuz) veya Ayrıştırma (bakınız) Ayrıştırma kılavuzu).
  3. Kaydet / İptal Butonlar. Kaydet, Analiz aracını oluşturur; İptal ise satırı siler.
PDF4me AI Belge Ayrıştırıcısı, "Analizör Kimliği" alanı "client_invoices" ile doldurulmuş, "Analizör Türü" açılır menüsünde "Sınıflandır" seçeneği "Ayrıştır"ın üzerinde vurgulanmış ve satırda bir "Sınıflandır" değeri seçilmiş, sağda "Kaydet" ve "İptal" düğmeleri bulunan bir satır ekle penceresi açar.

Satır ekle: Analizör Kimliğini girin (buraya) müşteri_faturaları), seçmek SınıflandırmakArdından kaydedin.

3. Adım: Analiz aracını açın ve ilk şemayı ekleyin.

Detay sayfasını açmak için yeni satıra tıklayın. URL kalıbı şu şekildedir:

https://dev.pdf4me.com/ai-document-parser/?id=<your-analyzer-guid>

Kontrol paneli, ilk kez açıldığında her Analizci için bir GUID verir. Bir sonraki sefer aynı Sınıflandırma Analizcisine doğrudan geri dönmek için bu URL'yi yer imlerinize ekleyin.

Detay sayfasında şunlar gösterilmektedir:

  • Sınıflandırma Bilgileri (solda). 2. adımda girdiğiniz Analizör Kimliğini gösterir (burada) client_invoicesBu panel salt okunurdur.
  • Şemalar (sağda). Varsayılan olarak boştur. Her şema bir belge varyantıdır. Tıklayın + Sağ üst köşedeki düğmeye tıklayarak ilk şemayı ekleyin.
  • Değişiklikleri Kaydet (sol üstte). Bu sayfada yaptığınız her düzenleme kalıcı olur.
  • Geri. geri döner Analizci listesi.
PDF4me AI Belge Ayrıştırıcısı'nın Sınıflandırma Analizcisi detay sayfası. Mavi ana başlıkta "AI Belge Ayrıştırıcısı" yazısı ve "Hızlı, doğru ve yapılandırılmış çıktı ile yapay zeka kullanarak fatura verilerini otomatik olarak ayıklayın" alt başlığı yer alıyor. Altında bir Geri düğmesi ve mavi bir Değişiklikleri Kaydet düğmesi bulunuyor. Soldaki Sınıflandırma Bilgileri paneli, Analizci Kimliği olarak client_invoices'ı gösteriyor. Sağdaki Şemalar bölümü boş olup, en sağda yeni bir Şema eklemek için mavi bir artı düğmesi bulunuyor.

Detay sayfası. Sınıflandırma Bilgileri Soldaki kısımda Analizör Kimliği bulunur. Şema eklemek için mavi + düğmesine tıklayın.

Adım 4: Sınıflandırma Adını, İstemi ve Belge Şemasını Doldurun

Her şema, analiz aracının ele alması gereken bir belge varyantıdır. Her şemanın üç zorunlu girişi ve altta tanıdık bir hızlı doldurma satırı vardır.

Şema alanları (zorunlu)

AlanAmaçÖrnek
Classification NameThe label returned by the API when this Schema matches. Use a short, business-friendly name.Client ABC
Classification PromptNatural-language description of how to recognise this variant. Mention company name, email, layout cues, distinguishing phrases. This is what the AI uses to route.The invoice has the company name ABC at the top, followed by the contact email [email protected].
Document SchemaJSON object with a description and a fields array. Each field has fieldName, fieldType, and fieldDescription, plus an optional fieldMethod such as generate for derived values.{ "description": "Extract invoice detail for ABC invoices", "fields": [ ... ] }

Örnek Şema: İstemci ABC

PDF4me AI Belge Ayrıştırıcısı Sınıflandırma Şeması düzenleyicisi, "Müşteri ABC" başlıklı ilk Şemayı göstermektedir. Soldaki Sınıflandırma Bilgisi paneli, Analizör Kimliği olan client_invoices'ı içermektedir. Şema kartında silmek için kırmızı bir çöp kutusu simgesi, "Sınıflandırma Adı" alanında "Müşteri ABC" değeri, "Sınıflandırma İstemi" alanında "Fatura adı en üstte ABC şirketinin adını içerecek ve ardından abc.com adresindeki müşteri faturaları için e-posta adresi en üstte yer alacaktır" metni ve "ABC faturaları için fatura detaylarını çıkar" açıklaması ve invoiceNumber (Fatura numarası, fatura numarası, makbuz numarası) ve invoiceDate (oluşturma tarihi) ile başlayan bir alan dizisi gösteren bir Belge Şeması JSON düzenleyicisi bulunmaktadır. Düzenleyicinin altında Fatura ve Satın Alma Siparişi hızlı doldurma düğmeleri yer almaktadır.

Birinci Şema. Sınıflandırma Adı, Sınıflandırma İstemi ve Belge Şeması birlikte bir belge varyantını tanımlar.

Client ABC. Document Schema
{
"description": "Extract invoice detail for ABC invoices",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldMethod": "generate",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4-digit year not found then consider 2-digit year at the end of extracted date."
}
]
}

Müşteri ABC için Sınıflandırma İstemi, yapay zekanın bu Şemaya ulaşmasını sağlayan doğal dil ipucudur:

Faturanın en üstünde ABC şirket adı, ardından iletişim e-posta adresi yer almaktadır. [email protected]"

Adım 5: Daha fazla şema ekleyin ve değişiklikleri kaydedin.

Maviye tıklayın + Sonraki varyant için bir Şema eklemek üzere düğmeye tekrar tıklayın. Her yeni Şema kendi Sınıflandırma Adı, Sınıflandırma İstemi ve Belge Şemasına sahip olur. Alanlar Şemalar arasında tamamen farklı olabilir. Örneğin, ABC müşterisinin müşteri referans sütunu olmayabilirken, XYZ müşterisinin olabilir.

İkinci şema örneği: Müşteri XYZ

PDF4me AI Belge Ayrıştırıcısı, "Müşteri XYZ" başlıklı ikinci Şema kartını sınıflandırıyor. Sınıflandırma Adı: Müşteri XYZ, Sınıflandırma İstemi: Belge, en üstte XYZ şirketinin adını, ardından support@xyz.com e-posta adresini ve adresi içeren bir faturadır. Ayrıca, "XYZ şirketinin faturasından fatura verilerini, invoiceNumber ve invoiceDate ile başlayan bir alan dizisiyle çıkarın" açıklamasını gösteren bir Belge Şeması JSON düzenleyicisi de bulunmaktadır. Düzenleyicinin altında Fatura ve Satın Alma Siparişi hızlı doldurma düğmeleri yer almaktadır.

Aynı analizleyici için ikinci şema. Her iki şema da artık şu anda aynı yerde bulunuyor. müşteri_faturaları.

Client XYZ. Document Schema
{
"description": "Extract Invoice data from company XYZ's Invoice",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldMethod": "generate",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4-digit year not found then consider 2-digit year at the end of extracted date."
}
]
}

Kaydetme işleminden sonra Şemalar listesi daralır.

Her iki şema da eklendikten sonra, listede her biri sol tarafta Sınıflandırma Adı ve sağ tarafta genişletmek için bir ok işareti bulunan, açılıp kapanabilen bir kart olarak gösterilir. Daha sonra tekrar düzenlemek için bir karta tıklayın.

PDF4me AI Belge Ayrıştırıcısı'nın, daraltılmış liste görünümünde her iki şemayı da gösteren bir Sınıflandırma Analizcisi detay sayfası. Soldaki Sınıflandırma Bilgisi paneli, Analizci Kimliği client_invoices'ı gösteriyor. Sağdaki Şemalar bölümü, ok şeklinde genişletme düğmeleri bulunan iki daraltılmış akordeon kart olarak Müşteri ABC ve Müşteri XYZ'yi listeliyor. Daha fazla şema eklemek için sağ üst köşede mavi bir artı düğmesi bulunuyor.

Her iki şema da kaydedildi. Genişletmek ve düzenlemek için herhangi bir karta tıklayın; daha fazla varyant eklemek için + işaretini kullanın.

Tıklamak Değişiklikleri Kaydet Eklediğiniz her şemayı kalıcı hale getirmek için sol üst köşeyi seçin. Analiz aracı artık aktif ve veri almaya hazır. PDFs.

Belge Şeması içindeki Alan düzeyindeki seçenekler

BağlanmakGerekli?Ne işe yarar?
fieldNameRequiredThe name of the field and how it will appear in the response JSON.
fieldTypeRequiredThe type of data to extract. One of string, number, date, or table.
fieldDescriptionRequiredNatural-language description of what needs to be extracted and where to find it. Include alternate labels and example formats so the AI matches correctly.
fieldMethodOptional (default extract)How the AI fills the value. extract takes the value verbatim from the document. generate tells the AI to derive or normalise it (useful for dates, computed totals, or cleaned-up IDs). Omit for default extract behaviour.
fieldsRequired when fieldType is tableNested array describing the columns of the table. Each entry takes the same attributes as a top-level field (fieldName, fieldType, fieldDescription, fieldMethod). Cannot itself be table.

Tablo alanı içeren şema (iç içe satırlar)

Kullanmak AlanTürü: "tablo" Bir şemanın fatura kalemleri gibi tekrarlanan satırları ayıklaması gerektiğinde, her tablo alanı kendi iç içe geçmiş yapısını taşır. alanlar Sütunları tanımlayan dizi.

{
"description": "Invoice data extractor",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4 digit year not found then consider 2 digit year at the end of extracted date.",
"fieldMethod": "generate"
},
{
"fieldName": "lineItems",
"fieldType": "table",
"fieldDescription": "All product / service rows from the invoice table. Be careful, sometimes a row can be part of the next item like when description goes over one line, but it's of a single item.",
"fields": [
{
"fieldName": "itemNumber",
"fieldType": "string",
"fieldDescription": "Product number, product id number or product code"
},
{
"fieldName": "hsnCode",
"fieldType": "string",
"fieldDescription": "HSN / SAC code (4 to 8 digit)"
}
]
}
]
}

Hızlı doldurma düğmeleri (başlangıç noktası olarak kullanın)

Şema düzenleyici şunları sunar: Fatura Ve Satın alma emri Belge Şeması kartının altındaki önceden ayarlanmış düğmeler. Bunları başlangıç noktası olarak kullanın. Yalnızca birini tıklayarak ilgili belge ailesi için tipik bir şema oluşturun, ardından yapılandırdığınız belirli varyanta uyacak şekilde alan adlarını, türlerini, yöntemlerini ve açıklamalarını değiştirin. Ön ayarlar iskelettir, nihai şekil değildir.

Sınıflandırma Analiz Aracını kullanın. API veya otomasyon çağrıları

Kaydedildikten sonra, aynı Analiz Kimliği referans yoluyla her yerde çalışır. Her platformda şemaları yeniden oluşturmanıza gerek yoktur.

AlanKaynakAmaç
AnalyzerId2. adımda yazdığınız metin (client_invoices)Sınıflandırma Analizcisi için kararlı tanımlayıcı.
docNameKaynak PDF dosya adıTakip ve hata mesajları için kullanılır.
docContentKaynak PDF kodlanmış olarak Base64Sınıflandırılacak ve içinden veri çıkarılacak belge.
asyncfalse senkron için, true anket içinYanıt iletimini kontrol eder.

Örnek REST İstek gövdesi:

{
"docName": "incoming_invoice.pdf",
"docContent": "BASE64_ENCODED_PDF_CONTENT",
"AnalyzerId": "client_invoices",
"async": false
}

Yanıt, eşleşen Sınıflandırma Adını ve o Şemanın Belge Şemasında tanımlanan alanları içerir. Müşteri ABC olarak tanınan bir belge, Müşteri ABC alanlarını döndürür; Müşteri XYZ olarak tanınan bir belge, Müşteri XYZ alanlarını döndürür. Tek çağrı, her iki karar da.

Ortak iş akışları

Tipik Sınıflandırma Analizcisi kalıplarıHow a Classify Analyzer with multiple Schemas runs in production.
Çoklu istemci AP gelen kutusu
  1. ABC müşterisinden, XYZ müşterisinden ve diğer birkaç müşteriden gelen tedarikçi faturaları tek bir posta kutusuna geliyor.
  2. Make, Zapier, Power Automate, veya n8n AI Parser'ı şu şekilde çağırır: AnalyzerId: client_invoices.
  3. Yanıt, Sınıflandırma Adını (Müşteri ABC, Müşteri XYZ, vb.) ve çıkarılan alanları içerir.
  4. Bir geçiş adımı, her sonucu eşleşen sonuca yönlendirir. ERP Sınıflandırma Adı kullanılarak müşteri kaydı oluşturulur; çıkarılan alanlar doğrudan fatura kaydını doldurur.
Yeniden yapılandırma gerektirmeyen tedarikçi entegrasyonu
  1. Yeni bir tedarikçi ilk kez farklı bir düzene sahip bir fatura gönderiyor.
  2. Operasyonlar mevcut olanı açar müşteri_faturaları Kontrol panelindeki Analiz aracına tıklayın. +.
  3. Yeni bir Şema eklenir; bu şemaya bir Sınıflandırma Adı (tedarikçinin adı), düzeni açıklayan bir Sınıflandırma İstemi ve önemli alanlar için bir Belge Şeması eklenir.
  4. Bir sonraki gelen PDF Yeni şemaya otomatik olarak yönlendirilir. Otomasyon yeniden yapılandırmasına gerek yoktur.
Karma belge önceliklendirmesi
  1. Tek bir analiz aracı faturaları, satın alma siparişlerini ve kredi notlarını kapsar.
  2. Her şemanın sınıflandırma istemi, ayırt edici işaretleri ("içerir") tanımlar. Ya fatura edilecek ve ödenecek toplam tutar" ile "sipariş numarası ve teslimat adresi içerir" arasındaki fark.
  3. "Document Schema per Schema" ifadesi, ilgili belge türüyle alakalı alanları çıkarır.
  4. Sınıflandırma Adına göre aşağı yönlü yönlendirme dalları oluşur; her dal eşleşen sisteme yazar.

Sınıflandırma için şema en iyi uygulamaları

  • Her kararlı belge varyantı için bir şema. Çok farklı düzenlere sahip iki tedarikçi için, çakışan kurallara sahip tek bir şema değil, iki ayrı şema olmalıdır.
  • Sınıflandırma İstemi, yönlendirme kuralınızdır. Bunu sade bir dille yazın ve somut işaretler ekleyin (şirket adı, e-posta, ayırt edici ifadeler, düzen ipuçları).
  • Sınıflandırma adını kısa, iş dünyasına uygun ve istikrarlı tutun. Bu, sonraki yönlendirme dallarınızın temelini oluşturur.
  • Fatura ve Satın Alma Siparişi hızlı doldurma düğmelerini başlangıç noktası olarak kullanın, ardından her varyant için alan açıklamalarını daraltın.
  • Eklemek fieldMethod: "generate" Yapay zekanın değeri olduğu gibi kopyalamak yerine normalleştirmesi gereken tarihler, hesaplanan toplamlar veya alanlar için.
  • Her şemayı yayına almadan önce gerçek bir örnekle test edin: Açıkça belli olan bir Müşteri ABC faturası her zaman Müşteri XYZ şemasına değil, Müşteri ABC şemasına yönlendirilmelidir.
  • Tıklamak Değişiklikleri Kaydet Her düzenleme turundan sonra; kaydedilmemiş şemalar gezinme sırasında kaybolur.

İlgili işlemler

Parse kullanarak yapay zeka destekli belge ayrıştırıcı
Aynı kontrol paneli, her analizci için tek şema. İşlediğiniz her belge aynı düzen ailesini paylaştığında kullanın.
Yapay Zeka - Belge Ayrıştırıcı Make
Kaydedilmiş Sınıflandırma Analizcisi Kimliğinizi kullanın. Make Senaryo. Yönlendirme ve çıkarma işlemlerini görsel iş akışlarında yaygınlaştırmak için herhangi bir veri kaynağı ve depolama modülüyle eşleştirin.
Yapay Zeka - Belge Ayrıştırıcı Power Automate
Aynı Sınıflandırma Analiz aracını bir yerden çalıştırın. Power Automate akış. Doğal olarak bağlanır SharePoint, Excel, Dataverse, Ve Outlook.
Yapay Zeka - Belge Ayrıştırıcı n8n
Kendi sunucunuzda barındırılan veya bulut tabanlı n8n İş akışları. Yapay Zeka Analizcisi Kimliği açılır menüsü, kaydettiğiniz Analizcileri doğrudan hesabınızdan yükler.
Yapay Zeka - Belge Ayrıştırıcı Zapier
6.000'den fazla kaynaktan herhangi birinden yapay zeka çıkarımını tetikleyin. SaaS Uygulamalar ve web kancaları. Kaydedilmiş Sınıflandırma Analizcisi Kimliğinizi Yapay Zeka Analizcisi Adı alanına yazın.

Sıkça Sorulan Sorular

How is Classify different from Parse in AI Document Parser?+
Parse holds a single Document Schema and returns its extracted fields. Classify holds multiple Schemas, one per document variant, each with its own Classification Prompt and Document Schema. At runtime the AI picks the best-matching Schema and returns its fields plus the Classification Name. Use Classify when one Analyzer must handle several layouts.
What is the Classification Prompt?+
A natural-language description of the markers that identify this document variant. Mention the company name printed at the top, the contact email, layout cues, anything distinctive. The AI compares every Schema Classification Prompt against the incoming PDF to pick the best match.
Can each Schema have different fields?+
Yes. Each Schema has its own Document Schema, so Client ABC can extract invoiceNumber and invoiceDate while Client XYZ extracts invoiceNumber, customerRef, and PONumber. The response contains exactly the fields defined in the matched Schema.
What does fieldMethod: generate do?+
Inside a Document Schema, fieldMethod controls how the AI fills the value. generate tells the AI to derive or normalize the value rather than copy a substring verbatim. Useful for dates (normalize multiple formats), totals (compute or normalize), and identifiers that may need cleanup. Omit fieldMethod for straight extraction.
How many Schemas can I add to one Analyzer?+
No hard cap published. In practice, 5 to 20 well-described Schemas per Analyzer perform best. If you need dozens, group similar variants under broader Classification Names and let the Document Schema handle the small differences.
Does the Analyzer Id change after Save Changes?+
No. The Analyzer Id is the string you typed in the Add row in Step 2 (for example client_invoices). It stays stable across edits and is the value every API call and automation module uses.
Do I need to upload a sample PDF when setting up the Analyzer?+
No. The AI Analyzer does not need a sample for setup. You describe each variant in natural language via the Classification Prompt; the AI engine applies the prompts to whatever document you send at runtime.
What happens if the incoming PDF does not match any Schema confidently?+
The AI still returns its best guess. To handle ambiguous cases, add a catch-all Schema with a generic Classification Prompt and a minimal Document Schema, or route low-confidence responses to a manual review queue in your automation.

Yardım Alın