Ana içeriğe geç

Yapay Zeka - Belge Ayrıştırıcı n8n

Bu düğüm ne işe yarıyor?

PDF4me Yapay Zeka Belge Ayrıştırıcısı Kaydedilmiş bir işlemi çalıştırarak herhangi bir belgeden yapılandırılmış verileri çıkarır. AI Analizör sizden PDF4me Dosyaya karşı hesap. Sabit ayrıştırıcılardan (AI-Fatura Ayrıştırıcı, AI-Süreç Sözleşmesi) farklı olarak, siz seçersiniz. AI Analizör Kimliği yapılandırılmış analizörlerin açılır menüsünden PDF4me Kontrol paneli sayesinde aynı düğüm faturaları, satın alma siparişlerini, makbuzları, özel formları, laboratuvar raporlarını, dahili şablonları ve şemada tanımladığınız her şeyi işleyebilir. Bir Ayrıştırma Tek bir şema veya bir şema için analiz aracı Sınıflandırmak Tek bir çağrıda birden fazla belge varyantını analiz eden araç. Dinamik sonuçlar döndürür. JSON şemanıza artı bir anahtarla bağlanmış _meta veriler Blok, ikili dosya yok.

İlgili Blog Yazıları
Bu özellik için henüz bir blog yazısı yok — yakında yayınlanacak.
Bu arada, her platforma yönelik eğitimler ve iş akışları için PDF4me bloguna göz atın.
Blogu ziyaret edin

Test için Örnek Fatura

İş akışınızı canlı verilere yönlendirmeden önce düğümün uçtan uca çalıştığını doğrulamak için bu örnek tedarikçi faturasını kullanın. Bunu ikili giriş olarak eşleştirin ve seçin. default_invoice_extraction olarak AI Analizör Kimliği.

Kimliğinizi Doğrulama API Rica etmek

Her PDF4me düğümde n8n geçerli bir belge gerektirir Bağlantı kurmak için kimlik bilgisi. İçeriğinizi barındıran birini oluşturun veya seçin. PDF4me API iş akışının kimlik doğrulaması yapabilmesi için anahtar. AI Veri çıkarma isteklerini güvenli bir şekilde işler. Aynı kimlik bilgisi ayrıca şunları da destekler: AI Analizör Kimliği GetAnalyzerId aracılığıyla açılır menü API.

Öncelikle analiz cihazınızı kurun.

Bu kılavuzda kullanacağınız kontrol paneli URL’leri:
Öncelikle Analizörünüzü oluşturun (her platform için zorunludur)
AI - Belge Ayrıştırıcı, PDF4me geliştirici panosundan kaydedilmiş bir Analizleyiciyi çalıştırır. Tek bir belge şeması için "Parse" seçeneğini veya tek bir çağrıda birçok varyantı (Müşteri ABC, Müşteri XYZ, genel fatura) yönlendirmek için "Classify" seçeneğini seçin. Aynı Analiz Aracı Kimliği, Make, Zapier, Power Automate, n8n ve REST API'de çalışır.

Kaçırmamanız Gereken Önemli Bilgiler

Analiz aracını kontrol panelinde kurarsınız, düğüm yalnızca ona referans verir.
Şemayı, alanları ve istemleri bir kez tanımlayın. Analizci listesi Ve Analiz detayları Sayfalar (Tek bir şema için ayrıştırma, birçok varyant için sınıflandırma). n8n Düğüm, analizörlerinizi yükler. AI Analizör Kimliği Açılır menüden hangisini seçerseniz seçin, o çalışır. Şemayı daha sonra düzenlemek iş akışına dokunmayı gerektirmez.
Çıktı dinamiktir. JSONikili dosya yok
Üst düzey anahtarlar, Analizleyici üzerinde tanımladığınız alan adlarıyla (dize, sayı, tarih veya tablo satırları) eşleşir. _meta veriler Nesneye her zaman başarı, mesaj, zaman damgası, kaynak dosya adı, analizör kimliği ve işlem eklenir. Başka bir şey yok. Çıktı İkili Alan Adı.
Ayrıştırma ve Sınıflandırma işlemi, düğüm tarafından değil, Analizleyici tarafından belirlenir.
Aynı düğüm, iki analizör modu. A Ayrıştırma Analizleyici, tek şemasındaki alanları döndürür. A Sınıflandırmak Analiz aracı, belgeyi en iyi eşleşen şemaya yönlendirir ve sınıflandırma adını döndürür. artı Eşleşen şemanın çıkarılan alanları. Kimliği değiştirerek davranışı değiştirin.
AI Document Parser n8n düğümü, Credential Pdf4me, Resource Extract, Extract Operations AI Document Parser, Input Data Type Binary Data, Input Binary Field data, Document Name document.pdf ve AI Analyzer Id açılır menüsünü gösteriyor (gerektiği gibi vurgulanmıştır).

Tam düğüm paneli: Çıkar → AI İkili veri girişiyle çalışan belge ayrıştırıcı. Birini seçin. AI Analizör Kimliği koşmadan önce.

Parametreler

Bu kılavuzda kullanacağınız kontrol paneli URL’leri:

Gereklidir n8n Kullanıcı Arayüzü: Bağlantı kurulacak kimlik bilgisi, Giriş Veri Türü, Belge Adı, AI Analizör Kimliği. Koşullu olarak gerekli alanlar (İkili Giriş Alanı, Base64 Belge İçeriği veya Belge URL'si) yalnızca eşleşen Giriş Veri Türü seçildiğinde görünür. Herhangi bir koşullu alan bulunmamaktadır. Çıktı İkili Alan Adı ve hayır Gelişmiş Seçenekler / Özel Profiller Bu operasyonda.

ParametreGerekliNe işe yarar?Örnek
Input Data TypeYesHow the document is supplied. Binary Data reads from a previous node (default, most common). Base64 String accepts an encoded document. URL downloads the document from a public link.Binary Data
Input Binary FieldConditionalName of the binary property on the incoming n8n item that holds the document. Required when Input Data Type is Binary Data. Defaults to data. Error reports which property was missing when the name is wrong.data
Base64 Document ContentConditionalBase64-encoded document. Required when Input Data Type is Base64 String. Data-URL style prefixes (text before the comma) are stripped automatically.JVBERi0xLjQK...
Document URLConditionalPublicly reachable HTTPS URL to the document. Required when Input Data Type is URL. Must be a valid full URL.https://example.com/document.pdf
Document NameYesFilename used by PDF4me for processing. Default document.pdf. With Binary Data, the uploaded file name is used for upload but your explicit Document Name value takes precedence in the API call when set. Use a real extension (.pdf, .png, .jpg, etc.) so PDF4me handles the file correctly.document.pdf
AI Analyzer IdYesThe saved Analyzer that controls extraction. Create Analyzers at https://dev.pdf4me.com/dashboard/#/ai-document-parser/ (+ Add), then edit schemas on https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>. Dropdown populated via GetAnalyzerId API. Sent as customisationNote. Pick Parse for one schema or Classify for many variants.aaaa133

Giriş Veri Türü Seçenekleri

Belgenin düğüme nasıl gireceğini seçin. Bu seçime bağlı olarak sonraki alanlar değişir.

n8n PDF4me AI Belge Ayrıştırıcı düğümündeki Giriş Veri Türü açılır menüsünde üç seçenek gösteriliyor: İkili Veri (açıklama ile vurgulanmış): Önceki düğümden belge dosyasını kullan; Base64 Dize (açıklama ile): Belge içeriğini base64 kodlu dize olarak sağla; URL (açıklama ile): Belge dosyasına URL sağla

Giriş Veri Türü. İkili Veri (varsayılan), Base64 Dizisi veya URL.

İkili VeriVarsayılan: önceki düğümden gelen dosya
Belgeyi Google Drive İndirme gibi önceki bir düğümden doğrudan okur. HTTP İstek, İkili Dosya Okuma veya e-posta eki düğümü. Ayarla Giriş İkili Alanı ikili alan adına (varsayılan) veriYüklenen dosya adı, Belge Adı'nı geçersiz kılmadığınız sürece kullanılır.
Base64 DizisiKodlanmış belge satır içi
Base64 dizesini yapıştırın veya eşleştirin. Base64 Belge İçeriği. Veri URL'si stilindeki ön ekler (virgülden önceki metin) otomatik olarak kaldırılır. Belge Adı Doğru uzantı sürücülerinin format algılama özelliğiyle.
URLHerkese açık bağlantıdan indir
Herkese açık bir hizmet sağlayın. HTTPS URL içinde Belge URL'si. PDF4me Belgeyi doğrudan getirir. İşlenecek dosya adı şuradan alınır: URL Mümkünse dosya yolundan veya Belge Adından.

AI Analizör Kimliği açılır menüsü

Açılır menü sizin bilgilerinizden doldurulur. PDF4me hesap üzerinden AnalizörKimliğini Al API Alanı açtığınızda. Her seçenek, kaydettiğiniz bir Analizcidir. PDF4me Kontrol paneli. İşlemekte olduğunuz belge türüyle şeması eşleşen paneli seçin.

n8n PDF4me AI Belge Ayrıştırıcı düğümünde açılan AI Analyzer Id açılır menüsü, üç örnek Analyzer seçeneğini gösteriyor: aaaa133, TestTenantProject, TestTenant

AI Analizör Kimliği açılır menüsü sizden yüklendi. PDF4me hesap.

Ayrıştırma Analizcisi
Tek Belge Şeması. Düğüm, bu şemada tanımlanan alanları tam olarak döndürür. İşlediğiniz her belge aynı düzen ailesini paylaştığında en iyi sonucu verir. Bkz. Parse kurulum kılavuzu şema kuralları dahil AlanTürü: "tablo" iç içe geçmiş satırlar için ve alanYöntemi (Varsayılanı çıkar, türetmek/normalleştirmek için oluştur).
Sınıflandırma Analizcisi
Çok sayıda şema, her belge varyantı için bir tane. AI Gelen belgeyi, her şemanın Sınıflandırma İstemini kullanarak en uygun şemaya yönlendirir ve ardından eşleşen Sınıflandırma Adını ve alanlarını döndürür. Bkz. Sınıflandırma kurulum kılavuzu.

Boş açılır menü mü? Düğüm gösteriyor "GetAnalyzerId hiçbir analiz seçeneği döndürmedi" Hesabınızda analizci olmadığında veya kimlik bilgileri erişilemediğinde API. Açın Analizci listesi ve en az bir Analizleyici ekleyin Analiz detayları sayfayı kontrol edin, ardından doğrulayın. API anahtarınızı girin n8n kimlik belgesi.

Çıkış Alanları

Başarılı bir koşu bir getiri sağlar. n8n öğe ile JSON Yalnızca, ikili dosya yok. Üst düzey anahtarlar, Analizci şemanızla eşleşiyor; a _metadata Nesne her zaman eklenir.

AlanTipİçeriğinde neler var?
Top-level extracted fieldsDynamicOne key per field defined in your Analyzer schema (string, number, date, or nested table rows). Names match fieldName exactly.
_metadata.successBooleantrue on a successful parse.
_metadata.messageString"Document parsed successfully using AI Document Parser".
_metadata.processingTimestampStringISO timestamp of the parse.
_metadata.sourceFileNameStringDocument name used for processing.
_metadata.aiAnalyzerIdStringThe Analyzer Id you selected (sent as customisationNote to the API).
_metadata.operationString"aiDocumentParser".
rawContent (fallback only)StringIf the API returns plain text instead of JSON and parsing fails, the node wraps the response as { "rawContent": "<api response string>" } at the top level.

Hızlı Kurulum

  1. Öncelikle Analiz aracınızı oluşturun. Açın Analizci listesi, tıklamak + EkleAçık bir Analizör Kimliği girin, seçin Ayrıştırma veya SınıflandırmakSatırı kaydedin, ardından belge şeması ekleyin. Analiz detayları Sayfaya bakın. Parse kurulum kılavuzu veya Sınıflandırma kurulum kılavuzu Şema kurallarının tamamı için, aşağıdakiler dahil: fieldType: "table" iç içe geçmiş satırlar için ve fieldMethod (Çıkarma veya oluşturma).
  2. Sizin n8n iş akışı, tıklayın + ve arama PDF4me. Ayarlamak Kaynak ile Çıkarmak Ve Çıkarma İşlemleri ile Yapay Zeka Belge Ayrıştırıcısı.
  3. İçinde Bağlantı kurmak için kimlik bilgisi, sizinkini seçin PDF4me kimlik bilgilerini yapıştırın veya bir şey yapıştırın API anahtar.
  4. Ayarlamak Giriş Veri Türüİkili Veri (varsayılan), önceki bir düğümden okuma yapar ve en yaygın olanıdır.
  5. Uygun giriş alanını doldurun (Giriş İkili Alanı, Base64 Belge İçeriği, veya Belge URL'si).
  6. Belge AdıVarsayılanı geçersiz kıl document.pdf Doğru uzantıyla gerçek dosya adını kullanmak için.
  7. Birini seçin AI Analizör Kimliği (Hesabınızdan yüklenen) açılır menüden.
  8. Düğümü çalıştırın. Çıktı öğesi, en üst düzeyde ayrıştırılmış alanları ve bunlara ek olarak diğer alanları da içerir. _metadataBu yolu Set, Code, Google Sheets, Airtable, veritabanı, e-posta veya herhangi bir alt düğüme yönlendirin.

Tipik Kurulumlar

İş Akışı ÖrnekleriCommon n8n workflow patterns using AI Document Parser.
Google Sheets'e e-posta eki
  1. E-posta Tetikleyicisi (IMAP), yeni bir mesaj geldiğinde devreye girer. PDF EK.
  2. AI Belge Ayrıştırıcı, Giriş Veri Türü İkili Veri ve Belge Adı olarak ayarlanmış ek dosya adıyla çalışır. AI Analizör Kimliği sizin için ayarlandı. fatura ayrıştırıcı Analiz cihazı.
  3. Google Sheets Ekle Fatura numarasını, satıcı adını, toplam tutarı ve vade tarihini AP takip sistemine yazar.
Classify ile çoklu satıcı gelen kutusu
  1. İzlenen klasör karışık içerikler alıyor. PDFs Müşteri ABC'den, Müşteri XYZ'den ve daha birçok müşteriden.
  2. AI Belge Ayrıştırıcısı, bir Sınıflandırma Analizcisi Kimliğine ayarlanmıştır (tedarikçi başına bir Şema).
  3. Bir Switch düğümü, yanıtta döndürülen eşleşen Sınıflandırma Adına göre dallanır ve her sonucu ilgili alt tabloya gönderir.
Belgeyi barındıran: URL
  1. Webhook, portalınızdan bir belge bağlantısı alır.
  2. AI Belge Ayrıştırıcı, Giriş Veri Türü ile çalışır. URL ve özel formunuzun Analizci Kimliği.
  3. Çıktı JSON Bu işlem, yeni bir kayıt oluşturmak için Dataverse / Airtable / Postgres yazma işlemine eşlenir.
Tara, otomatik kırp, sonra ayrıştır.
  1. Tarayıcı çıktısı geniş kenarlıklı bir klasöre kaydedilir.
  2. Yapay Zeka Otomatik Kırpma Belgesi (Kaynak) AIKenarları kırpar.
  3. AI Belge Ayrıştırıcı, eşleşen Analizci Kimliğine sahip kırpılmış ikili dosya üzerinde çalışır.
  4. Ayrıştırıldı JSON Akıntı her zamanki gibi aşağı yönde devam eder.
Önce doğrulayın, sonra zenginleştirin.
  1. AI Belge ayrıştırıcısı yapılandırılmış alanları döndürür.
  2. Kod düğümü, gerekli alanları doğrular ve iş kurallarını uygular.
  3. Geçerli ise, bir HTTP İstek, CRM sisteminizdeki tedarikçi verileriyle zenginleştirilir; aksi takdirde, manuel inceleme için Slack'e bir uyarı gönderilir.

Pratik İpuçları

Set up the Analyzer in PDF4me first
The node does not define extraction rules. It runs whatever your selected Analyzer specifies. Build it in the dashboard before configuring the node.
Use Document Name with the real extension
PDF4me uses the extension for format detection. Even on Binary Data, an explicit Document Name with the correct extension is safest.
No Output Binary Field Name and no Advanced Options
Unlike AI Auto Crop Document, this operation has neither. The output is JSON only; there is nothing to write back as a binary file.
Plain-text fallback wraps as rawContent
If the API returns plain text instead of JSON and parsing fails, the node wraps the response as { "rawContent": "<string>" } so the workflow does not break.
Combine with AI Auto Crop Document for scans
Scans with wide borders parse better after cropping. Chain AI Auto Crop Document (Resource AI) before this node.
Use AI-Invoice Parser / AI-Process Contract for built-in schemas
When you only need standard invoice or contract fields, the dedicated nodes are simpler. AI Document Parser shines when you have a custom schema.

Sorun giderme

"AI Analizör Kimliği gereklidir."

Çalıştırmadan önce açılır menüden bir Analizleyici seçin. Bu alan boş bırakılamaz.

"'...' özelliğinde ikili veri bulunamadı."

Hizala Giriş İkili Alanı önceki düğümle birlikte (genellikle veriHata raporu, hangi özelliğin eksik olduğunu belirtir.

"Belge içeriği gereklidir."

Boş base64 veya eksik dosya. Lütfen ilgili Giriş Veri Türü alanına içerik girin.

"Geçersiz URL format"

Kontrol etmek Belge URL'si tam ve geçerli bir URL (şema + ana bilgisayar + yol).

"GetAnalyzerId hiçbir analiz seçeneği döndürmedi"

Hesapta analiz aracı yok veya kimlik bilgileriyle ilgili bir sorun var. Lütfen aşağıdaki bölümden bir analiz aracı oluşturun. PDF4me kontrol paneli veya doğrulama API anahtara girin n8n kimlik belgesi.

Kopya Kağıdı

AlanDeğer
ResourceExtract
OperationAI Document Parser
Input Data TypeBinary Data
Input Binary Fielddata
Document Nameform.pdf (with the real extension)
AI Analyzer Id(pick from the dropdown loaded from your account)
CredentialsPDF4me API credential

Sıkça Sorulan Sorular

Where does the AI Analyzer Id list come from?+
The dropdown is populated from your PDF4me account via the GetAnalyzerId API. Each option is an Analyzer you created at https://dev.pdf4me.com/dashboard/#/ai-document-parser/ with schemas on https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>. The node sends the selected value as customisationNote to the AiDocumentParser API.
What does "GetAnalyzerId returned no analyzer options" mean?+
The account has no Analyzers configured, or the credentials cannot reach the GetAnalyzerId endpoint. Open https://dev.pdf4me.com/dashboard/#/ai-document-parser/ and create at least one Analyzer (Parse or Classify) on the Analyzer detail page, or verify the API key in your n8n credential.
How is this different from AI-Invoice Parser, AI-Process Contract, AI-Process Bank Cheque?+
Those nodes use fixed schemas tuned to those document types. AI Document Parser is schema-driven: it runs whatever Analyzer you select, so the same node handles invoices, purchase orders, receipts, custom forms, lab reports, anything you describe in a schema. Pick AI Document Parser whenever you need a custom layout or document type.
What shape does the output have?+
Top-level keys match the field names in your Analyzer schema (for example customerName, invoiceNumber, totalAmount, lineItems). Nested objects and table arrays follow the same shape you defined. A _metadata object is always appended with success, message, processingTimestamp, sourceFileName, aiAnalyzerId, and operation. No binary file is returned.
Does this work on scanned PDFs?+
Yes. The AI engine handles OCR internally, so scanned PDFs and image formats work the same as native PDFs. If borders are large, chain AI Auto Crop Document (Resource AI) before this node for cleaner extraction.
Can I change the Analyzer schema without rebuilding the workflow?+
Yes. The workflow only references the Analyzer Id. Edit the schema in the PDF4me dashboard and the next run picks up the new shape automatically. Output keys follow your latest schema, so any downstream Set / Code / Sheets nodes that assume specific keys may need updating after a breaking schema change.
Can I switch between Parse and Classify Analyzers without rewiring the node?+
Yes. Both Analyzer types are listed in the AI Analyzer Id dropdown. Pick a Classify Analyzer when you want one node to handle several document variants; pick a Parse Analyzer for a single fixed schema. The output shape adapts to whichever you choose.
What happens when the API returns plain text instead of JSON?+
The node tries to parse it; if parsing fails, the response is wrapped as { "rawContent": "<api response string>" } at the top level so the workflow does not break. Useful for inspecting unexpected responses during development.

İlgili Eylemler

Diğer Platformlarda Aynı Görev

Yardım Alın