Ana içeriğe geç

İfadeye Göre Metin Çıkarma n8n aksiyon

PDF4me İfadeye Göre Metin Çıkarma metinden belirli metin içeriğini çıkarır. PDF Belgeleri desen eşleştirme ve ifade tabanlı filtreleme kullanarak işleyin. n8n Otomasyon iş akışları. Süreç PDFuzakta n8n tetikleyiciler, ikili veriler, base64 dizeleri veya halka açık URLBu çözüm, joker karakter kalıpları (%), düzenli ifadeler, belirli veri alanları, sayfaya özgü hedefleme ve yapılandırılmış çıktı ile esnek çıkarma kuralları kullanarak metin bulma ve ayıklama işlemlerini gerçekleştirir. Fatura numarası ayıklama, veri alanı yakalama, kalıp tabanlı metin alma, otomatik veri ayıklama, belge ayrıştırma ve hassas metin hedeflemesi, esnek eşleştirme ve sorunsuz entegrasyon gerektiren içerik analizi iş akışları için idealdir.

İlgili Blog Yazıları
Bu özellik için henüz bir blog yazısı yok — yakında yayınlanacak.
Bu arada, her platforma yönelik eğitimler ve iş akışları için PDF4me bloguna göz atın.
Blogu ziyaret edin

Kurmak

Ekle PDF4me "İfadeye Göre Metin Çıkarma" düğümünü ekleyin. n8n İş akışını düzenleyin ve gerekli parametreleri yapılandırın. İlk kurulum talimatları için, lütfen sayfamıza bakın. n8n Entegrasyon Kılavuzu.

Önkoşullar:

  • PDF4me API kimlik bilgileri
  • n8n iş akışına erişim

Yapılandırma:

  1. Eklemek PDF4me düğümden iş akışına
  2. "İfadeye Göre Metin Çıkarma" eylemini seçin.
  3. Giriş parametrelerini yapılandırın (aşağıya bakınız)
İfade Yapılandırmasına Göre Metin Çıkarma

Parametreler

"İfadeye Göre Metin Çıkarma" eylemi için tüm parametrelerin listesi. Metin çıkarma işlemini kontrol etmek için bu parametreleri yapılandırın.

Önemli: Yıldız (***) ile işaretlenmiş parametreler zorunludur ve işlemin doğru şekilde çalışması için sağlanmalıdır.

ParametreTipTanımÖrnek
Giriş Veri Türü***StringPDF Giriş Biçimi Seçimi
• Formatınızı seçin PDF veri girişi
PDF4me birden fazla giriş türünü destekler
• Seçenekler: İkili Veri, Base64 Dize veya URL
Binary Data
Giriş İkili Alanıİkiliİkili PDF Dosya Girişi (İkili veri ise gereklidir)
• Referans PDF önceki dosyadan n8n düğüm veya dosya yükleme
PDF4me ikili işlemler PDF otomatik format algılama özelliğine sahip dosyalar
• Giriş Veri Türü "İkili Veri" olduğunda gereklidir.
{{ $binary.data }}
Base64 PDF İçeriğiStringBase64 Kodlanmış PDF Giriş (Gerekliyse) Base64 Sicim)
• Sağlamak PDF içerik base64 kodlu dize olarak
PDF4me otomatik olarak kodunu çözer ve işler PDF içerik
• Giriş Veri Türü " olduğunda gereklidirBase64 Sicim"
JVBER...
PDF URLStringHalk PDF URL Giriş (Gerekliyse) URL)
• Herkese açık/açık izin verin URL -e PDF dosya
PDF4me dosyayı indirir ve işler. URL
• Giriş Veri Türü " olduğunda gereklidirURL"
https://abc.com/document.pdf
Belge Adı***StringGiriş Dosya Adı
• Girişin adını belirtin PDF dosya
• Biçim tespiti ve işleme optimizasyonu için kullanılır.
• .pdf uzantısını içermesi zorunludur.
document.pdf
İfade***StringMetin Çıkarma Kalıbı
• Metin içeriğiyle eşleşecek kalıbı veya ifadeyi tanımlayın.
• Düzenli ifade kalıplarını, joker karakterleri ve özel ifadeleri destekler.
• Kullanmak % joker karakter eşleştirme veya belirli regex kalıpları için
%
Sayfa Sırası***StringSayfa Aralığı Belirtimi
• Metin çıkarma işlemi için hangi sayfaların işleneceğini belirleyin.
• Belgenin tamamı veya belirli sayfa numaraları/aralıkları için "tümünü" kullanın.
• Örnekler: "1,3,5" (belirli), "1-5" (aralık), "1-" (1. sayfadan sonuna kadar)
1-

Gelişmiş Seçenekler

Aşağıdaki parametreler Gelişmiş Seçenekler bölümünde mevcuttur ve isteğe bağlıdır:

ParametreTipTanımÖrnek
Özel ProfillerStringÖzel Yapılandırma Profilleri
• Özel profiller kullanarak ek seçenekler belirleyin.
JSON-önceden tanımlanmış parametreler içeren format gibi
• Gelişmiş çıkarma işleme ayarlarını etkinleştirir
• Özel gereksinimler için isteğe bağlı
{ "outputDataFormat": "json" }

Çıktı

Çıkış Parametreleri

ParametreTipTanımÖrnek
dosya adıStringPDF4me oluşturulan dosya adı - Başarıyla işlenmiş belgenin uzantısı ve zaman damgasıyla birlikte tam dosya adı. PDF4me Benzersiz adlandırmayı sağlar ve dosya formatı uyumluluğunu doğrulayarak sonraki süreçlerle sorunsuz entegrasyon imkanı sunar.text_extraction_results_1756999697398.json
mimeTypeStringPDF4me MIME tür tanımlayıcı - Standartlaştırılmış MIME Çıkarılan içerik dosyasının türü, tipik olarak application/json yapılandırılmış veriler için veya application/zip Birden fazla dosya için geçerlidir. Bu, tüm sistemlerde ve uygulamalarda doğru dosya işleme ve tanımayı sağlar.application/json
dosya boyutuSayıPDF4me Dosya boyutu (bayt cinsinden) - Çıkarılan içerik dosyasının bayt cinsinden tam boyutu, depolama planlaması, bant genişliği optimizasyonu ve dosya aktarımı izleme için sağlanır. Kurumsal belge yönetimi ve iş akışı otomasyonu için gereklidir.106
başarıBooleanPDF4me çıkarma durumu göstergesi - Metin çıkarma işleminin başarılı veya başarısız olduğunu gösteren Boolean bayrağı. Dönüş değeri: true başarılı ekstraksiyonlar için ve false Olası hatalar için, otomatikleştirilmiş iş akışlarında sağlam hata yönetimi sağlanır.true
mesajStringPDF4me çıkarma durumu mesajı - Metin çıkarma işleminin sonucunu gösteren açıklayıcı mesaj. Başarılı çıkarma işlemleri için net durum mesajları ve sorun giderme amacıyla ayrıntılı hata bilgileri sağlar.Text extraction by expression completed successfully
belge adıStringPDF4me orijinal belge adı referansı - Giriş dosyasının orijinal adı PDF İşlem görmüş dosya. Bu referans, denetim kayıtları, hata ayıklama amaçları ve kurumsal iş akışlarında çıkarılan içeriğin kaynağını izlemek için saklanır.document.pdf
ifadeStringPDF4me kullanılan ekstraksiyon ifadesi - Metin çıkarma işleminde kullanılan kalıp veya ifade. Bu alan, doğrulama ve hata ayıklama amacıyla çıkarma işlemi sırasında uygulanan gerçek ifadeyi gösterir.%
sayfaSıralamasıStringPDF4me işlenmiş sayfa aralığı - Metin çıkarma işlemi sırasında işlenen sayfa aralığı. Bu alan, belirtilen ifade için taranan gerçek sayfaları gösterir; doğrulama ve sorun giderme için faydalıdır.1-2

N8N Eylem Yanıtı

O PDF4me İfadeye Göre Metin Çıkarma API Yanıtı birden fazla formatta görüntüleyebilirsiniz. İhtiyaçlarınıza en uygun görünümü seçin:

JSON Yanıt Formatı

Ham JSON yanıt olarak API:

{
"fileName": "text_extraction_results_1756999697398.json",
"mimeType": "application/json",
"fileSize": 106,
"success": true,
"message": "Text extraction by expression completed successfully",
"docName": "document.pdf",
"expression": "%",
"pageSequence": "1-2"
}

Kullanım Senaryoları

Veri Madenciliği ve Bilgi Çıkarma

  • Veri kalıplarını, iletişim bilgilerini ve yapılandırılmış verileri ayıklayın. PDF Veri madenciliği ve iş zekası için özel ifadeler kullanan belgeler
  • Hedeflenen ifadeler kullanarak belirli maddeleri, şartları ve hukuki bilgileri çıkararak yasal belgeleri, sözleşmeleri ve resmi kayıtları işleyin.
  • Özel ifadeler kullanarak belirli finansal verileri, tutarları ve işlem bilgilerini çıkararak finansal raporları, faturaları ve muhasebe belgelerini dönüştürün.

İçerik Analizi ve Araştırma

  • Araştırma verilerini, alıntıları ve akademik bilgileri şu kaynaklardan çıkarın: PDF Akademik araştırma ve içerik analizi için özel ifadeler kullanan belgeler
  • Hedeflenen ifadeleri kullanarak belirli verileri, ölçümleri ve araştırma bulgularını çıkararak bilimsel makaleleri, araştırma belgelerini ve teknik yayınları işleyin.
  • Özel ifadeler kullanarak belirli ölçütleri, istatistikleri ve iş verilerini çıkararak iş raporlarını, pazar araştırmalarını ve sektör analizlerini dönüştürün.

Uyumluluk ve Düzenleyici İşlemler

  • Uyumluluk verilerini, düzenleyici bilgileri ve denetim ayrıntılarını şu kaynaklardan çıkarın: PDF Mevzuat uyumluluğu ve denetim işlemleri için özel ifadeler kullanan belgeler.
  • Belirli uyumluluk verilerini, standartları ve düzenleyici bilgileri çıkararak kalite kontrol belgelerini, denetim raporlarını ve belgelendirme materyallerini işleyin.
  • Özel ifadeler kullanarak belirli düzenleyici verileri, uyumluluk ölçütlerini ve resmi bilgileri çıkararak resmi belgeleri, izinleri ve düzenleyici başvuruları dönüştürün.

Yardım Alın