Ana içeriğe geç

PDF OCR içinde Make

Bu modülün işlevi

PDF4me, PDF OCR taranmış veya görüntü tabanlı verileri dönüştürür PDFs bir Make Senaryo. Seçin. Standart dijital olarak doğanlar için kalite PDFs veya Uzman Taranmış, fotoğraflanmış veya düşük çözünürlüklü belgeler için kaliteyi iyileştirin. Etkinleştirin OCR yalnızca gerektiğinde kullanılır. Seçilebilir metne sahip sayfaları atlamak ve kullanmak için Asenkron mu? 10 sayfayı aşan dosyalar için senaryo zaman aşımını önlemek amacıyla kullanılır. Çıktı aranabilir özelliktedir. PDF metin çıkarma, arşivleme, tam metin indeksleme veya AI işleme.

İlgili Blog Yazıları
Bu özellik için henüz bir blog yazısı yok — yakında yayınlanacak.
Bu arada, her platforma yönelik eğitimler ve iş akışları için PDF4me bloguna göz atın.
Blogu ziyaret edin

Kimliğinizi Doğrulama API Rica etmek

Her PDF4me modül içinde Make geçerli bir belge gerektirir Bağlantı. İçeriğinizi barındıran birini oluşturun veya seçin. PDF4me API Senaryonun kimlik doğrulamasını yapabilmesi için anahtar. OCR İstekleri güvenli bir şekilde işleme.

Kaçırmamanız Gereken Önemli Bilgiler

Uzman Kalitesi vs Standart Kalite
Kullanmak Uzman Taranmış veya fotoğraflanmış belgeler için, daha yüksek doğruluk sağlamak amacıyla sayfa başına iki işlem geçişi uygular. Kullanım Standart dijital doğumlular için PDFs Neresi OCR Hâlâ ihtiyaç var, daha hızlı ve maliyeti yarı yarıya daha düşük. API Sayfa başına kredi sayısı.
OCR Yalnızca Gerektiğinde seçeneği kredi tasarrufu sağlar.
Etkinleştirildiğinde, modül işleme başlamadan önce her sayfayı kontrol eder, zaten seçilebilir metin içeren sayfalar atlanır ve OCR Bu yalnızca resim tabanlı sayfalara uygulanır. Bu, tasarruf sağlar. API Girdiğiniz bilgiler için teşekkür ederiz. PDF Orijinal ve taranmış sayfaları bir araya getiriyor.
10 sayfadan uzun dosyalar için "Is Async" seçeneğini kullanın.
Asenkron mod olmadan, büyük PDFs şunlara neden olabilir Make senaryonun zaman aşımına uğraması öncesinde OCR Tamamlandı. Etkinleştir Asenkron mu? 10 sayfadan fazla olan tüm belgeler için, işlem tamamlandığında modülün sonuçları eşzamansız olarak döndürmesine izin verin.
PDF4me PDF OCR modülünü, önceki adımda eşleştirilen dosyaları, çıktı dosya adını, Kalite türünü Uzman olarak ayarlamayı, Yalnızca Gerektiğinde OCR yapmayı, Dil kodunu ve Eşzamansız olup olmadığını gösteren alanları içerecek şekilde oluşturun.

Dosya türü, çıktı dosya adı ve kalite türü gereklidir. OCR Yalnızca Gerektiğinde, Dil Kodu ve Asenkron Olması seçenekleri isteğe bağlıdır ancak karma içerikli ve büyük projeler için önerilir. PDFs.

Parametreler

Gerekli: Bağlantı, Dosyalar, Çıktı Dosya Adı ve Kalite Türü bilgilerinin tümü sağlanmalıdır. OCR Yalnızca Gerektiğinde, Dil Kodu ve Asenkron Olması seçenekleri isteğe bağlıdır.

ParametreGerekliNe işe yarar?Örnek
ConnectionYesPDF4me API connection. Click Add and paste your API key if connecting for the first time.Your PDF4me connection
FilesYesBinary PDF file mapped from a preceding module: scanned, photographed, or image-based PDFs.1. Data
Output File NameYesFilename for the searchable PDF output including the .pdf extension.scanned_searchable.pdf
Quality TypeYesStandard for born-digital PDFs (1 API call per page, faster). Expert for scanned or image-based documents (2 API calls per page, higher accuracy).Expert
OCR Only When NeededNoWhen set to Yes, pages with existing selectable text are skipped: OCR is applied only to image-based pages. Saves API credits for mixed-content PDFs.Yes
Language CodeNoISO language code for the OCR engine. Common values: eng, deu, fra, spa, ita, por. Leave blank for automatic language detection.eng
Is AsyncNoSet to Yes for PDFs with more than 10 pages to prevent Make scenario timeout. Results are returned asynchronously when processing completes.Yes

Hızlı Kurulum

  1. Eklemek PDF4mePDF OCR senin Make senaryo.
  2. Seçme Bağlantı (veya tıklayın) Eklemek sizinle bir tane oluşturmak için API anahtar).
  3. Harita Dosyalar Önceki indirme modülünün ikili çıktısına (örneğin, Dropbox → Dosya İndir → Data).
  4. Bir girin Çıktı Dosya Adı: örneğin scanned_searchable.pdf.
  5. Ayarlamak Kalite Türü ile Expert taranmış belgeler için veya Standard dijital doğumlular için PDFs.
  6. İsteğe bağlı olarak etkinleştirin OCR Sadece Gerektiğinde Ve Asenkron mu? (10 sayfadan uzun dosyalar için) ardından tıklayın. Kaydetmek ve çalıştırın. Çıktı Doc Data Arama sonuçlarınızda görünüyor mu? PDF.

İş Akışı Örnekleri

İş Akışı ÖrnekleriCommon Make scenario patterns using PDF OCR.
Taranmış fatura OCR ve veri çıkarma
  1. Gmail Taranmış fatura eki içeren yeni bir e-posta geldiğinde izleme tetiklenir.
  2. PDF OCR Kalite Türü Uzman olarak ayarlanmış şekilde çalışır ve OCR Yalnızca gerektiğinde etkinleştirildi.
  3. Kaynakları Çıkarma özelliği, Belge Verileri çıktısından aranabilir metni çıkarır.
  4. Çıkarılan metin, fatura alanları açısından ayrıştırılır ve otomatik olarak muhasebe sistemine kaydedilir.
Eski belgelerin dijitalleştirme işlemi
  1. Dropbox Gelen klasörüne yeni bir tarama geldiğinde izleme tetiklenir.
  2. PDF OCR Dosyayı Uzman kalitesinde işler ve büyük veri kümeleri için Async seçeneği Evet olarak ayarlanır.
  3. Aranabilir PDF yükleniyor SharePoint Arşiv klasörü.
  4. Slack Her belge dijitalleştirilip indekslendiğinde ekibe bildirim gönderir.
İmzalanmış sözleşme OCR arşiv ile Airtable kayıt
  1. OneDrive İmzalı kağıt sözleşmenin taranmış hali sözleşmeler klasörüne yüklendiğinde izleme tetiklenir.
  2. PDF OCR taranan sözleşmeyi aranabilir bir belgeye dönüştürür. PDF Uzman kalitesiyle.
  3. Google Drive aranabilir olanı kaydeder PDF Sözleşmeler Arşivi klasörüne.
  4. Airtable Sözleşme adı, tarihi ve aranabilir bağlantı içeren yeni bir kayıt oluşturur. PDF Uyumluluk takibi için.

Sıkça Sorulan Sorular

Which Quality Type should I choose?+
Use Expert for scanned documents, photographed pages, or low-quality images: it applies two processing passes per page for higher accuracy. Use Standard for born-digital PDFs (e.g. generated by software or saved from Word) where OCR is still required, it is faster and uses half as many API credits per page.
What does OCR Only When Needed do?+
When enabled, the module checks each page before processing. Pages that already contain selectable text are skipped: OCR is applied only to image-based pages. This is especially useful for PDFs that mix native digital pages with scanned inserts, since it avoids processing pages that do not need OCR.
Which languages does the OCR engine support?+
Common Language Code values are eng (English), deu (German), fra (French), spa (Spanish), ita (Italian), and por (Portuguese). Leave the Language Code field blank for automatic detection. Providing the correct code when the language is known improves accuracy.
When should I enable Is Async?+
Enable Is Async for any PDF with more than 10 pages. Without async mode, large multi-page documents may cause the Make scenario to time out before OCR processing finishes. With Is Async enabled, the module returns results asynchronously once processing completes regardless of file size.
What is in the Doc Data output?+
Doc Data contains the binary of the OCR-processed searchable PDF. The text layer is embedded inside the PDF: you can pass it to the Extract Resources module to extract the text, save it directly to cloud storage, or forward it to an AI analysis step for further processing.

İlgili Modüller

Yardım Alın