Ana içeriğe geç

Power Automate'te PDF'lerden Metin Çıkarma: Taranmış ve Görüntü Tabanlı Belgeler Dahil

· 13 dakikalık okuma
SEO and Content Writer

Dropbox, SharePoint veya e-posta yoluyla elinizde PDF dosyaları var; bazıları düz metin, bazıları taranmış veya görüntü tabanlı ve bu metinlere tek bir güvenilir akış halinde erişmeniz gerekiyor. Sorun şu: Görüntü tabanlı PDF'lerde seçilebilir metin bulunmaz.Öncelikle OCR'ye ihtiyaçları var. Aranabilir hale geldikten sonra, PDF4me Metin ve Görüntü Çıkarma her şeyi içine çekiyor tek bir aramaİkinci okuma yok, API kredisi israfı yok.

Bu kılavuz, her ikisini de ele alan bir iş akışını adım adım açıklıyor: tetiklemekdosya içeriğini al (Dropbox) → OCR kullanarak PDF dosyasını düzenlenebilir PDF dosyasına dönüştürün. (taranmış belgeler için) → Metin ve Görüntüleri Çıkarma (PDF4me). Tam çıktı yapısını ve API'yi kendiniz denemek ve sorun gidermek için bağlantıları elde edersiniz.

Tek bir telefon görüşmesinin önemi.

Belgeleri bölen, dosyaları yeniden adlandıran veya içeriği yönlendiren akışlar oluşturduğunuzda, genellikle her PDF'den çıkarılan metin ve resimlere ihtiyacınız olur. Her belgeyi döngü içinde yeniden okumak API çağrılarını artırır ve akışları yavaşlatır. Metin ve Görüntüleri Çıkarma Hem metin içeriğini hem de gömülü resimleri tek bir yanıtta döndürür. İhtiyacınız olan her şeyi alırsınız: metin, resim dosya adları ve Base64 resim verileri; böylece sonraki işlemler ek okumalara gerek kalmadan yeniden adlandırabilir, yönlendirebilir veya arşivleyebilir.

İşte bir ipucu: PDF dosyalarını barkoda göre bölmeniz ve her dosyayı barkoda göre yeniden adlandırmanız mı gerekiyor? Şunu kullanın: Barkoda Göre PDF'i Böl: geri döner barkodMetni Her bir bölüm için aynı yanıtta, böylece ikinci bir çağrı yapmadan yeniden adlandırabilirsiniz. Daha fazla bilgi için lütfen aşağıdaki bilgilere bakın. Power Automate'te Barkoda Göre PDF'leri Bölme rehber.

Ne istiyorsun?

  • Güç Otomasyonu, Open Power AutomateGiriş yapın ve yeni bir bulut akışı oluşturun (Anlık veya Otomatik).
  • PDF4me API anahtarı, API anahtarınızı alınPDF4me eylemlerini eklediğinizde bir bağlantı oluşturacaksınız. İlk defa mı kullanıyorsunuz? Bakın PDF4me'yi Power Automate'e bağlayın.
  • DropboxBunu şu amaçla kullanıyoruz: Dosya içeriğini alSharePoint, OneDrive veya dosya içeriği sağlayan herhangi bir bağlantı aracı da işe yarar.

İş Akışına Genel Bakış (4 Adım).

  1. Akışı manuel olarak tetikleAkışı isteğe bağlı olarak başlatın (veya kullanın) Bir dosya oluşturulduğunda (otomasyon için Dropbox'ta).
  2. Yol kullanarak dosya içeriğini al (Dropbox): PDF dosyasını şu yoldan indirir: /pdf4metest/extracttext/image to pdf.pdf.
  3. PDF: OCR kullanarak PDF dosyasını düzenlenebilir PDF'ye dönüştürün. (PDF4me): Taranmış/görüntü tabanlı PDF'leri aranabilir metne dönüştürür. PDF'leriniz zaten metin olarak aranabiliyorsa bu adımı atlayın.
  4. PDF: Metin ve Görüntüleri Çıkarma (PDF4me): Tam metni ve içine yerleştirilmiş tüm resimleri tek bir yanıtta döndürür.
Power Automate akışı: Manuel tetikleme → Dosya içeriğini alma → OCR kullanarak PDF'yi düzenlenebilir PDF'ye dönüştürme → PDF'den metin ve görüntüleri çıkarma

Giriş: Bir adet PDF dosyası (resim tabanlı veya metin tabanlı). Çıktı: Metin içeriği texts dizi ve görüntülerde images dizi ile fileName Ve streamFile (Base64).

Örnek PDF: Numaralandırılmış satırlara sahip örnek PDF belgesi (görüntü tabanlı giriş)

Örnek girdi: OCR işleminden sonra metni çıkarılabilir görüntü tabanlı PDF


Adım 1: Tetikleyiciyi Çalıştır + Dosya İçeriğini Al.

Şu ana kadarki akış: Tetikleyici → Dosya içeriğini al.

  1. Eklemek Akışı manuel olarak tetikle (veya Bir dosya oluşturulduğunda (otomasyon için Dropbox'ta).
  2. Eklemek DropboxYol kullanarak dosya içeriğini al.
  3. Parametreler:
  • Dosya Yolu *PDF dosyanızın yolunu girin, örneğin: /pdf4metest/extracttext/image to pdf.pdfGerekirse klasör simgesini kullanarak dosyalara göz atabilirsiniz.
  • Gelişmiş parametrelerİçerik Türünü Çıkar: Ayarlandı Evet.
  1. Bağlantı: Emin olmak Dropbox'a bağlı..

Çıktı, dosya içeriğidir (ikili veri). Bunu şuna eşleştirin: Dosya İçeriği OCR işleminde (ve daha sonra Metin ve Görüntü Çıkarma işleminde).

Dikkat et: Gerçek haritayı doğru şekilde yerleştirdiğinizden emin olun. Dosya İçeriği Çıktıyı seçin, dosya yolunu veya meta verilerini değil. Power Automate bazen açılır menüde birkaç seçenek sunar; ikili dosyayı içeren seçeneği belirleyin.

Dosya içeriğini al: Dosya Yolu /pdf4metest/extracttext/image to pdf.pdf, İçerik Türünü Çıkar Evet

Adım 2: OCR kullanarak PDF'yi düzenlenebilir PDF'ye dönüştürün (Görüntü tabanlı PDF'ler için).

Şu ana kadarki akış: Tetikleyici → Dosya içeriğini al → OCR kullanarak PDF'yi düzenlenebilir PDF'ye dönüştür.

PDF dosyanız taranmış veya görüntü tabanlı ise, metnin çıkarılmadan önce aranabilir hale gelmesi için bu adımı ekleyin. PDF dosyanızda zaten seçilebilir metin varsa, bir kelimeyi okuyucuda kopyalamayı deneyin, 3. adıma geçebilir ve dosya içeriğini doğrudan Metin ve Görüntü Çıkarma işlemine aktarabilirsiniz.

  1. Eklemek PDF4mePDF: OCR kullanarak PDF dosyasını düzenlenebilir PDF'ye dönüştürün..
  2. Parametreler:
  • Dosya İçeriği *, Harita Yol kullanarak dosya içeriğini al çıktı (PDF ikili dosyası).
  • Dosya adı *Örneğin, bir isim girin. Test.pdf veya kaynak dosya adı.
  • KaliteTipi: Taslak normal PDF'ler için (dosya başına 1 API çağrısı) veya Yüksek Taranmış/görüntü tabanlı PDF'ler için (sayfa başına 2 API çağrısı).
  • OCR yalnızca gerektiğinde kullanılır.: YANLIŞ OCR'ı her zaman çalıştırmak için, veya Evet PDF dosyası zaten aranabilir durumdaysa atla (API çağrılarını azaltır).
  • Dil: Kaynak belge diline ayarlandı (örneğin, en(Daha iyi OCR doğruluğu için gerekirse.)
  • Asenkron mu?: HAYIR Senkronize işlemler için (akışlar için önerilir).
  1. Bağlantı: PDF4me PDF'ye bağlı.
OCR kullanarak PDF'yi düzenlenebilir PDF'ye dönüştürün: Dosya İçeriği: Dosyayı Al, Dosya Adı: Test.pdf, Kalite Türü: Taslak, OCR Yalnızca Gerektiğinde: false, Dil: Eşzamansız: Hayır

3. Adım: Metin ve Görüntüleri Ayıklayın.

Şu ana kadarki akış: … → OCR kullanarak PDF'yi düzenlenebilir PDF'ye dönüştürün → Metin ve Görüntüleri çıkarın.

  1. Eklemek PDF4mePDF: Metin ve Görüntüleri Çıkarma.
  2. Parametreler:
  • Dosya İçeriği *Çıktıyı haritalandırın PDF, OCR kullanarak PDF'yi düzenlenebilir PDF'ye dönüştürün (veya doğrudan buradan) Dosya içeriğini al (OCR işlemini atladıysanız).
  • Dosya adı *Örneğin, bir isim girin. New.pdf veya kaynak dosya adı.
  • Metni Alıntıla: Evet Metni çıkarmak için.
  • Görüntüleri Çıkar: Evet gömülü görüntüleri çıkarmak için (veya HAYIR (sadece metne ihtiyacınız varsa).
  1. Bağlantı: PDF4me PDF'ye bağlı.
Metin ve Görüntüleri Çıkarma: OCR adımından elde edilen dosya içeriği, Dosya Adı New.pdf, Metin Çıkarma Evet, Görüntü Çıkarma Evet

Çıktı: Eylem geri dönüyor vücut ile:

  • metinler: Çıkarılan tüm metni içeren dize dizisi (satır sonları da dahil) \n).
  • resimlerNesne dizisi: fileName (örneğin) page001_image001.jpg) Ve streamFile (Base64). Görüntüleri kaydetmek veya işlemek için sonraki işlemlerde bunları kullanın.
Ham JSON çıktısı: statusCode 200, metin dizisi ve resim dizisi (fileName, streamFile) içeren gövde.

Parametreler ve Çıkış Referansı.

İşte kullandığımız ekipmanların kısa bir özeti. Bunları kendi sisteminize uyacak şekilde değiştirebilirsiniz.

AdımParametreDeğerNotlar
Dosyayı alDosya Yolu/pdf4metest/extracttext/...Dropbox yolunuz
Dosyayı alİçerik Türünü ÇıkarEvetPower Automate'in dosyayı yönetmesine yardımcı olur.
OCRKaliteTipiTaslakKullanmak Yüksek zorlu taranmış belgeler için
OCROCR yalnızca gerektiğinde kullanılır.YANLIŞAyarlandı Evet Metin zaten aranabilir durumdaysa API çağrılarını azaltmak için.
ÇıkarmakMetin / Görüntüleri ÇıkarmaEvet / Evetİşlemleri hızlandırmak için ihtiyacınız olmayan şeyleri kapatın.
Çıktıgövde.metinleriDize dizisiÇıkarılan tüm metin
Çıktıvücut.resimleridosyaAdı, akışDosyasıHer görüntü için Base64 görüntü verileri

Parametrelerin tüm ayrıntıları için bakınız. Metin ve Görüntüleri Ayıklama: Güçlü Otomasyon Ve OCR kullanarak PDF dosyasını düzenlenebilir PDF dosyasına dönüştürün..


Sorun giderme.

Bazen işler ters gidebilir. İşte genellikle sorunu çözen yöntem:

"Dosya boş" veya "Dosya açılamadı"

Genellikle yanlış alanın eşleştirildiği anlamına gelir. Gerçek bilgiyi içeren alanı kullanın. dosya içeriğiYol veya referans değil, Power Automate'in açılır menüsü burada biraz karmaşık olabilir. Bkz. Zapier ve Power Automate İpuçları Base64 ve dosya işleme için.

PDF yerine JPG veya PNG göndermek

Metin ve Görüntü Çıkarma işlemi için PDF dosyası gereklidir. Kaynağınız bir görüntü ise, önce onu dönüştürün. PDF'ye dönüştürArdından sonucu iletin.

401, 402 veya diğer hatalar

Kontrol etmek PDF4me Sorun Giderme 401 (API anahtarı), 402 (krediler) ve platforma özgü düzeltmeler için.


API'yi etkileşimli olarak deneyin.

Power Automate kullanmadan Metin ve Görüntü Çıkarma API'sini test edin. API TestleriPDF dosyasını yükleyin ve yanıtı görün:


Sonraki Adımlar.

Neredeyse bitirdiniz.
  • Test amaçlı bir PDF dosyasını klasörünüze bırakın ve akışı çalıştırın, kontrol edin. vücut çıktı için metinler Ve resimler.
  • Beslemek metinler Compose, Parse JSON veya Conditions'a dönüştürün; kullanın resimler Dosya oluşturma veya herhangi bir depolama işlemiyle.
  • Takas Manuel olarak tetikle için Bir dosya oluşturulduğunda (Dropbox) ve tetikleyicinin dosya yolunu şuraya bağlayın: Dosya içeriğini al Otomatikleştirme için, müdahale gerektirmeyen bir sistem.