Zum Hauptinhalt springen

Text aus PDFs in Power Automate extrahieren: Einschließlich gescannter und bildbasierter Dokumente

· 13 Minuten Lesezeit
SEO and Content Writer

Sie haben PDFs in Dropbox, SharePoint oder E-Mails – manche sind reiner Text, andere gescannt oder bildbasiert – und Sie benötigen den Text in einem zuverlässigen Workflow. Der Haken: Bildbasierte PDFs enthalten keinen auswählbaren Text.Sie benötigen zunächst eine OCR-Texterkennung. Sobald sie durchsuchbar sind, PDF4me: Text und Bilder extrahieren zieht alles an ein AnrufKein zweiter Lesevorgang, keine verschwendeten API-Credits.

Diese Anleitung führt Sie durch einen Ablauf, der beides abdeckt: auslösenDateiinhalt abrufen (Dropbox) → PDF mithilfe von OCR in bearbeitbares PDF konvertieren (für gescannte Dokumente) → Text und Bilder extrahieren (PDF4me). Sie erhalten die genaue Ausgabestruktur und Links zur Fehlerbehebung und zum Selbsttest der API.

Warum ein Anruf zählt.

Beim Erstellen von Workflows, die Dokumente aufteilen, Dateien umbenennen oder Inhalte weiterleiten, benötigen Sie häufig extrahierten Text und Bilder aus jedem PDF. Das wiederholte Einlesen jedes Dokuments in einer Schleife verbraucht API-Aufrufe und verlangsamt die Workflows. Text und Bilder extrahieren Die Antwort liefert sowohl Textinhalte als auch eingebettete Bilder. Sie erhalten alles Notwendige: Text, Bilddateinamen und Base64-Bilddaten. Nachgelagerte Aktionen können die Dateien daher ohne zusätzliche Lesezugriffe umbenennen, weiterleiten oder archivieren.

Als Tipp: Sie müssen PDFs anhand des Barcodes aufteilen und jede Datei entsprechend dem Barcode umbenennen? Verwenden Sie PDF nach Barcode aufteilen: es gibt zurück BarcodeText in derselben Antwort für jede Aufteilung, sodass Sie umbenennen können, ohne einen zweiten Aufruf durchzuführen. Siehe unsere PDF in Power Automate nach Barcode aufteilen Führung.

Was brauchen Sie?

  • Power Automate, Power Automate öffnenMelden Sie sich an und erstellen Sie einen neuen Cloud-Flow (Sofort oder Automatisiert).
  • PDF4me API-Schlüssel, Holen Sie sich Ihren API-SchlüsselSie stellen eine Verbindung her, wenn Sie die PDF4me-Aktionen hinzufügen. Zum ersten Mal? Siehe Verbinden Sie PDF4me mit Power AutomateDie
  • DropboxWir verwenden es für Dateiinhalt abrufenSharePoint, OneDrive oder jeder andere Connector, der Ihnen Dateiinhalte bereitstellt, funktioniert ebenfalls.

Der Ablauf im Überblick (4 Schritte).

  1. Einen Ablauf manuell auslösen: Starten Sie den Ablauf bei Bedarf (oder verwenden Sie Wenn eine Datei erstellt wird (in Dropbox zur Automatisierung).
  2. Dateiinhalt über den Pfad abrufen (Dropbox): Ruft die PDF-Datei von einem Pfad wie diesem ab /pdf4metest/extracttext/image to pdf.pdfDie
  3. PDF: PDF mithilfe von OCR in bearbeitbares PDF konvertieren (PDF4me): Wandelt gescannte/bildbasierte PDFs in durchsuchbaren Text um. Überspringen Sie diesen Schritt, wenn Ihre PDFs bereits durchsuchbar sind.
  4. PDF: Text und Bilder extrahieren (PDF4me): Gibt den vollständigen Text und alle eingebetteten Bilder in einer einzigen Antwort zurück.
Power Automate-Ablauf: Manuell auslösen → Dateiinhalt abrufen → PDF mithilfe von OCR in bearbeitbares PDF konvertieren → PDF Text und Bilder extrahieren

Eingang: Eine PDF-Datei (bild- oder textbasiert). Ausgabe: Textinhalt in texts Array und Bilder in images Array mit fileName Und streamFile (Base64).

Beispiel-PDF: Beispiel-PDF-Dokument mit nummerierten Zeilen (bildbasierte Eingabe)

Beispiel-Eingabe: bildbasierte PDF-Datei mit nach der OCR extrahierbarem Text


Schritt 1: Auslöser + Dateiinhalt abrufen.

Bisheriger Ablauf: Auslöser → Dateiinhalt abrufen.

  1. Hinzufügen Einen Ablauf manuell auslösen (oder Wenn eine Datei erstellt wird (in Dropbox zur Automatisierung).
  2. Hinzufügen DropboxDateiinhalt über den Pfad abrufenDie
  3. Parameter:
  • Dateipfad *Geben Sie den Pfad zu Ihrer PDF-Datei ein, z.B. /pdf4metest/extracttext/image to pdf.pdfVerwenden Sie bei Bedarf das Ordnersymbol zum Durchsuchen.
  • Erweiterte ParameterInhaltstyp ableiten: Aufstellen JaDie
  1. Verbindung: Sicherstellen Mit Dropbox verbundenDie

Die Ausgabe ist der Dateiinhalt (binär). Ordnen Sie ihn zu Dateiinhalt in der OCR-Aktion (und später in „Text und Bilder extrahieren“).

Kopf hoch: Stellen Sie sicher, dass Sie die tatsächliche Dateiinhalt Ausgabe, nicht Dateipfad oder Metadaten. Power Automate bietet manchmal mehrere Optionen im Dropdown-Menü an; wählen Sie diejenige aus, die die Binärdatei enthält.

Dateiinhalt abrufen: Dateipfad /pdf4metest/extracttext/image zu pdf.pdf, Inhaltstyp ableiten: Ja

Schritt 2: PDF mithilfe von OCR in bearbeitbares PDF konvertieren (für bildbasierte PDFs).

Bisheriger Ablauf: Auslöser → Dateiinhalt abrufen → PDF mithilfe von OCR in bearbeitbares PDF konvertieren.

Wenn Ihre PDF-Datei gescannt oder bildbasiert ist, fügen Sie diesen Schritt hinzu, damit der Text vor der Extraktion durchsuchbar wird. Falls Ihre PDF-Datei bereits auswählbaren Text enthält, versuchen Sie, ein Wort in einem Texteditor zu kopieren. Sie können dann direkt zu Schritt 3 springen und den Dateiinhalt an „Text und Bilder extrahieren“ übergeben.

  1. Hinzufügen PDF4mePDF: PDF mithilfe von OCR in bearbeitbares PDF konvertierenDie
  2. Parameter:
  • Dateiinhalt *, Karte Dateiinhalt über den Pfad abrufen Ausgabe (die binäre PDF-Datei).
  • Dateiname *Geben Sie einen Namen ein, z. B. Test.pdf oder der Quelldateiname.
  • Qualitätstyp: Entwurf für normale PDFs (1 API-Aufruf pro Datei) oder Hoch für gescannte/bildbasierte PDFs (2 API-Aufrufe pro Seite).
  • OCR nur bei Bedarf: FALSCH immer OCR ausführen, oder Ja Überspringen, falls die PDF-Datei bereits durchsuchbar ist (spart API-Aufrufe).
  • Sprache: Auf die Sprache des Quelldokuments eingestellt (z.B. en) falls dies für eine bessere OCR-Genauigkeit erforderlich ist.
  • Ist asynchron: NEIN für synchrone Abläufe (empfohlen für Datenflüsse).
  1. Verbindung: Verbunden mit PDF4me PDFDie
PDF in bearbeitbares PDF konvertieren (OCR): Dateiinhalt aus Datei abrufen, Dateiname: Test.pdf, Qualitätstyp: Entwurf, OCR nur bei Bedarf: false, Sprache: false, Asynchron: Nein

Schritt 3: Text und Bilder extrahieren.

Bisheriger Ablauf: … → PDF mithilfe von OCR in bearbeitbares PDF konvertieren → Text und Bilder extrahieren.

  1. Hinzufügen PDF4mePDF: Text und Bilder extrahierenDie
  2. Parameter:
  • Dateiinhalt *Ordnen Sie die Ausgabe von PDF, PDF mithilfe von OCR in bearbeitbares PDF konvertieren (oder direkt von Dateiinhalt abrufen (falls Sie die OCR-Funktion übersprungen haben).
  • Dateiname *Geben Sie einen Namen ein, z. B. New.pdf oder der Quelldateiname.
  • Text aus dem Text extrahieren: Ja Text extrahieren.
  • Bilder extrahieren: Ja um eingebettete Bilder zu extrahieren (oder NEIN (falls Sie nur den Text benötigen).
  1. Verbindung: Verbunden mit PDF4me PDFDie
Text und Bilder extrahieren: Dateiinhalt aus dem OCR-Schritt, Dateiname New.pdf, Text extrahieren: Ja, Bilder extrahieren: Ja

Ausgabe: Die Handlung kehrt zurück Körper mit:

  • Texte: Array von Zeichenketten mit dem gesamten extrahierten Text (Zeilenumbrüche als \n).
  • Bilder: Array von Objekten: fileName (z.B. page001_image001.jpg) Und streamFile (Base64). Verwenden Sie diese in nachfolgenden Aktionen, um die Bilder zu speichern oder zu verarbeiten.
Rohe JSON-Ausgabe: Statuscode 200, Body mit einem Array von Texten und einem Array von Bildern (Dateiname, Streamdatei)

Parameter- und Ausgabereferenz.

Hier ist eine kurze Übersicht der von uns verwendeten Komponenten. Passen Sie diese an Ihre Konfiguration an.

SchrittParameterWertAnmerkungen
Datei abrufenDateipfad/pdf4metest/extracttext/...Ihr Dropbox-Pfad
Datei abrufenInhaltstyp ableitenJaHilft Power Automate bei der Verarbeitung der Datei
OCRQualitätstypEntwurfVerwenden Hoch für schwierig zu scannende Dokumente
OCROCR nur bei BedarfFALSCHAuf einstellen Ja um API-Aufrufe zu sparen, wenn der Text bereits durchsuchbar ist
ExtraktText/Bilder extrahierenJa / JaSchalten Sie alles ab, was Sie nicht benötigen, um den Vorgang zu beschleunigen.
Ausgabebody.textsArray von ZeichenkettenDer gesamte extrahierte Text
Ausgabebody.imagesDateiname, StreamdateiBase64-Bilddaten für jedes Bild

Die vollständigen Parameterdetails finden Sie unter Text und Bilder extrahieren: Power Automate Und PDF mithilfe von OCR in bearbeitbares PDF konvertierenDie


Fehlerbehebung.

Manchmal läuft etwas schief. Folgendes hilft normalerweise:

"Datei ist leer" oder "Datei konnte nicht geöffnet werden"

Das bedeutet in der Regel, dass das falsche Feld zugeordnet wurde. Verwenden Sie das Feld, das die tatsächlichen Daten enthält. DateiinhaltNicht der Pfad oder eine Referenz. Die Dropdown-Liste von Power Automate kann hier problematisch sein. Siehe Zapier- und Power Automate-Tipps für Base64- und Dateiverarbeitung.

Senden einer JPG- oder PNG-Datei anstelle einer PDF-Datei

Zum Extrahieren von Text und Bildern wird eine PDF-Datei benötigt. Falls Ihre Quelle ein Bild ist, konvertieren Sie es zuerst mit In PDF konvertierenÜbergeben Sie dann das Ergebnis.

401, 402 oder andere Fehler

Überprüfen PDF4me-Fehlerbehebung für 401 (API-Schlüssel), 402 (Guthaben) und plattformspezifische Korrekturen.


Testen Sie die API interaktiv.

Testen Sie die Extract Text and Images API ohne Power Automate mit unserem API-Tests: Laden Sie eine PDF-Datei hoch und sehen Sie sich die Antwort an:


Nächste Schritte.

Du hast es fast geschafft.
  • Legen Sie eine Test-PDF-Datei in Ihren Ordner und führen Sie den Workflow aus. Überprüfen Sie anschließend die... Körper Ausgabe für Texte Und BilderDie
  • Füttern Texte in Compose, Parse JSON oder Conditions; verwenden Bilder mit Datei erstellen oder einer beliebigen Speicheraktion.
  • Tauschen Manuell auslösen für Wenn eine Datei erstellt wird (Dropbox) und den Dateipfad des Triggers mit diesem verbinden Dateiinhalt abrufen für die vollautomatische Bedienung.