Zum Hauptinhalt springen

Text und Bilder extrahieren in Power Automate

PDF4me Text und Bilder extrahieren Die Aktion ruft alle Textinhalte und eingebetteten Bilder ab von PDF Dokumente in Power Automate Für die umfassende Extraktion von Inhalten. Diese vielseitige Funktion bietet unabhängige Kontrolle über die Extraktion von Text und Bildern und gibt Volltext als Zeichenkette und Bilder als Array von Objekten zurück. Dies ermöglicht die Wiederverwendung von Inhalten, Datenanalyse, Bildverarbeitung und die Verteilung von Inhalten in verschiedenen Formaten. Microsoft 365 Arbeitsabläufe.

Verwandte Blog-Beiträge(1)

Authentifizierung Ihres API Anfrage

Um auf die PDF4me Web API durch Power AutomateJede Anfrage muss die entsprechenden Authentifizierungsdaten enthalten. Die Authentifizierung gewährleistet eine sichere Kommunikation und bestätigt Ihre Identität als autorisierter Benutzer, wodurch eine nahtlose Integration zwischen Ihren Systemen ermöglicht wird. Power Automate Flüsse und PDF4meleistungsstarke Dienste zur Inhaltsextraktion.

Text und Bilder extrahieren mit Power Automate

Hauptmerkmale

  • Textextraktion: Alle Textinhalte abrufen von PDF Dokumente
  • Bildextraktion: Alle eingebetteten Bilder als separate Dateien extrahieren
  • Unabhängige SteuerungWählen Sie aus, ob nur Text, nur Bilder oder beides extrahiert werden sollen.
  • Array Ausgabe: Bilder als Array zur Iteration und Verarbeitung empfangen.
  • Stapelverarbeitung: Inhalte aus mehreren Quellen extrahieren PDFs in Arbeitsabläufen

Parameter

Vollständige Liste der Parameter für die Aktion „Text und Bilder extrahieren“. Konfigurieren Sie diese Parameter, um die Inhaltsextraktion zu steuern.

Wichtig: Mit einem Sternchen (***) gekennzeichnete Parameter sind erforderlich und müssen angegeben werden, damit die Aktion ordnungsgemäß funktioniert.

ParameterTypBeschreibungBeispiel
Dateiinhalt***BinärQuelle PDF Dateiinhalt
• Karte PDF Datei aus der vorherigen Aktion Ausgabe
• Unterstützt PDFs von SharePoint, OneDrive, E-Mail
• Kann dynamisch aus Flussvariablen abgerufen werden
• Muss gültig sein PDF dokumentieren
[File Content from Get File]
Name***StringPDF Dokumentname
• Quelle PDF Dateiname mit der Erweiterung .pdf
• Wird zur Verarbeitung von Identifikationsdaten verwendet
• Die korrekte Dateiendung muss angegeben werden.
• Unterstützt dynamische Namensgebung aus Datenflüssen
Document.pdf
Bilder extrahieren***BooleanBildextraktionssteuerung
WAHR - Alle eingebetteten Bilder extrahieren
FALSCH - Bildextraktion überspringen
• Auf „false“ setzen, wenn keine Bilder benötigt werden
• Reduziert die Verarbeitungsgeschwindigkeit, wenn nur Text benötigt wird
true
Text extrahieren***BooleanTextextraktionskontrolle
WAHR - Den gesamten Textinhalt extrahieren
FALSCH - Textextraktion überspringen
• Auf „false“ setzen, wenn kein Text benötigt wird
• Reduziert die Verarbeitungsgeschwindigkeit, wenn nur Bilder benötigt werden
true

Ausgabe

Der PDF4me Text und Bilder extrahieren Die Aktion liefert umfassende Ausgabedaten für eine nahtlose Funktion. Power Automate Flussintegration:

Tabellenansicht

Antwortdaten in strukturierter Tabellenform:

ParameterTypBeschreibung
TexteStringVollständiger Textinhalt extrahiert aus PDF
BilderArrayListe der extrahierten Bilder, die als Array von Objekten zurückgegeben werden

Workflow-Beispiele

Der PDF4me Text und Bilder extrahieren Aktion in Power Automate bietet umfassende Workflow-Vorlagen, die für reale Geschäftsszenarien entwickelt wurden:

Automatisierte Inhaltstrennung und Archivierung

Transformieren Sie Ihr Content-Management mit automatisierter Extraktion und Speicherung:

Vollständige Arbeitsschritte:

  1. AuslösenDokument in den Verarbeitungsordner hochgeladen
  2. Dokument abrufen: Abrufen PDF aus SharePoint
  3. Inhalt extrahieren: Sowohl Text als auch Bilder extrahieren
  4. Text speichern: Speichere den extrahierten Text in einer Textdatei im Archiv
  5. Auf jedes Bild anwenden: Durchlaufe die extrahierten Bilder
  6. Bilder speichernSpeichern Sie jedes Bild einzeln im Bilderordner
  7. Index erstellen: Metadaten mit Text- und Bildreferenzen generieren
  8. Datenbank aktualisieren: Details und Speicherorte der Protokollextraktion

Geschäftliche Vorteile:

  • Trennt Inhalte von über 200 PDFmonatlich
  • Ermöglicht die unabhängige Verwaltung von Text und Bildern.
  • Reduziert die Speicherredundanz um 60 %
  • Ermöglicht die Wiederverwendung und Umnutzung von Inhalten

Branchenspezifische Anwendungsfälle und Anwendungen

Anwendungsfälle im Verlagswesen und in den Medien

  • Inhaltsextraktion: Text und Bilder zur Wiederverwendung von Inhalten extrahieren
  • Digitales Asset-Management: Dokumente trennen und katalogisieren
  • InhaltsmigrationInhalte für die Plattformmigration extrahieren
  • ArchivverwaltungInhalte separat organisieren, um einen besseren Zugriff zu ermöglichen

Hilfe erhalten