Aller au contenu principal

Extraire du texte et des images dans Power Automate

PDF4me Extraire du texte et des images Cette action récupère tout le contenu textuel et les images intégrées depuis PDF documents dans Power Automate Pour une extraction de contenu complète. Cette fonctionnalité polyvalente offre un contrôle indépendant de l'extraction de texte et d'images, renvoyant le texte intégral sous forme de chaîne de caractères et les images sous forme de tableau d'objets, permettant ainsi la réutilisation du contenu, l'analyse des données, le traitement d'images et la distribution de contenu multiformat. Microsoft 365 flux de travail.

Articles de blog connexes(1)

Authentification de votre API Demande

Pour accéder au PDF4me Web API à travers Power AutomateChaque requête doit inclure des informations d'authentification valides. L'authentification garantit une communication sécurisée et valide votre identité en tant qu'utilisateur autorisé, permettant une intégration fluide entre vos Power Automate flux et PDF4meles puissants services d'extraction de contenu de [nom de l'entreprise].

Extraction de texte et d'images avec Power Automate

Caractéristiques principales

  • Extraction de texteRécupérer tout le contenu textuel de PDF documents
  • Extraction d'imagesExtraire toutes les images intégrées dans des fichiers séparés
  • Contrôle indépendantChoisissez d'extraire uniquement le texte, uniquement les images ou les deux.
  • Array SortirRecevoir les images sous forme de tableau pour itération et traitement
  • Traitement par lotsExtraire le contenu de plusieurs sources PDFs dans les flux de travail

Paramètres

Liste complète des paramètres de l'action Extraire le texte et les images. Configurez ces paramètres pour contrôler l'extraction du contenu.

Important: Les paramètres marqués d'un astérisque (***) sont obligatoires et doivent être fournis pour que l'action fonctionne correctement.

ParamètreTaperDescriptionExemple
Contenu du fichier***BinaireSource PDF Contenu du fichier
• Carte PDF fichier de sortie de l'action précédente
• Soutient PDFs de SharePoint, OneDrive, e-mail
• Peut être récupéré dynamiquement à partir des variables de flux
• Doit être valide PDF document
[File Content from Get File]
Nom***StringPDF Nom du document
• Source PDF Nom de fichier avec l'extension .pdf
• Utilisé pour le traitement de l'identification
• Doit inclure l'extension de fichier appropriée
• Prend en charge la dénomination dynamique à partir des flux
Document.pdf
Extraire les images***BooleanContrôle d'extraction d'images
Vrai - Extraire toutes les images intégrées
FAUX - Ignorer l'extraction d'images
• Définir sur faux si les images ne sont pas requises
• Réduit le traitement lorsque seul le texte est nécessaire
true
Extrait de texte***BooleanContrôle d'extraction de texte
Vrai - Extraire tout le contenu textuel
FAUX - Ignorer l'extraction de texte
• Définir sur faux si le texte n'est pas requis
• Réduit le traitement lorsque seules les images sont nécessaires
true

Sortir

Le PDF4me Extraire du texte et des images L'action renvoie des données de sortie complètes pour une transition fluide Power Automate intégration des flux :

Vue tableau

Données de réponse présentées sous forme de tableau structuré :

ParamètreTaperDescription
TextesStringContenu textuel complet extrait de PDF
ImagesArrayListe des images extraites renvoyée sous forme de tableau d'objets

Exemples de flux de travail

Le PDF4me Extraire du texte et des images action dans Power Automate propose des modèles de flux de travail complets conçus pour des scénarios d'entreprise réels :

Séparation et archivage automatisés du contenu

Transformez votre gestion de contenu grâce à l'extraction et au stockage automatisés :

Étapes complètes du flux de travail :

  1. DéclenchementDocument téléchargé dans le dossier de traitement
  2. Obtenir le document: Récupérer PDF depuis SharePoint
  3. Extrait de contenuExtraire à la fois le texte et les images
  4. Enregistrer le texteStocker le texte extrait dans un fichier texte de l'archive
  5. Appliquer à chaque imageParcourir les images extraites
  6. Enregistrer les images: Enregistrez chaque image individuellement dans le dossier images
  7. Créer un indexGénérer des métadonnées avec des références textuelles et d'images
  8. Mise à jour de la base de donnéesDétails et emplacements d'extraction des journaux

Avantages pour l'entreprise :

  • Sépare le contenu de plus de 200 éléments PDFs mensuel
  • Permet la gestion indépendante des textes et des images
  • Réduit la redondance du stockage de 60 %
  • Facilite la réutilisation et le détournement du contenu

Cas d'utilisation et applications industrielles

Cas d'utilisation dans le domaine de l'édition et des médias

  • Extraction de contenuExtraire du texte et des images pour réutiliser le contenu
  • Gestion des actifs numériquesSéparer et cataloguer les ressources documentaires
  • Migration de contenuExtraire le contenu pour la migration de la plateforme
  • Gestion des archivesOrganiser le contenu séparément pour un meilleur accès

Obtenez de l'aide