Aller au contenu principal

Un article tagués avec « extract-text-from-pdf »

Voir tous les tags

Convertir un PDF en fichier texte dans Power Automate : Transformez vos contrats numérisés en un corpus SharePoint consultable avec PDF4me

· 29 minutes de lecture
SEO and Content Writer

PDF4me Extraire du texte et des images Cette action Power Automate renvoie la couche texte d'un PDF sous forme de tableau. Associée à la reconnaissance optique de caractères (OCR) en amont et à une jointure Compose en aval, cette opération transforme chaque PDF déposé dans une bibliothèque SharePoint en un document correspondant. .txt Fichier prêt pour la recherche par IA.

Recherchez comment faire cela et le premier résultat est celui de Microsoft. Référence des actions PDF, qui décrit Power Automate Ordinateur de bureau Ces actions n'existent pas dans un flux cloud. Ce détail explique pourquoi les deux résultats suivants sont une discussion Reddit et une discussion de la communauté Power Platform où des utilisateurs posent la même question sans obtenir de réponse claire. Ce flux constitue la réponse directe et s'exécute entièrement dans le cloud sur des connecteurs de niveau standard.

Aperçu du flux
1. When a file is created (properties only)
SharePoint trigger on the library, scoped to the RagInput folder. Returns metadata, not bytes.
2. Get file content
Fetches the actual PDF bytes using the identifier the trigger handed over.
3. Convert PDF to editable PDF using OCR
Adds a text layer to scans. OCR Only When Needed skips PDFs that already have one.
4. Extract Text and Images
Returns the text as an array. Extract Images stays No.
5. Compose
join() flattens the texts array into one newline separated string.
6. Create file
SharePoint writes the string to /Shared Documents/RagText as .txt.