Passa al contenuto principale

Estrarre testo da PDF in Power Automate: inclusi documenti scansionati e basati su immagini

· 14 minuti di lettura
SEO and Content Writer

Hai dei PDF in Dropbox, SharePoint o via email, alcuni sono testo semplice, altri sono scansionati o basati su immagini, e hai bisogno che il testo venga esportato in un flusso unico e affidabile. Il problema è: I PDF basati su immagini non contengono testo selezionabile.. Prima hanno bisogno dell'OCR. Una volta che sono ricercabili, PDF4me estrae testo e immagini attira tutto dentro una chiamata: nessuna seconda lettura, nessun credito API sprecato.

Questa guida ti illustra un flusso che gestisce entrambi gli aspetti: grillettoottenere il contenuto del file (Dropbox) → Convertire un PDF in un PDF modificabile utilizzando la tecnologia OCR. (per documenti scansionati) → Estrai testo e immagini (PDF4me). Riceverai la struttura di output esatta e i link per la risoluzione dei problemi e per provare l'API in autonomia.

Perché una singola chiamata può fare la differenza.

Quando si creano flussi che dividono documenti, rinominano file o instradano contenuti, spesso è necessario estrarre testo e immagini da ogni PDF. Rileggere ogni documento in un ciclo consuma un gran numero di chiamate API e rallenta i flussi. Estrai testo e immagini Restituisce sia il contenuto testuale che le immagini incorporate in un'unica risposta. Ottieni tutto ciò di cui hai bisogno: testo, nomi dei file immagine e dati immagine in formato Base64, in modo che le operazioni successive possano rinominare, instradare o archiviare i file senza ulteriori letture.

Per un consiglio: Devi dividere i PDF in base al codice a barre e rinominare ogni file in base al codice a barre? Usa Dividi il PDF tramite codice a barre: restituisce testo del codice a barre nella stessa risposta per ogni suddivisione, in modo da poter rinominare senza una seconda chiamata. Vedi il nostro Dividi PDF per codice a barre in Power Automate guida.

Di che cosa hai bisogno?

  • Power Automate, Open Power AutomateAccedi e crea un nuovo flusso cloud (istantaneo o automatizzato).
  • Chiave API di PDF4me, Ottieni la tua chiave API. Creerai una connessione quando aggiungerai le azioni PDF4me. È la prima volta? Vedi Collega PDF4me a Power Automate.
  • Dropbox, Lo usiamo per Ottieni il contenuto del fileSharePoint, OneDrive o qualsiasi altro connettore che fornisca contenuti di file funziona altrettanto bene.

Il flusso in sintesi (4 fasi).

  1. Avviare manualmente un flusso: Avvia il flusso su richiesta (oppure usa Quando viene creato un file in Dropbox per l'automazione).
  2. Ottieni il contenuto del file utilizzando il percorso (Dropbox): Recupera il PDF da un percorso come /pdf4metest/extracttext/image to pdf.pdf.
  3. PDF: Convertire un PDF in un PDF modificabile tramite OCR (PDF4me): Trasforma i PDF scansionati/basati su immagini in testo ricercabile. Salta questo passaggio se i tuoi PDF sono già ricercabili tramite testo.
  4. PDF: Estrai testo e immagini (PDF4me): Restituisce il testo completo e tutte le immagini incorporate in un'unica risposta.
Flusso di Power Automate: Attivazione manuale → Ottieni contenuto file → Converti in PDF modificabile tramite OCR → Estrai testo e immagini dal PDF

Ingresso: Un file PDF (con immagini o testo). Produzione: Contenuto testuale in texts array e immagini in images matrice con fileName E streamFile (Base64).

Esempio di PDF: Documento PDF di esempio con righe numerate (input basato su immagine)

Esempio di input: PDF basato su immagini con testo estraibile dopo l'OCR


Passaggio 1: Attiva + Ottieni il contenuto del file.

Flusso finora: Attiva → Ottieni il contenuto del file.

  1. Aggiungere Avviare manualmente un flusso (O Quando viene creato un file in Dropbox per l'automazione).
  2. Aggiungere DropboxOttieni il contenuto del file utilizzando il percorso.
  3. Parametri:
  • Percorso file *Inserisci il percorso del tuo PDF, ad esempio /pdf4metest/extracttext/image to pdf.pdfUtilizzare l'icona della cartella per sfogliare i file, se necessario.
  • Parametri avanzatiDedurre il tipo di contenuto: Imposta su .
  1. Connessione: Garantire Connesso a Dropbox.

L'output è il contenuto del file (binario). Mappalo a Contenuto del file nell'azione OCR (e successivamente in Estrai testo e immagini).

Dritta: Assicurati di mappare l'effettivo Contenuto del file output, non il percorso del file o i metadati. Power Automate a volte offre diverse opzioni nel menu a tendina; scegli quella che contiene il file binario.

Ottieni il contenuto del file: Percorso file /pdf4metest/extracttext/image in pdf.pdf, Deduzione del tipo di contenuto Sì

Passaggio 2: Convertire il PDF in PDF modificabile utilizzando l'OCR (per i PDF basati su immagini).

Flusso finora: Attiva → Ottieni il contenuto del file → Converti il PDF in PDF modificabile tramite OCR.

Se il tuo PDF è una scansione o un'immagine, aggiungi questo passaggio in modo che il testo diventi ricercabile prima dell'estrazione. Se il tuo PDF contiene già testo selezionabile, prova a copiare una parola in un lettore, puoi passare direttamente al passaggio 3 e passare il contenuto del file direttamente a Estrai testo e immagini.

  1. Aggiungere PDF4mePDF: Convertire un PDF in un PDF modificabile tramite OCR.
  2. Parametri:
  • Contenuto del file *Mappa Ottieni il contenuto del file utilizzando il percorso output (il file binario PDF).
  • Nome del file *Inserisci un nome come Test.pdf o il nome del file sorgente.
  • Tipo di qualità: Bozza per i PDF normali (1 chiamata API per file) o Alto per PDF scansionati/basati su immagini (2 chiamate API per pagina).
  • OCR solo quando necessario: falso per eseguire sempre l'OCR, oppure Per saltare questo passaggio se il PDF è già ricercabile (risparmiando così chiamate API).
  • Lingua: Imposta sulla lingua del documento sorgente (ad esempio en) se necessario per una maggiore precisione dell'OCR.
  • È asincrono: NO per la modalità sincrona (consigliata per i flussi).
  1. Connessione: Connesso a PDF4me PDF.
Converti PDF in PDF modificabile tramite OCR: Contenuto del file da Ottieni file, Nome file Test.pdf, Tipo di qualità Bozza, OCR solo quando necessario falso, Lingua, È asincrono No

Passaggio 3: Estrazione di testo e immagini.

Flusso finora: … → Convertire PDF in PDF modificabile tramite OCR → Estrarre testo e immagini.

  1. Aggiungere PDF4mePDF: Estrai testo e immagini.
  2. Parametri:
  • Contenuto del file *Mappa l'output da PDF, Convertire un PDF in un PDF modificabile utilizzando la tecnologia OCR (o direttamente da Ottieni il contenuto del file (se hai saltato l'OCR).
  • Nome del file *Inserisci un nome come New.pdf o il nome del file sorgente.
  • Testo estratto: estrarre il testo.
  • Estrai immagini: per estrarre le immagini incorporate (o NO (se hai bisogno solo di testo).
  1. Connessione: Connesso a PDF4me PDF.
Estrai testo e immagini: Contenuto del file dalla fase OCR, Nome file New.pdf, Estrai testo Sì, Estrai immagini Sì

Produzione: L'azione ritorna corpo con:

  • testi: Array di stringhe con tutto il testo estratto (interruzioni di riga come \n).
  • immagini: Array di oggetti: fileName (per esempio. page001_image001.jpg) E streamFile (Base64). Utilizzare questi valori nelle operazioni successive per salvare o elaborare le immagini.
Output JSON grezzo: statusCode 200, corpo con array di testi e array di immagini (fileName, streamFile)

Parametri e riferimento di output.

Ecco un breve riepilogo di ciò che abbiamo utilizzato. Modificate queste impostazioni in base alla vostra configurazione.

Fare un passoParametroValoreNote
Ottieni il filePercorso del file/pdf4metest/extracttext/...Il tuo percorso Dropbox
Ottieni il fileDedurre il tipo di contenutoAiuta Power Automate a gestire il file
OCRTipo di qualitàBozzaUtilizzo Alto per documenti scansionati complessi
OCROCR solo quando necessariofalsoImposta su per evitare chiamate API se il testo è già ricercabile
EstrarreEstrai testo/immaginiSì / SìDisattiva ciò che non ti serve per velocizzare le cose
Produzionetesto del corpoArray di stringheTutto il testo estratto
Produzioneimmagini del corponomefile, filestreamDati immagine in formato Base64 per ciascuna immagine

Per i dettagli completi dei parametri, vedere Estrazione di testo e immagini: Power Automate E Convertire un PDF in un PDF modificabile utilizzando la tecnologia OCR..


Risoluzione dei problemi.

A volte le cose vanno storte. Ecco cosa di solito risolve il problema:

"Il file è vuoto" oppure "Impossibile aprire il file"

Di solito significa che è stato mappato il campo sbagliato. Usa quello che contiene il valore effettivo. contenuto del file, non il percorso o un riferimento. Il menu a tendina di Power Automate può essere insidioso in questo caso. Vedi Suggerimenti su Zapier e Power Automate per Base64 e gestione dei file.

Invio di un file JPG o PNG anziché di un PDF

L'estrazione di testo e immagini richiede un PDF. Se la tua sorgente è un'immagine, convertila prima con Converti in PDF, quindi passa il risultato.

401, 402 o altri errori

Controllo Risoluzione dei problemi di PDF4me per gli errori 401 (chiave API), 402 (crediti) e correzioni specifiche della piattaforma.


Prova l'API in modalità interattiva.

Prova l'API di estrazione di testo e immagini senza Power Automate utilizzando il nostro Test APICarica un PDF e visualizza la risposta:


Prossimi passi.

Hai quasi finito.
  • Inserisci un PDF di prova nella tua cartella ed esegui il flusso, controlla il corpo output per testi E immagini.
  • Foraggio testi in Compose, Parse JSON o Conditions; usa immagini con Crea file o qualsiasi azione di archiviazione.
  • Scambio Attivazione manuale per Quando viene creato un file (Dropbox) e collega il percorso del file del trigger a Ottieni il contenuto del file per l'automazione senza intervento manuale.