Estrarre risorse
Estrarre → Estrarre risorse
IL Estrarre risorse API estrae testo e/o immagini incorporate da un PDF. Tu invii il PDF COME Base64 docContent), docName, extractText (vero/falso), extractImages (vero/falso) e facoltativamente async. IL API resi JSON con testo e immagini estratti (Base64Utilizza il tester qui sotto per provarlo; maggiori dettagli sono disponibili nelle sezioni seguenti.
Prova le risorse di estrazione API
:::nota - Guida rapida
Punto finale: POST /api/v2/ExtractResources · Necessario: api-key, docContent, docName, extractText, extractImages
:::
Usa il modulo sottostante per inviare il tuo API chiave, PDF Base64), e scegliere se estrarre testo, immagini o entrambi. La risposta è JSON con testo e/o immagini in Base64Nessun codice richiesto: compila i campi e fai clic Invia richiesta.
Panoramica, parametri e casi d'uso
- Overview
- Parameters
- Use cases
Che cos'è Extract Resources?
Questo endpoint estrae il contenuto testuale e/o le immagini incorporate da un PDF. Scegli cosa estrarre tramite extractText E extractImages (entrambi booleani). Il API resi JSON con testo e immagini estratti (immagini in Base64Utilizzalo quando hai bisogno sia di testo che di immagini in una singola chiamata, oppure solo di uno dei due.
Caratteristiche principali
- Testo e/o immagini: extractText E extractImages ti permette di richiedere solo testo, solo immagini o entrambi.
- JSON risposta: Testo e immagini incorporate (Base64) in un formato strutturato.
- Asincrono: Utilizzo async per PDFs con molte pagine o molte immagini.
:::suggerimento Ideale per Usare quando si ha bisogno sia di testo che di immagini da un PDF in una richiesta. Per il solo testo con modelli regex utilizzare Estrai testo tramite espressione; per le tabelle utilizzare Estrai la tabella da PDF.
:::
API parametri
| Parametro | Tipo | Necessario | Descrizione |
|---|---|---|---|
| api-key | corda | SÌ | Tuo PDF4me API chiave, Base64 codificato. Prendilo da pannello di controllo. |
| docContent | base64 | SÌ | PDF contenuto del file (Base64). |
| docName | corda | SÌ | PDF Nome del file con estensione .pdf. |
| extractText | booleano | SÌ | Estrarre il contenuto testuale dal PDF. |
| extractImages | booleano | SÌ | Estrai le immagini incorporate da PDF. |
| async | booleano | NO | Abilita l'elaborazione asincrona. |
Quando utilizzare Extract Resources
- Estrazione del contenuto: Ottieni sia testo che immagini da un PDF in un unico invito all'analisi o al riutilizzo.
- Raccolta di immaginiEstrai le immagini incorporate (loghi, grafici) per riutilizzarle o indicizzarle.
- Testo + risorseConsente di raggruppare testo e immagini per la ricerca, l'archiviazione o la migrazione.
Per schemi di richiesta/risposta ed esempi di codice, vedere Estrarre risorse nel PDF4me API documenti.
Prerequisiti
Prima di utilizzare questo endpoint, assicurati di avere:
- Un valido PDF4me API chiave (Ottieni il tuo API Chiave)
- UN PDF documento in Base64 formato o pubblico URL a PDF file
Formato di risposta
IL API restituisce un JSON risposta con contenuto testuale estratto e immagini incorporate in Base64 formato.