Passa al contenuto principale

Estrai la tabella da PDF - Analizzatore di dati API

PDF4me Estrai tabella da PDF consente di estrarre strutture di tabelle e dati da PDF documenti. Questo API processi di servizio PDF file ed estrae il contenuto della tabella, la struttura e i dati da PDF documenti. Il API riceve PDF contenuto attraverso REST API chiamate, utilizzando Base64 Codifica per una trasmissione sicura. Grazie al supporto per l'output di dati strutturati e l'analisi tabellare, questa soluzione è ideale per flussi di lavoro di elaborazione dati e piattaforme di business intelligence.

Articoli correlati del blog
Non ci sono ancora post sul blog dedicati a questa funzionalità — in arrivo a breve.
Nel frattempo, dai un'occhiata al blog di PDF4me per trovare tutorial e procedure operative su tutte le piattaforme.
Visita il blog

Autenticazione del tuo API Richiesta

Per accedere al PDF4me REST API, ogni richiesta deve includere credenziali di autenticazione adeguate. L'autenticazione garantisce una comunicazione sicura e convalida la tua identità come utente autorizzato del REST API.

Caratteristiche principali

  • Estrazione tabella: Estrai le strutture delle tabelle e i dati da PDF Documenti
  • Output di dati strutturatiRecupera i dati delle tabelle in formati organizzati e strutturati per una facile integrazione.
  • Conservazione della struttura della tabella: Mantenere il layout della tabella, le intestazioni, le righe e le relazioni tra le colonne
  • Base64 Codifica: Trasmissione sicura del contenuto dei file tramite Base64 codifica
  • Semplice API Integrazione: RESTful API progettato per flussi di lavoro automatizzati di estrazione dati dalle tabelle

REST API Punto finale

IL PDF4me REST API utilizza standard HTTP metodi per interagire con le risorse. Tutte le operazioni di estrazione delle tabelle vengono eseguite tramite un unico endpoint:

  • Metodo: POST
  • Punto finale: /api/v2/ExtractTableFromPdf

REST API Parametri

Elenco completo dei parametri per la tabella di estrazione da PDF REST APII parametri sono organizzati per categoria per una migliore comprensione e implementazione.

Importante: I parametri contrassegnati da un asterisco (*) sono obbligatori e devono essere forniti per il API per funzionare correttamente.

Parametri richiesti

ParametroTipoDescrizioneEsempio
docName*StringFonte PDF Nome del file con estensione .pdf corretta per l'identificazione del documento e l'estrazione della tabellaoutput.pdf
docContent*Base64 String)Il contenuto dell'input PDF file codificato in Base64 formato per l'analisi delle tabelle e l'estrazione dei datiJVBERi...

Parametri opzionali

ParametroTipoDescrizioneEsempio
asyncBooleanAbilita l'elaborazione asincrona. Quando true, IL API resi 202 Accepted con un Location intestazione per il sondaggio del risultatotrue

Produzione

IL PDF4me Estrai tabella da PDF REST API restituisce risposte diverse a seconda della modalità di elaborazione. API restituisce i dati della tabella estratti come un JSON risposta.

Elaborazione sincrona (impostazione predefinita)

Quando async È false o non fornito, il API restituisce immediatamente i dati della tabella estratti.

Codice di stato: 200 OK

Formato di risposta:

{
"tables": [
{
"rows": [
["Header 1", "Header 2", "Header 3"],
["Data 1", "Data 2", "Data 3"],
["Data 4", "Data 5", "Data 6"]
],
"columns": 3,
"rows": 3
}
]
}

La risposta contiene una serie di tabelle, ciascuna con righe, colonne e dati nelle celle.

Esempio di richiesta

Intestazione

Content-Type: application/json
Authorization: Basic YOUR_BASE64_ENCODED_API_KEY

Nota:

  • Ottieni il tuo API chiave dalla PDF4me Pannello di controllo
  • IL API la chiave deve essere Base64 codificato e prefissato con "Basic" nel Authorization intestazione
  • Esempio: se il tuo API la chiave è abc123, codificalo in Base64 e utilizzare Authorization: Basic YWJjMTIz

Carico utile

Richiesta di base:

{
"docContent": "JVBERi0xLjQKJeLjz9MKMSAwIG9iago8PAovVHlwZSAvQ2F0YWxvZwovUGFnZXMgMiAwIFIKPj4KZW5kb2JqCjIgMCBvYmoKPDwKL1R5cGUgL1BhZ2VzCi9LaWRzIFszIDAgUl0KL0NvdW50IDEKPD4KZW5kb2JqCjMgMCBvYmoKPDwKL1R5cGUgL1BhZ2UKL1BhcmVudCAyIDAgUgovTWVkaWFCb3ggWzAgMCA2MTIgNzkyXQovUmVzb3VyY2VzIDw8Ci9Gb250IDw8Ci9GMSA0IDAgUgo+Pgo+PgovQ29udGVudHMgNSAwIFIKPj4KZW5kb2JqCjQgMCBvYmoKPDwKL1R5cGUgL0ZvbnQKL1N1YnR5cGUgL1R5cGUxCi9CYXNlRm9udCAvSGVsdmV0aWNhCj4+CmVuZG9iago1IDAgb2JqCjw8Ci9MZW5ndGggNDQKPj4Kc3RyZWFtCkJUCi9GMSAxMiBUZgoxMDAgNzAwIFRkCihIZWxsbyBXb3JsZCkgVGoKRVQKZW5kc3RyZWFtCmVuZG9iagp4cmVmCjAgNgowMDAwMDAwMDAwIDY1NTM1IGYgCjAwMDAwMDAwMDkgMDAwMDAgbiAKMDAwMDAwMDA1NCAwMDAwMCBuIAowMDAwMDAwMTAxIDAwMDAwIG4gCjAwMDAwMDAxNzAgMDAwMDAgbiAKMDAwMDAwMDI0NCAwMDAwMCBuIAp0cmFpbGVyCjw8Ci9TaXplIDYKL1Jvb3QgMSAwIFIKPj4Kc3RhcnR4cmVmCjM0MQolJUVPRg==",
"docName": "output.pdf"
}

Con elaborazione asincrona:

{
"docContent": "JVBERi0xLjQKJeLjz9MK...",
"docName": "output.pdf",
"async": true
}

Esempi di codice

IL PDF4me Estrai tabella da PDF REST API Fornisce esempi di codice in diversi linguaggi di programmazione. Scegli il linguaggio più adatto al tuo ambiente di sviluppo:

C# Esempio (CSharp)

Completo C# implementazione per l'estrazione di tabelle da PDF:

Caratteristiche di estrazione della tabella

Capacità di estrazione dati

  • Recupero completo del tavolo: Estrai tutti i dati della tabella da PDF documenti con conservazione accurata della struttura
  • Riconoscimento dell'intestazione: Identificare e preservare le intestazioni di tabella, i nomi delle colonne e le etichette di riga
  • Estrazione del contenuto cellulareEstrarre il contenuto delle singole celle con i tipi di dati e la formattazione appropriati.
  • Analisi della struttura della tabella: Mantenere il layout della tabella, le relazioni e la struttura gerarchica

Elaborazione avanzata

  • Supporto multi-tavolo: Elabora più tabelle all'interno di una singola PDF documento
  • Gestione complessa dei tavoliEstrarre tabelle con celle unite, righe che si estendono su più righe e layout complessi
  • Conservazione del formato: Mantenere la formattazione, lo stile e l'aspetto visivo originali della tabella.
  • Validazione dei dati: Garantire l'integrità e l'accuratezza dei dati durante il processo di estrazione

Funzionalità professionali

  • Output strutturatoGenera dati organizzati e strutturati per una facile integrazione
  • Elaborazione in batch: Elabora più PDFs e estrarre tabelle in modo efficiente
  • Garanzia di qualitàGarantire l'accuratezza e l'affidabilità dell'estrazione dati per le applicazioni aziendali.
  • Integrazione aziendaleIntegrazione perfetta con i sistemi di gestione dei dati esistenti

Casi d'uso e applicazioni industriali

Casi d'uso di Business Intelligence e Analytics

  • Rendicontazione finanziariaEstrarre tabelle finanziarie dai report per l'analisi dei dati e la creazione di report
  • Metriche di prestazione: Elabora tabelle KPI e dashboard delle prestazioni per la business intelligence
  • Data WarehousingEstrazione di dati strutturati da documenti per il popolamento del data warehouse
  • Analisi aziendale: Converti PDF convertire le tabelle in formati di dati analizzabili per ottenere informazioni utili.

Richiedi assistenza