Estrai la tabella da PDF - Analizzatore di dati API
PDF4me Estrai tabella da PDF consente di estrarre strutture di tabelle e dati da PDF documenti. Questo API processi di servizio PDF file ed estrae il contenuto della tabella, la struttura e i dati da PDF documenti. Il API riceve PDF contenuto attraverso REST API chiamate, utilizzando Base64 Codifica per una trasmissione sicura. Grazie al supporto per l'output di dati strutturati e l'analisi tabellare, questa soluzione è ideale per flussi di lavoro di elaborazione dati e piattaforme di business intelligence.
Autenticazione del tuo API Richiesta
Per accedere al PDF4me REST API, ogni richiesta deve includere credenziali di autenticazione adeguate. L'autenticazione garantisce una comunicazione sicura e convalida la tua identità come utente autorizzato del REST API.
Caratteristiche principali
- Estrazione tabella: Estrai le strutture delle tabelle e i dati da PDF Documenti
- Output di dati strutturatiRecupera i dati delle tabelle in formati organizzati e strutturati per una facile integrazione.
- Conservazione della struttura della tabella: Mantenere il layout della tabella, le intestazioni, le righe e le relazioni tra le colonne
- Base64 Codifica: Trasmissione sicura del contenuto dei file tramite Base64 codifica
- Semplice API Integrazione: RESTful API progettato per flussi di lavoro automatizzati di estrazione dati dalle tabelle
REST API Punto finale
IL PDF4me REST API utilizza standard HTTP metodi per interagire con le risorse. Tutte le operazioni di estrazione delle tabelle vengono eseguite tramite un unico endpoint:
- Metodo: POST
- Punto finale:
/api/v2/ExtractTableFromPdf
REST API Parametri
Elenco completo dei parametri per la tabella di estrazione da PDF REST APII parametri sono organizzati per categoria per una migliore comprensione e implementazione.
Importante: I parametri contrassegnati da un asterisco (*) sono obbligatori e devono essere forniti per il API per funzionare correttamente.
Parametri richiesti
| Parametro | Tipo | Descrizione | Esempio |
|---|---|---|---|
| docName* | String | Fonte PDF Nome del file con estensione .pdf corretta per l'identificazione del documento e l'estrazione della tabella | output.pdf |
| docContent* | Base64 String) | Il contenuto dell'input PDF file codificato in Base64 formato per l'analisi delle tabelle e l'estrazione dei dati | JVBERi... |
Parametri opzionali
| Parametro | Tipo | Descrizione | Esempio |
|---|---|---|---|
| async | Boolean | Abilita l'elaborazione asincrona. Quando true, IL API resi 202 Accepted con un Location intestazione per il sondaggio del risultato | true |
Produzione
IL PDF4me Estrai tabella da PDF REST API restituisce risposte diverse a seconda della modalità di elaborazione. API restituisce i dati della tabella estratti come un JSON risposta.
- Success Response
- Asynchronous Processing
- Error Responses
- Response Format Details
Elaborazione sincrona (impostazione predefinita)
Quando async È false o non fornito, il API restituisce immediatamente i dati della tabella estratti.
Codice di stato: 200 OK
Formato di risposta:
{
"tables": [
{
"rows": [
["Header 1", "Header 2", "Header 3"],
["Data 1", "Data 2", "Data 3"],
["Data 4", "Data 5", "Data 6"]
],
"columns": 3,
"rows": 3
}
]
}
La risposta contiene una serie di tabelle, ciascuna con righe, colonne e dati nelle celle.
Elaborazione asincrona
Quando async È true, IL API elabora il documento in modo asincrono.
Risposta iniziale:
Codice di stato: 202 Accepted
Intestazioni di risposta:
Location: https://api.pdf4me.com/api/v2/ExtractTableFromPdfStatus/{operationId}
Corpo della risposta:
{
"traceId": "operation-trace-id"
}
Sondaggio per i risultati:
Utilizzare il Location intestazione URL per votare il completamento:
const response = await fetch(locationUrl, {
headers: { 'Authorization': 'Basic ' + apiKey }
});
// Continue polling until status code is 200
if (response.status === 200) {
const result = await response.json();
// Process extracted table data
}
Risposte di errore
| Codice di stato | Descrizione | Esempio di risposta |
|---|---|---|
| 400 Bad Request | Parametri di richiesta non validi o campi obbligatori mancanti | {"error": "Missing required parameter: docContent"} |
| 401 Unauthorized | Non valido o mancante API chiave | {"error": "Unauthorized"} |
| 408 Timeout della richiesta | Timeout di elaborazione della richiesta | {"error": "Request timeout"} |
| 500 Internal Server Error | Errore del server durante l'elaborazione | {"error": "Internal server error"} |
Comprendere il JSON Risposta
La risposta di estrazione della tabella è una JSON oggetto contenente:
- tavoli: Array degli oggetti della tabella
- file: Array di array che rappresentano le righe della tabella (ogni riga è un array di valori di cella)
- colonne: Numero di colonne nella tabella
- file: Numero di righe nella tabella
Struttura della tabella:
Ciascuna tabella è rappresentata come un array bidimensionale in cui:
- L'array esterno rappresenta le righe
- Gli array interni rappresentano le celle in ciascuna riga
- La prima riga in genere contiene le intestazioni di colonna
Esempio di richiesta
Intestazione
Content-Type: application/json
Authorization: Basic YOUR_BASE64_ENCODED_API_KEY
Nota:
- Ottieni il tuo API chiave dalla PDF4me Pannello di controllo
- IL API la chiave deve essere Base64 codificato e prefissato con "Basic" nel Authorization intestazione
- Esempio: se il tuo API la chiave è
abc123, codificalo in Base64 e utilizzareAuthorization: Basic YWJjMTIz
Carico utile
Richiesta di base:
{
"docContent": "JVBERi0xLjQKJeLjz9MKMSAwIG9iago8PAovVHlwZSAvQ2F0YWxvZwovUGFnZXMgMiAwIFIKPj4KZW5kb2JqCjIgMCBvYmoKPDwKL1R5cGUgL1BhZ2VzCi9LaWRzIFszIDAgUl0KL0NvdW50IDEKPD4KZW5kb2JqCjMgMCBvYmoKPDwKL1R5cGUgL1BhZ2UKL1BhcmVudCAyIDAgUgovTWVkaWFCb3ggWzAgMCA2MTIgNzkyXQovUmVzb3VyY2VzIDw8Ci9Gb250IDw8Ci9GMSA0IDAgUgo+Pgo+PgovQ29udGVudHMgNSAwIFIKPj4KZW5kb2JqCjQgMCBvYmoKPDwKL1R5cGUgL0ZvbnQKL1N1YnR5cGUgL1R5cGUxCi9CYXNlRm9udCAvSGVsdmV0aWNhCj4+CmVuZG9iago1IDAgb2JqCjw8Ci9MZW5ndGggNDQKPj4Kc3RyZWFtCkJUCi9GMSAxMiBUZgoxMDAgNzAwIFRkCihIZWxsbyBXb3JsZCkgVGoKRVQKZW5kc3RyZWFtCmVuZG9iagp4cmVmCjAgNgowMDAwMDAwMDAwIDY1NTM1IGYgCjAwMDAwMDAwMDkgMDAwMDAgbiAKMDAwMDAwMDA1NCAwMDAwMCBuIAowMDAwMDAwMTAxIDAwMDAwIG4gCjAwMDAwMDAxNzAgMDAwMDAgbiAKMDAwMDAwMDI0NCAwMDAwMCBuIAp0cmFpbGVyCjw8Ci9TaXplIDYKL1Jvb3QgMSAwIFIKPj4Kc3RhcnR4cmVmCjM0MQolJUVPRg==",
"docName": "output.pdf"
}
Con elaborazione asincrona:
{
"docContent": "JVBERi0xLjQKJeLjz9MK...",
"docName": "output.pdf",
"async": true
}
Esempi di codice
IL PDF4me Estrai tabella da PDF REST API Fornisce esempi di codice in diversi linguaggi di programmazione. Scegli il linguaggio più adatto al tuo ambiente di sviluppo:
- C#
- Java
- JavaScript
- Python
- Salesforce
- n8n
- Google Script
- AWS Lambda
Java Campione
Java implementazione con gestione completa degli errori ed elaborazione delle risposte:
JavaScript Campione
Node.js e compatibile con i browser JavaScript implementazione:
Google Apps Script Campione
Google Apps Script implementazione per Google Workspace integrazione:
Caratteristiche di estrazione della tabella
Capacità di estrazione dati
- Recupero completo del tavolo: Estrai tutti i dati della tabella da PDF documenti con conservazione accurata della struttura
- Riconoscimento dell'intestazione: Identificare e preservare le intestazioni di tabella, i nomi delle colonne e le etichette di riga
- Estrazione del contenuto cellulareEstrarre il contenuto delle singole celle con i tipi di dati e la formattazione appropriati.
- Analisi della struttura della tabella: Mantenere il layout della tabella, le relazioni e la struttura gerarchica
Elaborazione avanzata
- Supporto multi-tavolo: Elabora più tabelle all'interno di una singola PDF documento
- Gestione complessa dei tavoliEstrarre tabelle con celle unite, righe che si estendono su più righe e layout complessi
- Conservazione del formato: Mantenere la formattazione, lo stile e l'aspetto visivo originali della tabella.
- Validazione dei dati: Garantire l'integrità e l'accuratezza dei dati durante il processo di estrazione
Funzionalità professionali
- Output strutturatoGenera dati organizzati e strutturati per una facile integrazione
- Elaborazione in batch: Elabora più PDFs e estrarre tabelle in modo efficiente
- Garanzia di qualitàGarantire l'accuratezza e l'affidabilità dell'estrazione dati per le applicazioni aziendali.
- Integrazione aziendaleIntegrazione perfetta con i sistemi di gestione dei dati esistenti
Casi d'uso e applicazioni industriali
- Business Intelligence & Analytics
- Document Management & Processing
- Data Migration & Integration
- Research & Analysis
- Compliance & Regulatory
- Healthcare & Medical
Casi d'uso di Business Intelligence e Analytics
- Rendicontazione finanziariaEstrarre tabelle finanziarie dai report per l'analisi dei dati e la creazione di report
- Metriche di prestazione: Elabora tabelle KPI e dashboard delle prestazioni per la business intelligence
- Data WarehousingEstrazione di dati strutturati da documenti per il popolamento del data warehouse
- Analisi aziendale: Converti PDF convertire le tabelle in formati di dati analizzabili per ottenere informazioni utili.
Casi d'uso per la gestione e l'elaborazione dei documenti
- Elaborazione delle fattureEstrarre le voci e le tabelle dei prezzi dalle fatture per l'elaborazione automatizzata.
- Analisi dei contrattiEstrarre le tabelle dei termini e delle condizioni dai documenti legali
- Digitalizzazione dei report: Convertire i report cartacei in dati digitali ricercabili
- Gestione dei contenutiEstrazione di dati strutturati da documenti per sistemi di gestione dei contenuti
Casi d'uso per la migrazione e l'integrazione dei dati
- Migrazione del sistemaEstrazione dei dati delle tabelle durante le migrazioni di sistema e i trasferimenti di dati
- Conversione dei dati legacy: Convertire documenti storici in formati di dati moderni
- API Integrazione: Estrarre dati per l'integrazione con sistemi di terze parti e APIs
- Popolazione del database: Popola i database con dati strutturati da PDF Documenti
Casi d'uso per la ricerca e l'analisi
- Ricerca accademicaEstrarre tabelle di dati da articoli di ricerca e pubblicazioni accademiche
- Ricerca di mercato: Risultati del sondaggio di processo e tabelle di analisi di mercato
- Dati scientificiEstrarre dati sperimentali e risultati di ricerca da documenti scientifici
- Analisi statistica: Converti PDF trasformando le tabelle in strumenti di analisi statistica
Casi d'uso relativi alla conformità e alla regolamentazione.
- Segnalazione normativaEstrarre i dati di conformità da documenti e rapporti normativi
- Supporto alla conformità: Elaborare tabelle finanziarie e registri di controllo per la verifica della conformità
- Scoperta legaleEstrarre dati strutturati da documenti legali per i processi di discovery
- Analisi delle politicheEstrarre le tabelle delle politiche e i requisiti normativi per l'analisi
Casi d'uso in ambito sanitario e medico
- Cartelle clinicheEstrarre tabelle di dati dei pazienti da referti e cartelle cliniche
- Studi clinici: Dati di ricerca sul processo e risultati delle sperimentazioni cliniche
- richieste di risarcimento assicurativoEstrarre le tabelle di fatturazione e le informazioni relative alle richieste di rimborso.
- Ricerca medicaConvertire i dati della ricerca medica in formati analizzabili