Estratto allegato da PDF - Recupero file API
PDF4me Estrai allegato da PDF consente di estrarre tutti gli allegati di file incorporati PDF documenti. Questo API processi di servizio PDF file ed estrae file incorporati, documenti e risorse da PDF documenti. Il API riceve PDF contenuto attraverso REST API chiamate, utilizzando Base64 codifica per la trasmissione sicura. Con supporto per l'estrazione di più tipi di file da PDF Per i documenti, questa soluzione è ideale per i sistemi di gestione documentale e i flussi di lavoro di estrazione file.
Autenticazione del tuo API Richiesta
Per accedere al PDF4me REST API, ogni richiesta deve includere credenziali di autenticazione adeguate. L'autenticazione garantisce una comunicazione sicura e convalida la tua identità come utente autorizzato del REST API.
Caratteristiche principali
- Estrazione file: Estrai tutti i file, i documenti e le risorse incorporati da PDF Documenti
- Diversi tipi di fileSupporto per vari formati di allegati, tra cui testo, immagini, documenti e archivi.
- Estrazione in batch: Estrai più allegati da un singolo PDF documento in un'unica operazione
- Base64 Codifica: Trasmissione sicura del contenuto dei file tramite Base64 codifica
- Semplice API Integrazione: RESTful API progettato per flussi di lavoro automatizzati di estrazione di documenti
REST API Punto finale
IL PDF4me REST API utilizza standard HTTP Metodi per interagire con le risorse. Tutte le operazioni di estrazione degli allegati vengono eseguite tramite un unico endpoint:
- Metodo: POST
- Punto finale:
/api/v2/ExtractAttachmentFromPdf
REST API Parametri
Elenco completo dei parametri per Estrai allegato da PDF REST APII parametri sono organizzati per categoria per una migliore comprensione e implementazione.
Importante: I parametri contrassegnati da un asterisco (*) sono obbligatori e devono essere forniti per il API per funzionare correttamente.
Parametri richiesti
| Parametro | Tipo | Descrizione | Esempio |
|---|---|---|---|
| docContent* | Base64 String) | Il contenuto dell'input PDF file codificato in Base64 formato per l'estrazione degli allegati e il recupero dei file | JVBERi... |
| docName* | String | Fonte PDF Nome del file con estensione .pdf corretta per l'identificazione del documento e l'estrazione degli allegati. | output.pdf |
Parametri opzionali
| Parametro | Tipo | Descrizione | Esempio |
|---|---|---|---|
| async | Boolean | Abilita l'elaborazione asincrona. Quando true, IL API resi 202 Accepted con un Location intestazione per il sondaggio del risultato | true |
Produzione
IL PDF4me Estrai allegato da PDF REST API restituisce risposte diverse a seconda della modalità di elaborazione. API restituisce i dati allegati estratti come un JSON risposta o come ZIP file Contiene tutti gli allegati estratti.
- Success Response
- Asynchronous Processing
- Error Responses
- Response Format Details
Elaborazione sincrona (impostazione predefinita)
Quando async È false o non fornito, il API restituisce immediatamente i risultati degli allegati estratti.
Codice di stato: 200 OK
Formato di risposta:
{
"outputDocuments": [
{
"fileName": "attachment1.txt",
"streamFile": "base64-encoded-file-content..."
},
{
"fileName": "attachment2.pdf",
"streamFile": "base64-encoded-file-content..."
}
]
}
La risposta contiene un array di allegati estratti, ciascuno con un fileName E streamFile Base64(contenuto codificato).
Elaborazione asincrona
Quando async È true, IL API elabora il documento in modo asincrono.
Risposta iniziale:
Codice di stato: 202 Accepted
Intestazioni di risposta:
Location: https://api.pdf4me.com/api/v2/ExtractAttachmentFromPdfStatus/{operationId}
Corpo della risposta:
{
"traceId": "operation-trace-id"
}
Sondaggio per i risultati:
Utilizzare il Location intestazione URL per votare il completamento:
const response = await fetch(locationUrl, {
headers: { 'Authorization': 'Basic ' + apiKey }
});
// Continue polling until status code is 200
if (response.status === 200) {
const result = await response.json();
// Process extracted attachments
}
Risposte di errore
| Codice di stato | Descrizione | Esempio di risposta |
|---|---|---|
| 400 Bad Request | Parametri di richiesta non validi o campi obbligatori mancanti | {"error": "Missing required parameter: docContent"} |
| 401 Unauthorized | Non valido o mancante API chiave | {"error": "Unauthorized"} |
| 408 Timeout della richiesta | Timeout di elaborazione della richiesta | {"error": "Request timeout"} |
| 500 Internal Server Error | Errore del server durante l'elaborazione | {"error": "Internal server error"} |
Comprendere il JSON Risposta
La risposta di estrazione è una JSON oggetto contenente un array di allegati estratti:
- outputDocumenti: Array degli oggetti allegati estratti
- Nome file: Il nome del file estratto
- streamFile: Base64-contenuto codificato del file estratto
Alternativa: ZIP Risposta al file
In alcuni casi, il API potrebbe restituire un ZIP file contenente tutti gli allegati estratti invece di JSON. IL ZIP Il file può essere scaricato ed estratto per accedere ai singoli file.
Codifica Base64 Contenuto:
Per decodificare il Base64-contenuto del file codificato da streamFile:
// JavaScript
const decoded = atob(base64String);
const blob = new Blob([decoded], { type: 'application/octet-stream' });
# Python
import base64
decoded = base64.b64decode(base64_string)
with open('extracted_file.txt', 'wb') as f:
f.write(decoded)
Esempio di richiesta
Intestazione
Content-Type: application/json
Authorization: Basic YOUR_BASE64_ENCODED_API_KEY
Nota:
- Ottieni il tuo API chiave dalla PDF4me Pannello di controllo
- IL API la chiave deve essere Base64 codificato e prefissato con "Basic" nel Authorization intestazione
- Esempio: se il tuo API la chiave è
abc123, codificalo in Base64 e utilizzareAuthorization: Basic YWJjMTIz
Carico utile
Richiesta di base:
{
"docContent": "JVBERi0xLjQKJeLjz9MKMSAwIG9iago8PAovVHlwZSAvQ2F0YWxvZwovUGFnZXMgMiAwIFIKPj4KZW5kb2JqCjIgMCBvYmoKPDwKL1R5cGUgL1BhZ2VzCi9LaWRzIFszIDAgUl0KL0NvdW50IDEKPD4KZW5kb2JqCjMgMCBvYmoKPDwKL1R5cGUgL1BhZ2UKL1BhcmVudCAyIDAgUgovTWVkaWFCb3ggWzAgMCA2MTIgNzkyXQovUmVzb3VyY2VzIDw8Ci9Gb250IDw8Ci9GMSA0IDAgUgo+Pgo+PgovQ29udGVudHMgNSAwIFIKPj4KZW5kb2JqCjQgMCBvYmoKPDwKL1R5cGUgL0ZvbnQKL1N1YnR5cGUgL1R5cGUxCi9CYXNlRm9udCAvSGVsdmV0aWNhCj4+CmVuZG9iago1IDAgb2JqCjw8Ci9MZW5ndGggNDQKPj4Kc3RyZWFtCkJUCi9GMSAxMiBUZgoxMDAgNzAwIFRkCihIZWxsbyBXb3JsZCkgVGoKRVQKZW5kc3RyZWFtCmVuZG9iagp4cmVmCjAgNgowMDAwMDAwMDAwIDY1NTM1IGYgCjAwMDAwMDAwMDkgMDAwMDAgbiAKMDAwMDAwMDA1NCAwMDAwMCBuIAowMDAwMDAwMTAxIDAwMDAwIG4gCjAwMDAwMDAxNzAgMDAwMDAgbiAKMDAwMDAwMDI0NCAwMDAwMCBuIAp0cmFpbGVyCjw8Ci9TaXplIDYKL1Jvb3QgMSAwIFIKPj4Kc3RhcnR4cmVmCjM0MQolJUVPRg==",
"docName": "output.pdf"
}
Con elaborazione asincrona:
{
"docContent": "JVBERi0xLjQKJeLjz9MK...",
"docName": "output.pdf",
"async": true
}
Esempi di codice
IL PDF4me Estrai allegato da PDF REST API Fornisce esempi di codice in diversi linguaggi di programmazione. Scegli il linguaggio più adatto al tuo ambiente di sviluppo:
- C#
- Java
- JavaScript
- Python
- Salesforce
- n8n
- Google Script
- AWS Lambda
C# Esempio (CSharp)
Completo C# implementazione per l'estrazione degli allegati da PDF:
Java Campione
Java implementazione con gestione completa degli errori ed elaborazione delle risposte:
JavaScript Campione
Node.js e compatibile con i browser JavaScript implementazione:
Google Script Campione
Google Apps Script implementazione per Google Workspace integrazione:
Caratteristiche di estrazione degli accessori
Funzionalità di recupero file
- Estrazione completa: Estrai tutti i file e le risorse incorporati da PDF Documenti
- Tipo di file Rilevamento: Identificazione automatica dei tipi e dei formati di file incorporati
- Conservazione dei metadati: Mantenere i nomi dei file originali, le date di creazione e le proprietà
- Garanzia di qualità: Garantire l'integrità dei file e la corretta estrazione senza danneggiamenti
Elaborazione dei documenti
- PDF Analisi: Analisi approfondita di PDF struttura per posizionare gli accessori incorporati
- Identificazione delle risorseRilevamento intelligente di vari tipi di file incorporati
- Estrazione in batch: Elabora più allegati da un singolo PDF in un'unica operazione
- Elaborazione sicuraEstrazione sicura con verifica dell'integrità dei file
Funzionalità avanzate
- Supporto per più formatiEstrarre documenti, immagini, archivi e file multimediali
- Organizzazione dei file: Mantenere una corretta denominazione e organizzazione dei file durante l'estrazione
- Convalida del contenuto: Verificare l'integrità e la completezza del file estratto
- Risultati professionaliEstrazione di alta qualità adatta ad applicazioni aziendali
Casi d'uso e applicazioni industriali
- Document Management & Recovery
- Legal & Compliance
- Business & Finance
- Technical & Engineering
- Healthcare & Medical
Casi d'uso per la gestione e il recupero dei documenti
- Recupero archivioEstrazione di file da documenti PDF archiviati per il recupero dei dati
- Gestione dei contenutiRecuperare risorse incorporate da sistemi di gestione documentale
- Organizzazione dei fileEstrarre e organizzare file da pacchetti PDF complessi
- Migrazione dei dati: Estrarre gli allegati durante i processi di migrazione dei documenti
Casi d'uso legali e di conformità
- Recupero delle proveEstrarre documenti e prove a supporto da PDF legali
- Documentazione di conformitàRecuperare documenti e certificati normativi
- Supporto alla conformitàEstrazione delle tracce di controllo e dei materiali di supporto
- Scoperta legale: Recupera i file incorporati per i processi di acquisizione di prove legali
Casi d'uso in ambito aziendale e finanziario
- Elaborazione delle fattureEstrarre i documenti giustificativi dai PDF delle fatture
- Gestione dei contrattiRecupera gli allegati e le modifiche al contratto
- Rendicontazione finanziariaEstrarre i fogli di calcolo e i report di supporto
- Analisi del documento: Analizzare i contenuti incorporati per ottenere informazioni strategiche
Casi d'uso tecnici e ingegneristici
- Documentazione tecnicaEstrarre esempi di codice, specifiche e diagrammi
- File di progettoRecuperare le risorse del progetto e i materiali di supporto
- Risorse di progettazione: Estrai immagini, file CAD e risorse di progettazione
- Dati di ricercaRecuperare set di dati e materiali di ricerca da file PDF
Casi d'uso in ambito sanitario e medico
- Cartelle clinicheEstrazione delle cartelle cliniche e della documentazione medica dei pazienti.
- Dati di ricercaRecuperare dati di studi clinici e materiali di ricerca
- Documenti di conformità: Estrarre documenti normativi e certificazioni
- Assistenza al paziente: Recuperare immagini e referti medici di supporto