Extraer archivo adjunto de PDF - Recuperación de archivos API
PDF4me Extraer archivo adjunto de PDF le permite extraer todos los archivos adjuntos incrustados en PDF documentos. Este API procesos de servicio PDF archivos y extrae archivos, documentos y recursos incrustados de PDF Los documentos. El API recibe PDF contenido a través de REST API llamadas, utilizando Base64 codificación para transmisión segura. Con soporte para extraer múltiples tipos de archivos de PDF Esta solución es ideal para sistemas de gestión documental y flujos de trabajo de extracción de archivos.
Autenticando su API Pedido
Para acceder al PDF4me REST APICada solicitud debe incluir las credenciales de autenticación adecuadas. La autenticación garantiza una comunicación segura y valida su identidad como usuario autorizado del sistema. REST API.
Características principales
- Extracción de archivos: Extraer todos los archivos, documentos y recursos incrustados de PDF documentos
- Varios tipos de archivos: Compatibilidad con diversos formatos de archivos adjuntos, incluyendo texto, imágenes, documentos y archivos comprimidos.
- Extracción por lotes: Extraer múltiples archivos adjuntos de un solo archivo PDF documento en una operación
- Base64 Codificación: Transmisión segura del contenido de los archivos mediante Base64 codificación
- Simple API Integración: RESTful API Diseñado para flujos de trabajo de extracción automatizada de documentos.
REST API Punto final
El PDF4me REST API utiliza estándar HTTP métodos para interactuar con los recursos. Todas las operaciones de extracción de archivos adjuntos se realizan a través de un único punto final:
- Método: POST
- Punto final:
/api/v2/ExtractAttachmentFromPdf
REST API Parámetros
Lista completa de parámetros para la función Extraer archivo adjunto de PDF REST APILos parámetros están organizados por categoría para una mejor comprensión e implementación.
Importante: Los parámetros marcados con un asterisco (*) son obligatorios y deben proporcionarse para la API para que funcione correctamente.
Parámetros requeridos
| Parámetro | Tipo | Descripción | Ejemplo |
|---|---|---|---|
| docContent* | Base64 (String) | El contenido de la entrada PDF archivo codificado en Base64 formato para la extracción de archivos adjuntos y el procesamiento de recuperación de archivos | JVBERi... |
| docName* | String | Fuente PDF Nombre de archivo con la extensión .pdf adecuada para la identificación del documento y el procesamiento de extracción de archivos adjuntos. | output.pdf |
Parámetros opcionales
| Parámetro | Tipo | Descripción | Ejemplo |
|---|---|---|---|
| async | Boolean | Habilitar el procesamiento asíncrono. Cuando true, el API devoluciones 202 Accepted con un Location encabezado para sondear el resultado | true |
Producción
El PDF4me Extraer archivo adjunto de PDF REST API devuelve diferentes respuestas según el modo de procesamiento. API devuelve los datos adjuntos extraídos como un JSON respuesta o como un ZIP archivo que contiene todos los archivos adjuntos extraídos.
- Success Response
- Asynchronous Processing
- Error Responses
- Response Format Details
Procesamiento síncrono (predeterminado)
Cuando async es false o no proporcionado, el API Devuelve inmediatamente los resultados del archivo adjunto extraído.
Código de estado: 200 OK
Formato de respuesta:
{
"outputDocuments": [
{
"fileName": "attachment1.txt",
"streamFile": "base64-encoded-file-content..."
},
{
"fileName": "attachment2.pdf",
"streamFile": "base64-encoded-file-content..."
}
]
}
La respuesta contiene una matriz de archivos adjuntos extraídos, cada uno con un fileName y streamFile (Base64-contenido codificado).
Procesamiento asíncrono
Cuando async es true, el API procesa el documento de forma asíncrona.
Respuesta inicial:
Código de estado: 202 Accepted
Encabezados de respuesta:
Location: https://api.pdf4me.com/api/v2/ExtractAttachmentFromPdfStatus/{operationId}
Cuerpo de la respuesta:
{
"traceId": "operation-trace-id"
}
Encuesta para obtener resultados:
Utilice el Location encabezado URL para consultar la finalización:
const response = await fetch(locationUrl, {
headers: { 'Authorization': 'Basic ' + apiKey }
});
// Continue polling until status code is 200
if (response.status === 200) {
const result = await response.json();
// Process extracted attachments
}
Respuestas de error
| Código de estado | Descripción | Ejemplo de respuesta |
|---|---|---|
| 400 Bad Request | Parámetros de solicitud no válidos o campos obligatorios faltantes. | {"error": "Missing required parameter: docContent"} |
| 401 Unauthorized | Inválido o faltante API llave | {"error": "Unauthorized"} |
| 408 Tiempo de espera de solicitud agotado | Tiempo de espera agotado para el procesamiento de la solicitud. | {"error": "Request timeout"} |
| 500 Internal Server Error | Error del servidor durante el procesamiento | {"error": "Internal server error"} |
Comprender el JSON Respuesta
La respuesta de extracción es una JSON objeto que contiene una matriz de archivos adjuntos extraídos:
- Documentos de salida: Array de objetos adjuntos extraídos
- Nombre del archivo: El nombre del archivo extraído
- archivo de transmisión: Base64-contenido codificado del archivo extraído
Alternativa: ZIP Respuesta del archivo
En algunos casos, el API puede devolver un ZIP archivo que contiene todos los archivos adjuntos extraídos en lugar de JSON. El ZIP El archivo se puede descargar y extraer para acceder a archivos individuales.
Decodificación Base64 Contenido:
Para descifrar el Base64-contenido del archivo codificado desde streamFile:
// JavaScript
const decoded = atob(base64String);
const blob = new Blob([decoded], { type: 'application/octet-stream' });
# Python
import base64
decoded = base64.b64decode(base64_string)
with open('extracted_file.txt', 'wb') as f:
f.write(decoded)
Ejemplo de solicitud
Encabezamiento
Content-Type: application/json
Authorization: Basic YOUR_BASE64_ENCODED_API_KEY
Nota:
- Consigue tu API clave del PDF4me Panel
- El API La clave debe ser Base64 codificado y prefijado con "Basic" en el Authorization encabezado
- Ejemplo: Si su API La clave es
abc123, codificarlo a Base64 y usarAuthorization: Basic YWJjMTIz
Carga útil
Solicitud básica:
{
"docContent": "JVBERi0xLjQKJeLjz9MKMSAwIG9iago8PAovVHlwZSAvQ2F0YWxvZwovUGFnZXMgMiAwIFIKPj4KZW5kb2JqCjIgMCBvYmoKPDwKL1R5cGUgL1BhZ2VzCi9LaWRzIFszIDAgUl0KL0NvdW50IDEKPD4KZW5kb2JqCjMgMCBvYmoKPDwKL1R5cGUgL1BhZ2UKL1BhcmVudCAyIDAgUgovTWVkaWFCb3ggWzAgMCA2MTIgNzkyXQovUmVzb3VyY2VzIDw8Ci9Gb250IDw8Ci9GMSA0IDAgUgo+Pgo+PgovQ29udGVudHMgNSAwIFIKPj4KZW5kb2JqCjQgMCBvYmoKPDwKL1R5cGUgL0ZvbnQKL1N1YnR5cGUgL1R5cGUxCi9CYXNlRm9udCAvSGVsdmV0aWNhCj4+CmVuZG9iago1IDAgb2JqCjw8Ci9MZW5ndGggNDQKPj4Kc3RyZWFtCkJUCi9GMSAxMiBUZgoxMDAgNzAwIFRkCihIZWxsbyBXb3JsZCkgVGoKRVQKZW5kc3RyZWFtCmVuZG9iagp4cmVmCjAgNgowMDAwMDAwMDAwIDY1NTM1IGYgCjAwMDAwMDAwMDkgMDAwMDAgbiAKMDAwMDAwMDA1NCAwMDAwMCBuIAowMDAwMDAwMTAxIDAwMDAwIG4gCjAwMDAwMDAxNzAgMDAwMDAgbiAKMDAwMDAwMDI0NCAwMDAwMCBuIAp0cmFpbGVyCjw8Ci9TaXplIDYKL1Jvb3QgMSAwIFIKPj4Kc3RhcnR4cmVmCjM0MQolJUVPRg==",
"docName": "output.pdf"
}
Con procesamiento asíncrono:
{
"docContent": "JVBERi0xLjQKJeLjz9MK...",
"docName": "output.pdf",
"async": true
}
Ejemplos de código
El PDF4me Extraer archivo adjunto de PDF REST API Proporciona ejemplos de código en varios lenguajes de programación. Elija el lenguaje que mejor se adapte a su entorno de desarrollo:
- C#
- Java
- JavaScript
- Python
- Salesforce
- n8n
- Google Script
- AWS Lambda
Java Muestra
Java Implementación con manejo completo de errores y procesamiento de respuestas:
JavaScript Muestra
Node.js y compatible con navegadores JavaScript implementación:
Google Script Muestra
Google Apps Script implementación para Google Workspace integración:
Características de extracción de archivos adjuntos
Capacidades de recuperación de archivos
- Extracción completa: Extraer todos los archivos y recursos incrustados de PDF documentos
- Detección del tipo de archivo: Identificación automática de tipos y formatos de archivos incrustados.
- Preservación de metadatos: Mantener los nombres de archivo originales, las fechas de creación y las propiedades.
- Seguro de calidadGarantizar la integridad del archivo y una extracción correcta sin corrupción.
Procesamiento de documentos
- PDF Análisis: Análisis profundo de PDF estructura para localizar los accesorios incrustados
- Identificación de recursos: Detección inteligente de varios tipos de archivos incrustados
- Extracción por lotes: Procesar múltiples archivos adjuntos desde uno solo PDF en una operación
- Procesamiento seguroExtracción segura con verificación de la integridad del archivo.
Características avanzadas
- Compatibilidad con múltiples formatosExtrae documentos, imágenes, archivos comprimidos y archivos multimedia.
- Organización de archivosMantenga una correcta nomenclatura y organización de los archivos durante la extracción.
- Validación de contenido: Verificar la integridad y la completitud del archivo extraído.
- Resultados profesionalesExtracción de alta calidad adecuada para aplicaciones empresariales.
Casos de uso y aplicaciones en la industria
- Document Management & Recovery
- Legal & Compliance
- Business & Finance
- Technical & Engineering
- Healthcare & Medical
Casos de uso para la gestión y recuperación de documentos
- Recuperación de archivos: Extraer archivos de documentos PDF archivados para la recuperación de datos
- Gestión de contenidos: Recuperar recursos incrustados de sistemas de gestión documental
- Organización de archivosExtraer y organizar archivos de paquetes PDF complejos
- Migración de datos: Extraer archivos adjuntos durante los procesos de migración de documentos
Casos de uso legales y de cumplimiento normativo
- Recuperación de pruebasExtraer documentos justificativos y pruebas de archivos PDF legales.
- Documentación de cumplimiento: Recuperar documentos y certificados reglamentarios
- Soporte de auditoríaExtraer registros de auditoría y materiales de apoyo.
- Descubrimiento legal: Recuperar archivos incrustados para procesos de descubrimiento legal
Casos de uso en negocios y finanzas
- Procesamiento de facturasExtraer documentos justificativos de los archivos PDF de las facturas
- Gestión de contratos: Recuperar anexos y modificaciones del contrato
- Información financieraExtraer las hojas de cálculo e informes de apoyo.
- Análisis de documentosAnalizar el contenido incrustado para la inteligencia empresarial.
Casos de uso técnicos y de ingeniería
- Documentación técnica: Extraer ejemplos de código, especificaciones y diagramas
- Archivos del proyectoRecuperar los recursos del proyecto y los materiales de apoyo.
- Recursos de diseñoExtraer imágenes, archivos CAD y recursos de diseño
- Datos de investigación: Recuperar conjuntos de datos y materiales de investigación de archivos PDF
Casos de uso en el sector sanitario y médico
- Registros médicosExtraer archivos de pacientes y documentación médica
- Datos de investigaciónRecuperar datos de ensayos clínicos y materiales de investigación.
- Archivos de cumplimiento: Extraer documentos reglamentarios y certificaciones
- Atención al pacienteRecuperar imágenes e informes médicos de apoyo