Documento clasificado
PDF4me Documento clasificado te permite clasificar e identificar documentos en función de su contenido. API procesos de servicio PDF Los archivos y analizan la estructura del documento, los patrones de contenido y los metadatos para determinar los tipos y categorías de documentos. API recibe PDF contenido a través de REST API llamadas, utilizando Base64 Codificación para una transmisión segura. Gracias a su compatibilidad con la identificación del tipo de documento y la categorización automatizada, esta solución es ideal para sistemas de gestión documental y flujos de trabajo automatizados.
Autenticando su API Pedido
Para acceder al PDF4me REST APICada solicitud debe incluir las credenciales de autenticación adecuadas. La autenticación garantiza una comunicación segura y valida su identidad como usuario autorizado del sistema. REST API.
Características principales
- Clasificación de documentos: Identificar y clasificar los tipos de documentos en función del análisis de contenido.
- Análisis de contenido: Analizar la estructura del documento, los patrones de contenido y los metadatos.
- Varios tipos de documentos: Soporte para varios PDF formatos de documento
- Procesamiento automatizadoClasificación de documentos optimizada sin intervención manual
- Simple API Integración: RESTful API Diseñado para flujos de trabajo de procesamiento automatizado de documentos.
REST API Punto final
El PDF4me REST API utiliza estándar HTTP métodos para interactuar con los recursos. Todas las operaciones de clasificación de documentos se realizan a través de un único punto final:
- Método: POST
- Punto final:
/api/v2/ClassifyDocument
REST API Parámetros
Lista completa de parámetros para el documento clasificado REST APILos parámetros están organizados por categoría para una mejor comprensión e implementación.
Importante: Los parámetros marcados con un asterisco (*) son obligatorios y deben proporcionarse para la API para que funcione correctamente.
Parámetros requeridos
| Parámetro | Tipo | Descripción | Ejemplo |
|---|---|---|---|
| docContent* | Base64 (String) | El contenido de la entrada PDF archivo codificado en Base64 formato para el procesamiento de análisis y clasificación de documentos | JVBERi... |
| docName* | String | Fuente PDF Nombre del archivo con la extensión .pdf adecuada para la identificación y el procesamiento del documento. | output.pdf |
Parámetros opcionales
| Parámetro | Tipo | Descripción | Ejemplo |
|---|---|---|---|
| async | Boolean | Habilitar el procesamiento asíncrono. Cuando true, el API devoluciones 202 Accepted con un Location encabezado para sondear el resultado | true |
Producción
El PDF4me Documento clasificado REST API devuelve diferentes respuestas según el modo de procesamiento. API devuelve datos de clasificación como un JSON respuesta.
- Success Response
- Asynchronous Processing
- Error Responses
- Response Format Details
Procesamiento síncrono (predeterminado)
Cuando async es false o no proporcionado, el API Devuelve los resultados de la clasificación inmediatamente.
Código de estado: 200 OK
Formato de respuesta:
{
"documentType": "invoice",
"category": "financial",
"confidence": 0.95,
"metadata": {
"pageCount": 1,
"createdDate": "2024-01-15T10:30:00Z"
}
}
La respuesta contiene datos de clasificación, incluyendo el tipo de documento, la categoría, el índice de confianza y la información de metadatos.
Procesamiento asíncrono
Cuando async es true, el API procesa el documento de forma asíncrona.
Respuesta inicial:
Código de estado: 202 Accepted
Encabezados de respuesta:
Location: https://api.pdf4me.com/api/v2/ParseDocumentStatus/{operationId}
Cuerpo de la respuesta:
{
"traceId": "operation-trace-id"
}
Encuesta para obtener resultados:
Utilice el Location encabezado URL para consultar la finalización:
const response = await fetch(locationUrl, {
headers: { 'Authorization': 'Basic ' + apiKey }
});
// Continue polling until status code is 200
if (response.status === 200) {
const result = await response.json();
// Process classification results
}
Respuestas de error
| Código de estado | Descripción | Ejemplo de respuesta |
|---|---|---|
| 400 Bad Request | Parámetros de solicitud no válidos o campos obligatorios faltantes. | {"error": "Missing required parameter: docContent"} |
| 401 Unauthorized | Inválido o faltante API llave | {"error": "Unauthorized"} |
| 408 Tiempo de espera de solicitud agotado | Tiempo de espera agotado para el procesamiento de la solicitud. | {"error": "Request timeout"} |
| 500 Internal Server Error | Error del servidor durante el procesamiento | {"error": "Internal server error"} |
Comprender el JSON Respuesta
La respuesta de clasificación es una JSON objeto que contiene datos estructurados sobre el documento:
- tipo de documento: El tipo de documento identificado (por ejemplo, "factura", "contrato", "informe")
- categoría: La categoría del documento (por ejemplo, "financiero", "legal", "comercial")
- confianza: Una puntuación que indica el nivel de confianza de la clasificación (de 0,0 a 1,0)
- metadatos: Información adicional del documento, como el número de páginas, la fecha de creación, etc.
Decodificación Base64 Contenido (si lo hay):
Si la respuesta incluye Base64-contenido codificado, decodifíquelo usando:
// JavaScript
const decoded = atob(base64String);
# Python
import base64
decoded = base64.b64decode(base64_string).decode('utf-8')
Ejemplo de solicitud
Encabezamiento
Content-Type: application/json
Authorization: Basic YOUR_BASE64_ENCODED_API_KEY
Nota:
- Consigue tu API clave del PDF4me Panel
- El API La clave debe ser Base64 codificado y prefijado con "Basic" en el Authorization encabezado
- Ejemplo: Si su API La clave es
abc123, codificarlo a Base64 y usarAuthorization: Basic YWJjMTIz
Carga útil
Solicitud básica:
{
"docContent": "JVBERi0xLjQKJeLjz9MKMSAwIG9iago8PAovVHlwZSAvQ2F0YWxvZwovUGFnZXMgMiAwIFIKPj4KZW5kb2JqCjIgMCBvYmoKPDwKL1R5cGUgL1BhZ2VzCi9LaWRzIFszIDAgUl0KL0NvdW50IDEKPD4KZW5kb2JqCjMgMCBvYmoKPDwKL1R5cGUgL1BhZ2UKL1BhcmVudCAyIDAgUgovTWVkaWFCb3ggWzAgMCA2MTIgNzkyXQovUmVzb3VyY2VzIDw8Ci9Gb250IDw8Ci9GMSA0IDAgUgo+Pgo+PgovQ29udGVudHMgNSAwIFIKPj4KZW5kb2JqCjQgMCBvYmoKPDwKL1R5cGUgL0ZvbnQKL1N1YnR5cGUgL1R5cGUxCi9CYXNlRm9udCAvSGVsdmV0aWNhCj4+CmVuZG9iago1IDAgb2JqCjw8Ci9MZW5ndGggNDQKPj4Kc3RyZWFtCkJUCi9GMSAxMiBUZgoxMDAgNzAwIFRkCihIZWxsbyBXb3JsZCkgVGoKRVQKZW5kc3RyZWFtCmVuZG9iagp4cmVmCjAgNgowMDAwMDAwMDAwIDY1NTM1IGYgCjAwMDAwMDAwMDkgMDAwMDAgbiAKMDAwMDAwMDA1NCAwMDAwMCBuIAowMDAwMDAwMTAxIDAwMDAwIG4gCjAwMDAwMDAxNzAgMDAwMDAgbiAKMDAwMDAwMDI0NCAwMDAwMCBuIAp0cmFpbGVyCjw8Ci9TaXplIDYKL1Jvb3QgMSAwIFIKPj4Kc3RhcnR4cmVmCjM0MQolJUVPRg==",
"docName": "output.pdf"
}
Con procesamiento asíncrono:
{
"docContent": "JVBERi0xLjQKJeLjz9MK...",
"docName": "output.pdf",
"async": true
}
Ejemplos de código
El PDF4me Documento clasificado REST API Proporciona ejemplos de código en varios lenguajes de programación. Elija el lenguaje que mejor se adapte a su entorno de desarrollo:
- C#
- Java
- JavaScript
- Python
- Salesforce
- n8n
- Google Script
- AWS Lambda
Java Muestra
Java Implementación con manejo completo de errores y procesamiento de respuestas:
JavaScript Muestra
Node.js y compatible con navegadores JavaScript implementación:
Google Script Muestra
Google Apps Script implementación para Google Workspace integración:
Características de clasificación de documentos
Capacidades de clasificación
- Detección del tipo de documento: Identificación de tipos de documentos basada en el análisis de contenido
- Categorización de contenido: Agrupación de documentos por contenido y propósito
- Reconocimiento de plantillas: Identificación de plantillas de documentos y formatos estándar
- Clasificación de cumplimientoClasificación para los requisitos reglamentarios y de cumplimiento
Características empresariales
- Procesamiento por lotes: Procesar múltiples documentos con estándares de clasificación consistentes.
- Seguro de calidadGarantizar la precisión y fiabilidad de la clasificación para aplicaciones empresariales.
- Listo para la integraciónIntegración perfecta con los sistemas de gestión documental existentes.
- Procesamiento escalable: Gestiona grandes volúmenes de documentos con un rendimiento de nivel empresarial.
Casos de uso y aplicaciones en la industria
- Document Management & Organization
- Compliance & Regulatory
- Business Process Automation
- Financial Services
- Healthcare & Medical
- Legal & Professional Services
Casos de uso para la gestión y organización de documentos
- Presentación automatizada: Clasifica y organiza automáticamente los documentos en sistemas de archivo digital.
- Gestión de contenidosCategorización avanzada para sistemas de gestión y recuperación de contenido.
- Organización de archivo: Clasificación sistemática de documentos y registros históricos
- Optimización de búsqueda: Búsqueda de documentos mejorada mediante clasificación y etiquetado precisos.
Casos de uso relacionados con el cumplimiento normativo y la normativa
- Preparación de auditoríasClasificación automática de documentos para fines de cumplimiento y auditoría.
- Informes regulatoriosProcesamiento simplificado de documentos para presentaciones regulatorias
- Descubrimiento legalClasificación eficiente de documentos para el descubrimiento legal y el apoyo a litigios.
- Cumplimiento de la política: Verificación automatizada del cumplimiento de los documentos con las políticas de la organización.
Casos de uso de la automatización de procesos empresariales
- Enrutamiento del flujo de trabajo: Enrutamiento automático de documentos basado en los resultados de la clasificación.
- Optimización de procesosFlujos de trabajo optimizados para el procesamiento de documentos con clasificación avanzada.
- Control de calidad: Verificación automatizada de los tipos de documentos y la exactitud del contenido
- Asignación de recursos: Asignación eficiente de recursos de procesamiento en función de los tipos de documentos.
Casos de uso de servicios financieros
- Procesamiento de facturasClasificación automática de facturas, recibos y documentos financieros.
- Documentación del préstamo: Procesamiento simplificado de solicitudes de préstamo y documentos justificativos
- Preparación de impuestosClasificación automatizada de documentos y formularios relacionados con impuestos.
- Soporte de auditoríaOrganización eficiente de documentos para auditorías y revisiones financieras.
Casos de uso en el sector sanitario y médico
- Registros de pacientesClasificación automática de historiales médicos y documentación de pacientes.
- Reclamaciones de seguros: Procesamiento simplificado de reclamaciones de seguros y documentación médica
- Documentación de cumplimientoClasificación automatizada para el cumplimiento normativo en el sector sanitario
- Datos de investigaciónOrganización sistemática de documentos de investigación médica y ensayos clínicos.
Casos de uso de servicios legales y profesionales
- Gestión de contratosClasificación automática de contratos y acuerdos legales.
- Documentación del casoOrganización eficiente de expedientes legales y documentos de respaldo.
- Monitoreo del cumplimientoClasificación automatizada para el cumplimiento normativo y el monitoreo
- Documentación del clienteProcesamiento optimizado de archivos de clientes y documentación profesional.