Classificar documento
PDF4me Classificar documento Permite classificar e identificar documentos com base no seu conteúdo. API processos de serviço PDF O sistema analisa arquivos e estrutura de documentos, padrões de conteúdo e metadados para determinar tipos e categorias de documentos. API recebe PDF conteúdo através de REST API chamadas, utilizando Base64 Codificação para transmissão segura. Com suporte para identificação do tipo de documento e categorização automática, esta solução é ideal para sistemas de gestão documental e fluxos de trabalho automatizados.
Autenticando seu API Solicitar
Para acessar o PDF4me REST APIPara que uma solicitação seja aceita, é necessário incluir as credenciais de autenticação adequadas. A autenticação garante a segurança da comunicação e valida sua identidade como usuário autorizado do sistema. REST API.
Principais características
- Classificação de DocumentosIdentificar e classificar tipos de documentos com base na análise de conteúdo.
- Análise de ConteúdoAnalisar a estrutura do documento, os padrões de conteúdo e os metadados.
- Vários tipos de documentosSuporte para vários PDF formatos de documentos
- Processamento automatizadoClassificação simplificada de documentos sem intervenção manual.
- Simple API IntegraçãoRESTful API Projetado para fluxos de trabalho automatizados de processamento de documentos.
REST API Ponto final
O PDF4me REST API usa padrão HTTP Métodos para interagir com recursos. Todas as operações de classificação de documentos são realizadas por meio de um único ponto de extremidade:
- Método: POST
- Ponto final:
/api/v2/ClassifyDocument
REST API Parâmetros
Lista completa de parâmetros para a função Classificar Documento REST APIOs parâmetros estão organizados por categoria para melhor compreensão e implementação.
Importante: Os parâmetros marcados com um asterisco (*) são obrigatórios e devem ser fornecidos para o API para funcionar corretamente.
Parâmetros obrigatórios
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| docContent* | Base64 (String) | O conteúdo da entrada PDF arquivo codificado em Base64 formato para processamento de análise e classificação de documentos | JVBERi... |
| docName* | String | Fonte PDF Nome do arquivo com a extensão .pdf adequada para identificação e processamento do documento. | output.pdf |
Parâmetros opcionais
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| async | Boolean | Ative o processamento assíncrono. Quando true, o API retornos 202 Accepted com um Location cabeçalho para consultar o resultado | true |
Saída
O PDF4me Classificar documento REST API Retorna respostas diferentes dependendo do modo de processamento. API retorna dados de classificação como um JSON resposta.
- Success Response
- Asynchronous Processing
- Error Responses
- Response Format Details
Processamento síncrono (padrão)
Quando async é false ou não fornecido, o API Retorna os resultados da classificação imediatamente.
Código de status: 200 OK
Formato da resposta:
{
"documentType": "invoice",
"category": "financial",
"confidence": 0.95,
"metadata": {
"pageCount": 1,
"createdDate": "2024-01-15T10:30:00Z"
}
}
A resposta contém dados de classificação, incluindo tipo de documento, categoria, pontuação de confiança e informações de metadados.
Processamento assíncrono
Quando async é true, o API Processa o documento de forma assíncrona.
Resposta inicial:
Código de status: 202 Accepted
Cabeçalhos de resposta:
Location: https://api.pdf4me.com/api/v2/ParseDocumentStatus/{operationId}
Corpo da resposta:
{
"traceId": "operation-trace-id"
}
Votação para apuração dos resultados:
Use o Location cabeçalho URL Para verificar a conclusão da pesquisa:
const response = await fetch(locationUrl, {
headers: { 'Authorization': 'Basic ' + apiKey }
});
// Continue polling until status code is 200
if (response.status === 200) {
const result = await response.json();
// Process classification results
}
Respostas de erro
| Código de status | Descrição | Exemplo de resposta |
|---|---|---|
| 400 Bad Request | Parâmetros de solicitação inválidos ou campos obrigatórios ausentes | {"error": "Missing required parameter: docContent"} |
| 401 Unauthorized | Inválido ou ausente API chave | {"error": "Unauthorized"} |
| 408 Tempo limite da solicitação | Tempo limite de processamento da solicitação | {"error": "Request timeout"} |
| 500 Internal Server Error | Erro do servidor durante o processamento | {"error": "Internal server error"} |
Entendendo o JSON Resposta
A resposta de classificação é uma JSON Objeto contendo dados estruturados sobre o documento:
- tipo de documento: O tipo de documento identificado (por exemplo, "fatura", "contrato", "relatório")
- categoria: A categoria do documento (por exemplo, "financeiro", "jurídico", "comercial")
- confiança: Uma pontuação que indica o nível de confiança da classificação (0,0 a 1,0)
- metadadosInformações adicionais sobre o documento, como número de páginas, data de criação, etc.
Decodificando Base64 Conteúdo (se presente):
Se a resposta incluir Base64Conteúdo codificado, decodifique-o usando:
// JavaScript
const decoded = atob(base64String);
# Python
import base64
decoded = base64.b64decode(base64_string).decode('utf-8')
Exemplo de solicitação
Cabeçalho
Content-Type: application/json
Authorization: Basic YOUR_BASE64_ENCODED_API_KEY
Observação:
- Adquira o seu API chave do PDF4me Painel
- O API a chave deve ser Base64 codificado e prefixado com "Básico" no Authorization cabeçalho
- Exemplo: Se o seu API chave é
abc123, codifique-o para Base64 e usarAuthorization: Basic YWJjMTIz
Carga útil
Solicitação básica:
{
"docContent": "JVBERi0xLjQKJeLjz9MKMSAwIG9iago8PAovVHlwZSAvQ2F0YWxvZwovUGFnZXMgMiAwIFIKPj4KZW5kb2JqCjIgMCBvYmoKPDwKL1R5cGUgL1BhZ2VzCi9LaWRzIFszIDAgUl0KL0NvdW50IDEKPD4KZW5kb2JqCjMgMCBvYmoKPDwKL1R5cGUgL1BhZ2UKL1BhcmVudCAyIDAgUgovTWVkaWFCb3ggWzAgMCA2MTIgNzkyXQovUmVzb3VyY2VzIDw8Ci9Gb250IDw8Ci9GMSA0IDAgUgo+Pgo+PgovQ29udGVudHMgNSAwIFIKPj4KZW5kb2JqCjQgMCBvYmoKPDwKL1R5cGUgL0ZvbnQKL1N1YnR5cGUgL1R5cGUxCi9CYXNlRm9udCAvSGVsdmV0aWNhCj4+CmVuZG9iago1IDAgb2JqCjw8Ci9MZW5ndGggNDQKPj4Kc3RyZWFtCkJUCi9GMSAxMiBUZgoxMDAgNzAwIFRkCihIZWxsbyBXb3JsZCkgVGoKRVQKZW5kc3RyZWFtCmVuZG9iagp4cmVmCjAgNgowMDAwMDAwMDAwIDY1NTM1IGYgCjAwMDAwMDAwMDkgMDAwMDAgbiAKMDAwMDAwMDA1NCAwMDAwMCBuIAowMDAwMDAwMTAxIDAwMDAwIG4gCjAwMDAwMDAxNzAgMDAwMDAgbiAKMDAwMDAwMDI0NCAwMDAwMCBuIAp0cmFpbGVyCjw8Ci9TaXplIDYKL1Jvb3QgMSAwIFIKPj4Kc3RhcnR4cmVmCjM0MQolJUVPRg==",
"docName": "output.pdf"
}
Com processamento assíncrono:
{
"docContent": "JVBERi0xLjQKJeLjz9MK...",
"docName": "output.pdf",
"async": true
}
Exemplos de código
O PDF4me Classificar documento REST API Fornece exemplos de código em várias linguagens de programação. Escolha a linguagem que melhor se adapta ao seu ambiente de desenvolvimento:
- C#
- Java
- JavaScript
- Python
- Salesforce
- n8n
- Google Script
- AWS Lambda
Java Amostra
Java Implementação com tratamento completo de erros e processamento de respostas:
JavaScript Amostra
Node.js e compatível com navegadores JavaScript Implementação:
Google Script Amostra
Google Apps Script implementação para Google Workspace integração:
Características de classificação de documentos
Capacidades de classificação
- Detecção do tipo de documentoIdentificação de tipos de documentos com base na análise de conteúdo.
- Categorização de ConteúdoAgrupamento de documentos por conteúdo e finalidade.
- Reconhecimento de ModelosIdentificação de modelos de documentos e formatos padrão.
- Classificação de ConformidadeClassificação para fins de requisitos regulamentares e de conformidade.
Funcionalidades empresariais
- Processamento em loteProcessar vários documentos com padrões de classificação consistentes.
- Garantia de QualidadeGarantir a precisão e a confiabilidade da classificação para aplicações comerciais.
- Pronto para integraçãoIntegração perfeita com sistemas de gestão documental existentes.
- Processamento escalávelGerencie grandes volumes de documentos com desempenho de nível empresarial.
Casos de uso e aplicações industriais
- Document Management & Organization
- Compliance & Regulatory
- Business Process Automation
- Financial Services
- Healthcare & Medical
- Legal & Professional Services
Casos de uso para gerenciamento e organização de documentos
- Arquivamento automatizadoClassificar e organizar documentos automaticamente em sistemas de arquivamento digital.
- Gestão de ConteúdoCategorização avançada para sistemas de gerenciamento e recuperação de conteúdo.
- Organização de ArquivosClassificação sistemática de documentos e registros históricos.
- Otimização de BuscaBusca de documentos aprimorada por meio de classificação e etiquetagem precisas.
Casos de uso de conformidade e regulamentação
- Preparação para auditoriaClassificação automática de documentos para fins de conformidade e auditoria.
- Relatórios regulatóriosProcessamento simplificado de documentos para submissões regulatórias
- Descoberta legalClassificação eficiente de documentos para descoberta legal e suporte a litígios.
- Conformidade com a políticaVerificação automatizada da conformidade dos documentos com as políticas organizacionais.
Casos de uso da automação de processos de negócios
- Roteamento de fluxo de trabalhoEncaminhamento automático de documentos com base nos resultados da classificação.
- Otimização de ProcessosFluxos de trabalho de processamento de documentos simplificados com classificação avançada.
- Controle de qualidadeVerificação automatizada dos tipos de documentos e da precisão do conteúdo.
- Alocação de RecursosAlocação eficiente de recursos de processamento com base nos tipos de documento.
Casos de uso de serviços financeiros
- Processamento de faturasClassificação automática de faturas, recibos e documentos financeiros.
- Documentação do empréstimoProcessamento simplificado de pedidos de empréstimo e documentos comprobatórios.
- Preparação de ImpostosClassificação automatizada de documentos e formulários relacionados a impostos.
- Suporte de auditoriaOrganização eficiente de documentos para auditorias e revisões financeiras.
Casos de uso na área da saúde e medicina
- Registros de pacientesClassificação automática de registros médicos e documentação do paciente.
- Reclamações de segurosProcessamento simplificado de pedidos de reembolso de seguros e documentação médica.
- Documentação de ConformidadeClassificação automatizada para conformidade com regulamentações na área da saúde.
- Dados de pesquisaOrganização sistemática de documentos de pesquisa médica e ensaios clínicos.
Casos de uso de serviços jurídicos e profissionais
- Gestão de ContratosClassificação automática de contratos e acordos legais
- Documentação do casoOrganização eficiente de processos judiciais e documentos de apoio.
- Monitoramento de ConformidadeClassificação automatizada para conformidade regulatória e monitoramento.
- Documentação do ClienteProcessamento simplificado de arquivos de clientes e documentação profissional.