Extrair anexo de PDF - Recuperação de Arquivos API
PDF4me Extrair anexo de PDF Permite extrair todos os anexos de arquivos incorporados em PDF documentos. Isto API processos de serviço PDF abre arquivos e extrai arquivos, documentos e recursos incorporados de PDF documentos. O API recebe PDF conteúdo através de REST API chamadas, utilizando Base64 Codificação para transmissão segura. Com suporte para extração de múltiplos tipos de arquivo. PDF Para documentos, esta solução é ideal para sistemas de gerenciamento de documentos e fluxos de trabalho de extração de arquivos.
Autenticando seu API Solicitar
Para acessar o PDF4me REST APIPara que uma solicitação seja aceita, é necessário incluir as credenciais de autenticação adequadas. A autenticação garante a segurança da comunicação e valida sua identidade como usuário autorizado do sistema. REST API.
Principais características
- Extração de ArquivosExtraia todos os arquivos, documentos e recursos incorporados de PDF documentos
- Vários tipos de arquivoSuporte para diversos formatos de anexos, incluindo texto, imagens, documentos e arquivos compactados.
- Extração em loteExtrair vários anexos de um único arquivo. PDF documento em uma única operação
- Base64 CodificaçãoTransmissão segura de conteúdo de arquivos usando Base64 codificação
- Simple API IntegraçãoRESTful API Projetado para fluxos de trabalho automatizados de extração de documentos.
REST API Ponto final
O PDF4me REST API usa padrão HTTP Métodos para interagir com recursos. Todas as operações de extração de anexos são realizadas por meio de um único ponto de extremidade:
- Método: POST
- Ponto final:
/api/v2/ExtractAttachmentFromPdf
REST API Parâmetros
Lista completa de parâmetros para a função Extrair Anexo de PDF REST APIOs parâmetros estão organizados por categoria para melhor compreensão e implementação.
Importante: Os parâmetros marcados com um asterisco (*) são obrigatórios e devem ser fornecidos para o API para funcionar corretamente.
Parâmetros obrigatórios
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| docContent* | Base64 (String) | O conteúdo da entrada PDF arquivo codificado em Base64 formato para extração de anexos e processamento de recuperação de arquivos | JVBERi... |
| docName* | String | Fonte PDF Nome do arquivo com a extensão .pdf adequada para identificação do documento e processamento de extração de anexos. | output.pdf |
Parâmetros opcionais
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| async | Boolean | Ative o processamento assíncrono. Quando true, o API retornos 202 Accepted com um Location cabeçalho para consultar o resultado | true |
Saída
O PDF4me Extrair anexo de PDF REST API Retorna respostas diferentes dependendo do modo de processamento. API Retorna os dados de anexos extraídos como um JSON resposta ou como um ZIP arquivo Contendo todos os anexos extraídos.
- Success Response
- Asynchronous Processing
- Error Responses
- Response Format Details
Processamento síncrono (padrão)
Quando async é false ou não fornecido, o API Retorna imediatamente os resultados do anexo extraído.
Código de status: 200 OK
Formato da resposta:
{
"outputDocuments": [
{
"fileName": "attachment1.txt",
"streamFile": "base64-encoded-file-content..."
},
{
"fileName": "attachment2.pdf",
"streamFile": "base64-encoded-file-content..."
}
]
}
A resposta contém uma matriz de anexos extraídos, cada um com um fileName e streamFile (Base64(conteúdo codificado).
Processamento assíncrono
Quando async é true, o API Processa o documento de forma assíncrona.
Resposta inicial:
Código de status: 202 Accepted
Cabeçalhos de resposta:
Location: https://api.pdf4me.com/api/v2/ExtractAttachmentFromPdfStatus/{operationId}
Corpo da resposta:
{
"traceId": "operation-trace-id"
}
Votação para apuração dos resultados:
Use o Location cabeçalho URL Para verificar a conclusão da pesquisa:
const response = await fetch(locationUrl, {
headers: { 'Authorization': 'Basic ' + apiKey }
});
// Continue polling until status code is 200
if (response.status === 200) {
const result = await response.json();
// Process extracted attachments
}
Respostas de erro
| Código de status | Descrição | Exemplo de resposta |
|---|---|---|
| 400 Bad Request | Parâmetros de solicitação inválidos ou campos obrigatórios ausentes | {"error": "Missing required parameter: docContent"} |
| 401 Unauthorized | Inválido ou ausente API chave | {"error": "Unauthorized"} |
| 408 Tempo limite da solicitação | Tempo limite de processamento da solicitação | {"error": "Request timeout"} |
| 500 Internal Server Error | Erro do servidor durante o processamento | {"error": "Internal server error"} |
Entendendo o JSON Resposta
A resposta de extração é uma JSON Objeto contendo uma matriz de anexos extraídos:
- documentos de saída: Array de objetos de anexo extraídos
- nome_do_arquivo: O nome do arquivo extraído
- arquivo de fluxo: Base64-conteúdo codificado do arquivo extraído
Alternativa: ZIP Resposta do arquivo
Em alguns casos, o API pode retornar um ZIP arquivo contendo todos os anexos extraídos em vez de JSON. O ZIP O arquivo pode ser baixado e extraído para acessar os arquivos individuais.
Decodificando Base64 Contente:
Para decodificar o Base64-conteúdo do arquivo codificado de streamFile:
// JavaScript
const decoded = atob(base64String);
const blob = new Blob([decoded], { type: 'application/octet-stream' });
# Python
import base64
decoded = base64.b64decode(base64_string)
with open('extracted_file.txt', 'wb') as f:
f.write(decoded)
Exemplo de solicitação
Cabeçalho
Content-Type: application/json
Authorization: Basic YOUR_BASE64_ENCODED_API_KEY
Observação:
- Adquira o seu API chave do PDF4me Painel
- O API a chave deve ser Base64 codificado e prefixado com "Básico" no Authorization cabeçalho
- Exemplo: Se o seu API chave é
abc123, codifique-o para Base64 e usarAuthorization: Basic YWJjMTIz
Carga útil
Solicitação básica:
{
"docContent": "JVBERi0xLjQKJeLjz9MKMSAwIG9iago8PAovVHlwZSAvQ2F0YWxvZwovUGFnZXMgMiAwIFIKPj4KZW5kb2JqCjIgMCBvYmoKPDwKL1R5cGUgL1BhZ2VzCi9LaWRzIFszIDAgUl0KL0NvdW50IDEKPD4KZW5kb2JqCjMgMCBvYmoKPDwKL1R5cGUgL1BhZ2UKL1BhcmVudCAyIDAgUgovTWVkaWFCb3ggWzAgMCA2MTIgNzkyXQovUmVzb3VyY2VzIDw8Ci9Gb250IDw8Ci9GMSA0IDAgUgo+Pgo+PgovQ29udGVudHMgNSAwIFIKPj4KZW5kb2JqCjQgMCBvYmoKPDwKL1R5cGUgL0ZvbnQKL1N1YnR5cGUgL1R5cGUxCi9CYXNlRm9udCAvSGVsdmV0aWNhCj4+CmVuZG9iago1IDAgb2JqCjw8Ci9MZW5ndGggNDQKPj4Kc3RyZWFtCkJUCi9GMSAxMiBUZgoxMDAgNzAwIFRkCihIZWxsbyBXb3JsZCkgVGoKRVQKZW5kc3RyZWFtCmVuZG9iagp4cmVmCjAgNgowMDAwMDAwMDAwIDY1NTM1IGYgCjAwMDAwMDAwMDkgMDAwMDAgbiAKMDAwMDAwMDA1NCAwMDAwMCBuIAowMDAwMDAwMTAxIDAwMDAwIG4gCjAwMDAwMDAxNzAgMDAwMDAgbiAKMDAwMDAwMDI0NCAwMDAwMCBuIAp0cmFpbGVyCjw8Ci9TaXplIDYKL1Jvb3QgMSAwIFIKPj4Kc3RhcnR4cmVmCjM0MQolJUVPRg==",
"docName": "output.pdf"
}
Com processamento assíncrono:
{
"docContent": "JVBERi0xLjQKJeLjz9MK...",
"docName": "output.pdf",
"async": true
}
Exemplos de código
O PDF4me Extrair anexo de PDF REST API Fornece exemplos de código em várias linguagens de programação. Escolha a linguagem que melhor se adapta ao seu ambiente de desenvolvimento:
- C#
- Java
- JavaScript
- Python
- Salesforce
- n8n
- Google Script
- AWS Lambda
Java Amostra
Java Implementação com tratamento completo de erros e processamento de respostas:
JavaScript Amostra
Node.js e compatível com navegadores JavaScript Implementação:
Google Script Amostra
Google Apps Script implementação para Google Workspace integração:
Recursos de extração de anexos
Capacidades de recuperação de arquivos
- Extração completaExtraia todos os arquivos e recursos incorporados de PDF documentos
- Detecção de tipo de arquivoIdentificação automática de tipos e formatos de arquivos incorporados.
- Preservação de MetadadosManter os nomes de arquivo originais, datas de criação e propriedades.
- Garantia de QualidadeGarantir a integridade dos arquivos e a extração correta, sem corrupção.
Processamento de Documentos
- PDF AnáliseAnálise aprofundada de PDF estrutura para localizar anexos embutidos
- Identificação de RecursosDetecção inteligente de vários tipos de arquivos incorporados.
- Extração em loteProcessar vários anexos a partir de um único arquivo. PDF em uma única operação
- Processamento seguroExtração segura com verificação de integridade do arquivo.
Recursos avançados
- Suporte a múltiplos formatosExtrair documentos, imagens, arquivos e arquivos multimídia.
- Organização de ArquivosMantenha a nomenclatura e a organização adequadas dos arquivos durante a extração.
- Validação de conteúdoVerificar a integridade e a completude do arquivo extraído.
- Resultados profissionaisExtração de alta qualidade adequada para aplicações empresariais.
Casos de uso e aplicações industriais
- Document Management & Recovery
- Legal & Compliance
- Business & Finance
- Technical & Engineering
- Healthcare & Medical
Casos de uso para gerenciamento e recuperação de documentos
- Recuperação de ArquivosExtrair arquivos de documentos PDF arquivados para recuperação de dados.
- Gestão de ConteúdoRecuperar recursos incorporados de sistemas de gerenciamento de documentos
- Organização de ArquivosExtrair e organizar arquivos de pacotes PDF complexos.
- Migração de dadosExtrair anexos durante processos de migração de documentos
Casos de uso para questões legais e de conformidade
- Recuperação de EvidênciasExtrair documentos e provas de apoio a partir de PDFs jurídicos.
- Documentação de ConformidadeRecuperar documentos e certificados regulamentares
- Suporte de auditoriaExtrair trilhas de auditoria e materiais de suporte.
- Descoberta legalRecuperar arquivos incorporados para processos de descoberta legal
Casos de uso em negócios e finanças
- Processamento de faturasExtrair documentos comprobatórios de PDFs de faturas
- Gestão de ContratosRecuperar anexos e alterações contratuais
- Relatórios financeirosExtrair planilhas e relatórios de apoio.
- Análise de DocumentosAnalisar conteúdo incorporado para inteligência de negócios
Casos de uso técnicos e de engenharia
- Documentação técnicaExtrair exemplos de código, especificações e diagramas.
- Arquivos do projetoRecuperar recursos do projeto e materiais de apoio.
- Recursos de designExtrair imagens, arquivos CAD e recursos de design.
- Dados de pesquisaRecuperar conjuntos de dados e materiais de pesquisa de PDFs
Casos de uso na área da saúde e medicina
- Registros médicosExtrair arquivos de pacientes e documentação médica.
- Dados de pesquisaRecuperar dados de ensaios clínicos e materiais de pesquisa
- Arquivos de conformidadeExtrair documentos regulamentares e certificações
- Cuidados ao PacienteRecuperar imagens e relatórios médicos de apoio.