Extrair recursos
Extrair → Extrair recursos
O Extrair recursos API Extrai texto e/ou imagens incorporadas de um PDFVocê envia o PDF como Base64 (docContent), docName, extractText (verdadeiro/falso), extractImages (verdadeiro/falso) e, opcionalmente, async. O API retornos JSON com texto e imagens extraídos (Base64Use o testador abaixo para experimentar; mais detalhes estão nas seções seguintes.
Experimente a opção Extrair Recursos. API
:::nota Referência rápida
Ponto final: POST /api/v2/ExtractResources · Obrigatório: api-key, docContent, docName, extractText, extractImages
:::
Use o formulário abaixo para enviar sua API chave, PDF (Base64), e escolha se deseja extrair texto, imagens ou ambos. A resposta é JSON com texto e/ou imagens em Base64Não é necessário nenhum código: preencha os campos e clique. Enviar solicitação.
Visão geral, parâmetros e casos de uso
- Overview
- Parameters
- Use cases
O que é Extrair Recursos?
Este endpoint extrai conteúdo de texto e/ou imagens incorporadas de um PDFVocê escolhe o que extrair através de extractText e extractImages (ambos booleanos). O API retornos JSON com texto e imagens extraídos (imagens em Base64Use-o quando precisar de texto e imagens em uma única chamada, ou apenas de um deles.
Principais características
- Texto e/ou imagens: extractText e extractImages Permite solicitar apenas texto, apenas imagens ou ambos.
- JSON respostaTexto e imagens incorporadas (Base64) em um formato estruturado.
- Assíncrono: Usar async para PDFs com muitas páginas ou muitas imagens.
:::dica Ideal para Use quando precisar de texto e imagens de um PDF em uma única solicitação. Para texto somente com padrões regex, use Extrair texto por expressão; para tabelas use Extrair tabela de PDF. :::
API parâmetros
| Parâmetro | Tipo | Obrigatório | Descrição |
|---|---|---|---|
| api-key | corda | Sim | Seu PDF4me API chave, Base64 codificado. Obtenha-o do painel. |
| docContent | base64 | Sim | PDF conteúdo do arquivo (Base64). |
| docName | corda | Sim | PDF Nome do arquivo com extensão .pdf. |
| extractText | booleano | Sim | Extrair o conteúdo do texto a partir de PDF. |
| extractImages | booleano | Sim | Extrair imagens incorporadas do PDF. |
| async | booleano | Não | Ativar o processamento assíncrono. |
Quando usar Extrair Recursos
- Extração de conteúdoObtenha texto e imagens de um PDF em uma única solicitação de análise ou reaproveitamento.
- Coleta de imagensExtrair imagens incorporadas (logotipos, gráficos) para reutilização ou indexação.
- Texto + recursos: Reunir texto e imagens para pesquisa, arquivamento ou migração.
Para esquemas de requisição/resposta e exemplos de código, consulte Extrair recursos no PDF4me API documentos.
Pré-requisitos
Antes de usar este endpoint, certifique-se de que você possui:
- Um válido PDF4me API chave (Adquira o seu API Chave)
- A PDF documento em Base64 formato ou um público URL para um PDF arquivo
Formato de resposta
O API retorna um JSON resposta com conteúdo de texto extraído e imagens incorporadas em Base64 formato.