Extraer recursos
Extracto → Extraer recursos
El Extraer recursos API extrae texto y/o imágenes incrustadas de un PDF. Tú envías el PDF como Base64 (docContent), docName, extractText (verdadero/falso), extractImages (verdadero/falso) y opcionalmente async. El API devoluciones JSON con texto e imágenes extraídos (Base64Utilice el probador que aparece a continuación para probarlo; encontrará más detalles en las secciones siguientes.
Pruebe los recursos de extracción API
:::nota Referencia rápida
Punto final: POST /api/v2/ExtractResources · Requerido: api-key, docContent, docName, extractText, extractImages
:::
Utiliza el formulario a continuación para enviar tu solicitud API llave, PDF (Base64), y elige si deseas extraer texto, imágenes o ambos. La respuesta es JSON con texto y/o imágenes en Base64No se requiere código: complete los campos y haga clic. Enviar solicitud.
Descripción general, parámetros y casos de uso
- Overview
- Parameters
- Use cases
¿Qué es la extracción de recursos?
Este punto final extrae contenido de texto y/o imágenes incrustadas de un PDF. Usted elige qué extraer mediante extractText y extractImages (ambos booleanos). El API devoluciones JSON con texto e imágenes extraídos (imágenes en Base64Úselo cuando necesite texto e imágenes en una sola llamada, o solo uno de ellos.
Características principales
- Texto y/o imágenes: extractText y extractImages Te permite solicitar solo texto, solo imágenes o ambas cosas.
- JSON respuesta: Texto e imágenes incrustadas (Base64) en un formato estructurado.
- Asíncrono: Usar async para PDFs con muchas páginas o muchas imágenes.
Usar cuando se necesitan tanto texto como imágenes de un PDF en una sola solicitud. Para texto solamente con patrones de expresiones regulares use Extraer texto por expresión; para tablas use Extraer tabla de PDF.
API parámetros
| Parámetro | Tipo | Requerido | Descripción |
|---|---|---|---|
| api-key | cadena | Sí | Su PDF4me API llave, Base64 codificado. Consíguelo desde el panel. |
| docContent | base64 | Sí | PDF contenido del archivo (Base64). |
| docName | cadena | Sí | PDF Nombre del archivo con extensión .pdf. |
| extractText | booleano | Sí | Extraer contenido de texto del PDF. |
| extractImages | booleano | Sí | Extraer imágenes incrustadas de la PDF. |
| async | booleano | No | Habilitar el procesamiento asíncrono. |
Cuándo utilizar la extracción de recursos
- Extracción de contenido: Obtener texto e imágenes de un PDF en una sola llamada para análisis o reutilización.
- Recolección de imágenes: Extraer imágenes incrustadas (logotipos, gráficos) para su reutilización o indexación.
- Texto + recursos: Reúne texto e imágenes para su búsqueda, archivo o migración.
Para ver esquemas de solicitud/respuesta y ejemplos de código, consulte Extraer recursos en el PDF4me API documentos.
Requisitos previos
Antes de utilizar este punto final, asegúrese de tener:
- Un válido PDF4me API llave (Consigue tu API Llave)
- A PDF documento en Base64 formato o público URL a un PDF archivo
Formato de respuesta
El API devuelve un JSON respuesta con contenido de texto extraído e imágenes incrustadas en Base64 formato.