Extraction des ressources
Extrait → Extraction des ressources
Le Extraction des ressources API extrait du texte et/ou des images intégrées d'un PDFVous envoyez le PDF comme Base64 (docContent), docName, extractText (vrai/faux), extractImages (vrai/faux), et éventuellement async. Le API retours JSON avec du texte et des images extraits (Base64Utilisez l'outil de test ci-dessous pour l'essayer ; vous trouverez plus de détails dans les sections suivantes.
Essayez l'extraction de ressources API
Point final : POST /api/v2/ExtractResources · Requis: api-key, docContent, docName, extractText, extractImages
Utilisez le formulaire ci-dessous pour envoyer votre API clé, PDF (Base64), et choisissez si vous souhaitez extraire du texte, des images ou les deux. La réponse est JSON avec du texte et/ou des images dans Base64Aucun code requis : remplissez les champs et cliquez Envoyer une requête.
Aperçu, paramètres et cas d'utilisation
- Overview
- Parameters
- Use cases
Qu'est-ce que l'extraction de ressources ?
Ce point de terminaison extrait le contenu textuel et/ou les images intégrées d'un PDFVous choisissez ce que vous souhaitez extraire via extractText et extractImages (les deux booléens). API retours JSON avec du texte et des images extraits (images dans Base64Utilisez-le lorsque vous avez besoin à la fois de texte et d'images dans un seul appel, ou seulement de l'un ou de l'autre.
Caractéristiques principales
- Texte et/ou images: extractText et extractImages vous permet de demander uniquement du texte, uniquement des images, ou les deux.
- JSON réponse: Texte et images intégrées (Base64) dans un format structuré.
- Asynchrone: Utiliser async pour PDFs avec de nombreuses pages ou de nombreuses images.
À utiliser lorsque vous avez besoin à la fois de texte et d'images provenant d'un PDF en une seule requête. Pour le texte uniquement avec des modèles d'expressions régulières, utilisez Extraire du texte par expression; pour les tableaux utiliser Extraire le tableau de PDF.
API paramètres
| Paramètre | Taper | Requis | Description |
|---|---|---|---|
| api-key | chaîne | Oui | Ton PDF4me API clé, Base64 encodé. Récupérez-le depuis le tableau de bord. |
| docContent | base64 | Oui | PDF contenu du fichier (Base64). |
| docName | chaîne | Oui | PDF Nom du fichier avec l'extension .pdf. |
| extractText | booléen | Oui | Extraire le contenu textuel du PDF. |
| extractImages | booléen | Oui | Extraire les images intégrées de PDF. |
| async | booléen | Non | Activer le traitement asynchrone. |
Quand utiliser l'extraction de ressources
- Extraction de contenuRécupérez à la fois le texte et les images d'un PDF en un seul appel à l'analyse ou à la réutilisation.
- Collecte d'imagesExtraire les images intégrées (logos, graphiques) pour les réutiliser ou les indexer.
- Texte + ressourcesRassemblez textes et images à des fins de recherche, d'archivage ou de migration.
Pour les schémas de requête/réponse et des exemples de code, voir Extraction des ressources dans le PDF4me API documents.
Prérequis
Avant d'utiliser ce point de terminaison, assurez-vous d'avoir :
- Un valide PDF4me API clé (Obtenez votre API Clé)
- UN PDF document dans Base64 format ou public URL à un PDF déposer
Format de réponse
Le API renvoie un JSON réponse avec contenu textuel extrait et images intégrées dans Base64 format.