提取资源
提炼 → 提取资源
这 提取资源 API 从文本中提取文本和/或嵌入的图像 PDF你发送 PDF 作为 Base64 (docContent), docName, extractText (真/假) extractImages (真/假),以及可选的 async。 这 API 返回 JSON 提取文本和图像(Base64请使用下面的测试工具进行尝试;更多详情请参见后续章节。
尝试提取资源 API
:::备注 快速参考
终点: POST /api/v2/ExtractResources · 必需的: api-key, docContent, docName, extractText, extractImages
:::
在线体验
使用下方表格提交您的 API 钥匙, PDF (Base64),并选择提取文本、图像或两者都提取。响应是 JSON 包含文字和/或图像 Base64无需编写代码:填写字段并点击 发送请求.
Loading API Tester...
概述、参数和用例
- Overview
- Parameters
- Use cases
什么是资源提取?
此端点从文本中提取文本内容和/或嵌入的图像。 PDF您可以选择要提取的内容。 extractText 和 extractImages (均为布尔值)。 API 返回 JSON 提取文本和图像(图像在 Base64当您需要在一次调用中同时发送文本和图像,或者只需要其中一种时,请使用此功能。
主要特点
- 文字和/或图片: extractText 和 extractImages 允许您请求仅文本、仅图像或两者都请求。
- JSON 回复:文本和嵌入式图像(Base64)以结构化格式。
- 异步: 使用 async 为了 PDFs 包含多页或多张图片。
提示:最适合
当您需要同时从文本和图像中获取内容时,请使用此方法。 PDF 一次请求即可完成。对于仅包含正则表达式模式的文本,请使用 通过表达式提取文本;对于表格,请使用 从表格中提取信息 PDF.
:::
先决条件
使用此端点之前,请确保您已具备以下条件:
- 有效的 PDF4me API 钥匙 (获得你的 API 钥匙)
- A PDF 文档 Base64 格式或公共 URL 一个 PDF 文件
回复格式
这 API 返回一个 JSON 响应中包含提取的文本内容和嵌入的图像 Base64 格式。