跳到主要内容

提取资源

提炼提取资源

提取资源 API 从文本中提取文本和/或嵌入的图像 PDF你发送 PDF 作为 Base64docContent), docNameextractText (真/假) extractImages (真/假),以及可选的 async。 这 API 返回 JSON 提取文本和图像(Base64请使用下面的测试工具进行尝试;更多详情请参见后续章节。

尝试提取资源 API

:::备注 快速参考 终点: POST /api/v2/ExtractResources · 必需的: api-keydocContentdocNameextractTextextractImages :::

在线体验

使用下方表格提交您的 API 钥匙, PDFBase64),并选择提取文本、图像或两者都提取。响应是 JSON 包含文字和/或图像 Base64无需编写代码:填写字段并点击 发送请求.

Loading API Tester...

概述、参数和用例

什么是资源提取?

此端点从文本中提取文本内容和/或嵌入的图像。 PDF您可以选择要提取的内容。 extractTextextractImages (均为布尔值)。 API 返回 JSON 提取文本和图像(图像在 Base64当您需要在一次调用中同时发送文本和图像,或者只需要其中一种时,请使用此功能。

主要特点

  • 文字和/或图片extractTextextractImages 允许您请求仅文本、仅图像或两者都请求。
  • JSON 回复:文本和嵌入式图像(Base64)以结构化格式。
  • 异步: 使用 async 为了 PDFs 包含多页或多张图片。

提示:最适合

当您需要同时从文本和图像中获取内容时,请使用此方法。 PDF 一次请求即可完成。对于仅包含正则表达式模式的文本,请使用 通过表达式提取文本;对于表格,请使用 从表格中提取信息 PDF.

:::

先决条件

使用此端点之前,请确保您已具备以下条件:

  • 有效的 PDF4me API 钥匙 (获得你的 API 钥匙
  • A PDF 文档 Base64 格式或公共 URL 一个 PDF 文件

回复格式

API 返回一个 JSON 响应中包含提取的文本内容和嵌入的图像 Base64 格式。

获取帮助