跳到主要内容

解析文档

提炼解析文档

解析文档 API 从结构化数据中提取数据 PDF 使用您在其中创建的模板 PDF4me 仪表板。您发送 docContent (可选;如果省略,则文档将通过以下方式获取) docName), docNameTemplateIdGUID) 或者 TemplateNameParseIdGUID),并且(可选地) async。 这 API 返回 JSON 使用已解析的数据(文档类型、页数、提取的字段)。请使用下面的测试工具进行尝试;更多详细信息请参见后续章节。

尝试解析文档 API

:::备注 快速参考 终点: POST /api/v2/ParseDocument · 必需的: api-keydocNameTemplateId (或者 TemplateName), ParseId :::

在线体验

使用下方表格提交您的 API 钥匙, PDFBase64 或被引用 docName)、模板 ID 或名称,以及解析 ID。响应是 JSON 使用已解析的文档数据。无需编写代码,只需填写字段并点击即可。 发送请求.

Loading API Tester...

概述、参数和用例

什么是文档解析?

此端点从中提取结构化数据 PDF 使用 解析模板 你在……中创造 PDF4me 仪表板。您提供 PDFdocContent 可选,如果省略,则文档将通过以下方式获取 docName), docNameTemplateIdGUID) 或者 TemplateName, 和 ParseIdGUID)。 这 API 返回 JSON 根据模板的捕获区域和键,提取文档类型、页数和字段。

主要特点

  • 基于模板在控制面板中创建模板:上传示例 PDF绘制捕获区域,配置键和正则表达式。
  • TemplateId 或者 TemplateName使用模板的 GUID 或从仪表盘上获取名称。
  • ParseId: 独特的 GUID 每个解析操作(客户端生成或使用) API-假如)。
  • 结构化输出JSON 包含文档类型、页数和提取的结构化数据。

获取模板和解析 ID

  1. 使用权 PDF4me 仪表板前往 解析文档 页。
  2. 创建模板点击“添加”,输入模板名称,然后保存。
  3. 配置模板上传模板 PDF绘制捕获区域,配置键和正则表达式,测试解析,然后保存。
  4. 获取模板 ID复制唯一 GUID 您的模板(或使用) TemplateName)。
  5. 生成解析 ID创造一个独特的 GUID 对于每个解析操作(客户端或通过工具)。

:::提示 最适合

当您有重复出现的文档类型(例如发票、表单)且需要结构化提取时,请使用此工具。可与以下工具结合使用: 分类文件 按类型路由,然后使用正确的模板进行解析。

:::

先决条件

使用此端点之前,请确保您已具备以下条件:

  • 有效的 PDF4me API 钥匙 (获得你的 API 钥匙
  • A PDF 文档 Base64 格式或公共 URL 一个 PDF 文件
  • A 解析模板 在您的 PDF4me 仪表板 (创建解析模板
  • 你需要 模板 IDGUID) 或者 模板名称 从您的解析模板
  • A 解析 IDGUID) 用于解析操作

回复格式

API 返回一个 JSON 响应包含已解析的文档数据,包括文档类型、页数和提取的结构化信息。

获取帮助