跳到主要内容

分类文件

PDF4me 分类文件 使您能够根据文档内容对其进行分类和识别。 API 服务流程 PDF 它分析文件并研究文档结构、内容模式和元数据,以确定文档类型和类别。 API 接收 PDF 通过内容 REST API 利用电话 Base64 采用编码技术实现安全传输。该解决方案支持文档类型识别和自动分类,是文档管理系统和自动化工作流程的理想之选。

相关博客文章
目前尚无关于此功能的博客文章——敬请期待。
在此期间,您可以浏览 PDF4me 博客,查看适用于各平台的教程和工作流程。
访问博客

验证您的身份 API 要求

要访问 PDF4me REST API每个请求都必须包含正确的身份验证凭据。身份验证可确保通信安全,并验证您作为授权用户的身份。 REST API

主要特点

  • 文件分类基于内容分析识别和分类文档类型
  • 内容分析分析文档结构、内容模式和元数据
  • 多种文档类型支持各种 PDF 文档格式
  • 自动化处理:无需人工干预即可简化文档分类
  • 简单的 API 一体化RESTful API 专为自动化文档处理工作流程而设计

REST API 端点

PDF4me REST API 使用标准 HTTP 与资源交互的方法。所有文档分类操作均通过单个端点执行:

  • 方法: POST
  • 终点: /api/v2/ClassifyDocument

REST API 参数

分类文档的完整参数列表 REST API参数按类别组织,以便更好地理解和实施。

重要的: 标有星号 (*) 的参数为必填项,必须提供。 API 正常运作。

必需参数

范围类型描述例子
docContent*Base64String输入的内容 PDF 文件编码为 Base64 文档分析和分类处理格式JVBERi...
docName*String来源 PDF 文件名应带有正确的 .pdf 扩展名,以便识别和处理文档。output.pdf

可选参数

范围类型描述例子
asyncBoolean启用异步处理。 true, 这 API 返回 202 Accepted 与一个 Location 用于轮询结果的标头true

输出

PDF4me 分类文件 REST API 根据处理模式的不同,会返回不同的响应。 API 返回分类数据作为 JSON 回复

同步处理(默认)

什么时候 asyncfalse 或者未提供, API 立即返回分类结果。

状态码: 200 OK

回复格式:

{
"documentType": "invoice",
"category": "financial",
"confidence": 0.95,
"metadata": {
"pageCount": 1,
"createdDate": "2024-01-15T10:30:00Z"
}
}

响应包含分类数据,包括文档类型、类别、置信度评分和元数据信息。

请求示例

标题

Content-Type: application/json
Authorization: Basic YOUR_BASE64_ENCODED_API_KEY

笔记:

  • 获得你的 API 钥匙 PDF4me 仪表板
  • API 关键必须是 Base64 编码后以“Basic”为前缀 Authorization 标题
  • 例如:如果你的 API 关键是 abc123将其编码为 Base64 并使用 Authorization: Basic YWJjMTIz

有效载荷

基本请求:

{
"docContent": "JVBERi0xLjQKJeLjz9MKMSAwIG9iago8PAovVHlwZSAvQ2F0YWxvZwovUGFnZXMgMiAwIFIKPj4KZW5kb2JqCjIgMCBvYmoKPDwKL1R5cGUgL1BhZ2VzCi9LaWRzIFszIDAgUl0KL0NvdW50IDEKPD4KZW5kb2JqCjMgMCBvYmoKPDwKL1R5cGUgL1BhZ2UKL1BhcmVudCAyIDAgUgovTWVkaWFCb3ggWzAgMCA2MTIgNzkyXQovUmVzb3VyY2VzIDw8Ci9Gb250IDw8Ci9GMSA0IDAgUgo+Pgo+PgovQ29udGVudHMgNSAwIFIKPj4KZW5kb2JqCjQgMCBvYmoKPDwKL1R5cGUgL0ZvbnQKL1N1YnR5cGUgL1R5cGUxCi9CYXNlRm9udCAvSGVsdmV0aWNhCj4+CmVuZG9iago1IDAgb2JqCjw8Ci9MZW5ndGggNDQKPj4Kc3RyZWFtCkJUCi9GMSAxMiBUZgoxMDAgNzAwIFRkCihIZWxsbyBXb3JsZCkgVGoKRVQKZW5kc3RyZWFtCmVuZG9iagp4cmVmCjAgNgowMDAwMDAwMDAwIDY1NTM1IGYgCjAwMDAwMDAwMDkgMDAwMDAgbiAKMDAwMDAwMDA1NCAwMDAwMCBuIAowMDAwMDAwMTAxIDAwMDAwIG4gCjAwMDAwMDAxNzAgMDAwMDAgbiAKMDAwMDAwMDI0NCAwMDAwMCBuIAp0cmFpbGVyCjw8Ci9TaXplIDYKL1Jvb3QgMSAwIFIKPj4Kc3RhcnR4cmVmCjM0MQolJUVPRg==",
"docName": "output.pdf"
}

使用异步处理:

{
"docContent": "JVBERi0xLjQKJeLjz9MK...",
"docName": "output.pdf",
"async": true
}

代码示例

PDF4me 分类文件 REST API 提供多种编程语言的代码示例。请选择最适合您开发环境的语言:

C# (CSharp) 示例

完全的 C# 文档分类实现:

文档分类特征

分类能力

  • 文档类型检测基于内容分析的文档类型识别
  • 内容分类按内容和目的对文档进行分组
  • 模板识别:识别文档模板和标准格式
  • 合规性分类:监管和合规要求的分类

企业功能

  • 批量处理:使用一致的分类标准处理多个文档
  • 质量保证确保业务应用的分类准确性和可靠性
  • 已准备好集成与现有文档管理系统无缝集成
  • 可扩展处理以企业级性能处理大量文档

行业应用案例及应用

文档管理与组织应用案例

  • 自动归档自动对数字文件系统中的文档进行分类和整理
  • 内容管理内容管理和检索系统的高级分类
  • 档案组织历史文献和记录的系统分类
  • 搜索优化通过准确的分类和标记增强文档搜索功能

获取帮助