跳到主要内容

从附件中提取 PDF 文件恢复 API

PDF4me 从附件中提取 PDF 使您能够提取嵌入在文件中的所有附件。 PDF 文件。这 API 服务流程 PDF 从文件中提取嵌入的文件、文档和资源 PDF 文件。 API 接收 PDF 通过内容 REST API 利用电话 Base64 用于安全传输的编码。支持从中提取多种文件类型。 PDF 对于文档而言,此解决方案是文档管理系统和文件提取工作流程的理想选择。

相关博客文章
目前尚无关于此功能的博客文章——敬请期待。
在此期间,您可以浏览 PDF4me 博客,查看适用于各平台的教程和工作流程。
访问博客

验证您的身份 API 要求

要访问 PDF4me REST API每个请求都必须包含正确的身份验证凭据。身份验证可确保通信安全,并验证您作为授权用户的身份。 REST API

主要特点

  • 文件提取从文件中提取所有嵌入的文件、文档和资源 PDF 文件
  • 多种文件类型支持多种附件格式,包括文本、图像、文档和压缩文件。
  • 批量萃取从单个文件中提取多个附件 PDF 一次操作即可完成文档处理
  • Base64 编码:使用安全文件内容传输 Base64 编码
  • 简单的 API 一体化RESTful API 专为自动化文档提取工作流程而设计

REST API 端点

PDF4me REST API 使用标准 HTTP 与资源交互的方法。所有附件提取操作均通过单个端点执行:

  • 方法: POST
  • 终点: /api/v2/ExtractAttachmentFromPdf

REST API 参数

从附件提取的完整参数列表 PDF REST API参数按类别组织,以便更好地理解和实施。

重要的: 标有星号 (*) 的参数为必填项,必须提供。 API 正常运作。

必需参数

范围类型描述例子
docContent*Base64String输入的内容 PDF 文件编码为 Base64 附件提取和文件恢复处理的格式JVBERi...
docName*String来源 PDF 文件名应带有正确的 .pdf 扩展名,以便进行文档识别和附件提取处理。output.pdf

可选参数

范围类型描述例子
asyncBoolean启用异步处理。 true, 这 API 返回 202 Accepted 与一个 Location 用于轮询结果的标头true

输出

PDF4me 从附件中提取 PDF REST API 根据处理模式的不同,会返回不同的响应。 API 返回提取的附件数据。 JSON 回复 或者作为 ZIP 文件 包含所有提取的附件。

同步处理(默认)

什么时候 asyncfalse 或者未提供, API 立即返回提取的附件结果。

状态码: 200 OK

回复格式:

{
"outputDocuments": [
{
"fileName": "attachment1.txt",
"streamFile": "base64-encoded-file-content..."
},
{
"fileName": "attachment2.pdf",
"streamFile": "base64-encoded-file-content..."
}
]
}

响应包含一个提取的附件数组,每个附件都有一个 fileNamestreamFileBase64编码内容)。

请求示例

标题

Content-Type: application/json
Authorization: Basic YOUR_BASE64_ENCODED_API_KEY

笔记:

  • 获得你的 API 钥匙 PDF4me 仪表板
  • API 关键必须是 Base64 编码后以“Basic”为前缀 Authorization 标题
  • 例如:如果你的 API 关键是 abc123将其编码为 Base64 并使用 Authorization: Basic YWJjMTIz

有效载荷

基本请求:

{
"docContent": "JVBERi0xLjQKJeLjz9MKMSAwIG9iago8PAovVHlwZSAvQ2F0YWxvZwovUGFnZXMgMiAwIFIKPj4KZW5kb2JqCjIgMCBvYmoKPDwKL1R5cGUgL1BhZ2VzCi9LaWRzIFszIDAgUl0KL0NvdW50IDEKPD4KZW5kb2JqCjMgMCBvYmoKPDwKL1R5cGUgL1BhZ2UKL1BhcmVudCAyIDAgUgovTWVkaWFCb3ggWzAgMCA2MTIgNzkyXQovUmVzb3VyY2VzIDw8Ci9Gb250IDw8Ci9GMSA0IDAgUgo+Pgo+PgovQ29udGVudHMgNSAwIFIKPj4KZW5kb2JqCjQgMCBvYmoKPDwKL1R5cGUgL0ZvbnQKL1N1YnR5cGUgL1R5cGUxCi9CYXNlRm9udCAvSGVsdmV0aWNhCj4+CmVuZG9iago1IDAgb2JqCjw8Ci9MZW5ndGggNDQKPj4Kc3RyZWFtCkJUCi9GMSAxMiBUZgoxMDAgNzAwIFRkCihIZWxsbyBXb3JsZCkgVGoKRVQKZW5kc3RyZWFtCmVuZG9iagp4cmVmCjAgNgowMDAwMDAwMDAwIDY1NTM1IGYgCjAwMDAwMDAwMDkgMDAwMDAgbiAKMDAwMDAwMDA1NCAwMDAwMCBuIAowMDAwMDAwMTAxIDAwMDAwIG4gCjAwMDAwMDAxNzAgMDAwMDAgbiAKMDAwMDAwMDI0NCAwMDAwMCBuIAp0cmFpbGVyCjw8Ci9TaXplIDYKL1Jvb3QgMSAwIFIKPj4Kc3RhcnR4cmVmCjM0MQolJUVPRg==",
"docName": "output.pdf"
}

使用异步处理:

{
"docContent": "JVBERi0xLjQKJeLjz9MK...",
"docName": "output.pdf",
"async": true
}

代码示例

PDF4me 从附件中提取 PDF REST API 提供多种编程语言的代码示例。请选择最适合您开发环境的语言:

C# (CSharp) 示例

完全的 C# 从……提取附件的实现 PDF

附件提取功能

文件恢复功能

  • 完全提取从文件中提取所有嵌入的文件和资源 PDF 文件
  • 文件类型检测自动识别嵌入式文件类型和格式
  • 元数据保存保留原始文件名、创建日期和属性
  • 质量保证确保文件完整性并正确提取,避免文件损坏

文档处理

  • PDF 分析深入分析 PDF 用于定位嵌入式附件的结构
  • 资源识别智能检测各种嵌入式文件类型
  • 批量萃取处理来自单个文件的多个附件 PDF 一次操作
  • 安全处理安全提取并验证文件完整性

高级功能

  • 多格式支持提取文档、图像、压缩文件和多媒体文件
  • 文件整理提取过程中请保持正确的文件命名和组织结构
  • 内容验证验证提取文件的完整性和准确性
  • 专业成果适用于企业应用的高质量萃取

行业应用案例及应用

文档管理与恢复用例

  • 存档恢复从已存档的 PDF 文档中提取文件以进行数据恢复
  • 内容管理从文档管理系统中检索嵌入式资源
  • 文件整理从复杂的 PDF 包中提取和整理文件
  • 数据迁移在文档迁移过程中提取附件

获取帮助