跳到主要内容

分裂 PDF 按文本 - 内容分割器 API

PDF4me 分裂 PDF 通过文本 是一个功能强大的企业级解决方案,它可以拆分 PDF 通过高级技术搜索特定文本模式来查找文档 API 整合。这种全面的 PDF 拆分服务高效处理 PDF 包含文本内容的文档,提供智能文本识别、自动页面过滤、精确文档分割和高级功能。 PDF 增强文档管理和自动化处理工作流程的处理能力。 API 流程 PDF 按接收源拆分 PDF 通过文件 REST API 通话时,利用先进的文本识别技术和智能过滤算法,实现精准的文档分割和专业处理。 PDF 全面支持文本识别、智能页面过滤、自动文档分割和专业处理。 PDF 该解决方案非常适合文档管理、自动化处理、基于文本的拆分和企业级处理。 PDF 需要可靠文档拆分、保证准确性和一致输出质量的工作流程。拆分 PDF 通过文本文件轻松操作 API 高级 PDF 处理和文档管理。

相关博客文章
目前尚无关于此功能的博客文章——敬请期待。
在此期间,您可以浏览 PDF4me 博客,查看适用于各平台的教程和工作流程。
访问博客

验证您的身份 API 要求

要访问 PDF4me REST API每个请求都必须包含正确的身份验证凭据。身份验证可确保通信安全,并验证您作为授权用户的身份。 REST API

主要特点

  • 文本识别:来自智能文本识别和模式匹配 PDF 文件
  • 自动分割: 分裂 PDF 根据特定文本模式和筛选条件生成文档
  • 页面筛选:利用文本内容筛选页面,实现精确的文档拆分
  • 质量保持: 维持 PDF 劈裂作业期间的质量
  • 专业成果: 高质量 PDF 使用精确的文本识别进行分割
  • 无缝的 API 一体化RESTful API 专为自动化而设计 PDF 处理工作流程和企业系统集成

REST API 端点

PDF4me REST API 使用标准 HTTP 与资源交互的方法。全部基于文本。 PDF 拆分操作通过单个端点执行:

  • 方法: POST
  • 终点: /api/v2/SplitByText

支持 PDF 分割功能

API 为各种 PDF 文本分割和处理功能:

文本处理

  • 文本识别:来自智能文本识别和模式匹配 PDF 文件
  • 模式匹配:搜索特定文本模式和内容,以进行过滤和拆分操作
  • 多种格式支持多种文本格式和内容类型
  • 专业成果高质量文本识别,模式匹配准确
  • 高级处理支持复杂文本结构和识别要求

文档拆分

  • 自动分割: 分裂 PDF 根据特定文本模式和筛选条件生成文档
  • 页面筛选:利用文本内容筛选页面,实现精确的文档拆分
  • 智能处理:基于文本的页面识别的智能文档分割
  • 专业成果: 高质量 PDF 精确分页
  • 高级处理支持复杂的文档结构和拆分需求

内容处理

  • 质量保持: 维持 PDF 劈裂作业期间的质量
  • 格式支持支持各种 PDF 格式和文档类型
  • 专业提升: 高质量 PDF 采用精确分割法进行处理
  • 灵活选项:可根据特定要求定制处理参数

REST API 参数

Split 的完整参数列表 PDF 通过文本 REST API参数按类别组织,以便更好地理解和实施。

重要的: 标有星号 (*) 的参数为必填项,必须提供。 API 正常运作。

必需参数

范围类型描述例子
文件内容*Base64完整的内容 PDF 文档编码 Base64 用于基于文本的分割处理的格式。此参数包含全部内容。 PDF 文本识别、页面过滤和文档拆分工作流程所需的文件数据。对安全文档处理至关重要。 API-基于 PDF 拆分操作。JVBERi...
文件名*String来源 PDF 用于文本分割操作的文档文件名,需包含正确的 .pdf 扩展名。此参数用于标识文本识别、页面过滤和文档分割工作流程的输入文档。此参数是文档识别和处理流程管理所必需的。 PDF 拆分操作。document.pdf
文本*String要搜索并用作分割标准的特定文本模式或内容 PDF 文档。此参数支持文本模式匹配,可实现精确的页面识别和拆分操作。它支持自动文档拆分、内容管理和基于文本的处理工作流程,并具备精确的模式匹配功能。Chapter 1
分页文本*String指定检测到文本模式时的页面拆分行为。此参数控制如何…… PDF 当满足文本条件时进行分割,从而可以精确控制基于文本的处理工作流程中的文档分割逻辑和页面分离。After
文件命名*String指定拆分的命名约定 PDF 文件。此参数控制输出文件的命名方式,从而实现拆分文档的文件命名和组织方式的一致性。支持多种命名模式,以便更好地管理和组织文件。document_part_{page}

输出

PDF4me 分裂 PDF 通过文本 REST API 返回的结果可以以多种格式查看。请选择最符合您需求的视图:

JSON 回复格式

原始 JSON 来自 API

{
"File Content": "Output file content from the PDF4me action",
"File Name": "Output file name from the PDF4me action"
}

请求示例

标题

Content-Type: application/json
Authorization: YOUR_API_KEY

笔记: 获得你的 API 钥匙 PDF4me 仪表板

有效载荷

{
"docContent": "Please put PDF base64 content",
"docName": "output.pdf",
"text": "Nadal, who officially turned professional in 2001",
"splitTextPage": "before",
"fileNaming": "NameAsPerOrder"
}

代码示例

PDF4me 分裂 PDF 通过文本 REST API 提供多种编程语言的代码示例。请选择最适合您开发环境的语言:

C#CSharp) 样本

完全的 C# 实施 PDF 按文本拆分:

PDF 分割功能

文本处理

  • 文本识别:来自智能文本识别和模式匹配 PDF 文件
  • 模式匹配搜索特定文本模式和内容,以进行过滤和拆分操作
  • 多种格式支持多种文本格式和内容类型
  • 专业成果高质量文本识别,模式匹配准确
  • 高级处理支持复杂文本结构和识别要求

文档拆分

  • 自动分割: 分裂 PDF 根据特定文本模式和筛选条件生成文档
  • 页面筛选:利用文本内容筛选页面,实现精确的文档拆分
  • 智能处理:基于文本的页面识别的智能文档分割
  • 专业成果: 高质量 PDF 精确分页
  • 高级处理支持复杂的文档结构和拆分需求

内容处理

  • 质量保持: 维持 PDF 劈裂作业期间的质量
  • 格式支持支持各种 PDF 格式和文档类型
  • 专业提升: 高质量 PDF 采用精确分割法进行处理
  • 灵活选项:可根据特定要求定制处理参数

行业应用案例及应用

用例

  • 文档处理:根据文本标识符拆分大型 PDF 文档以进行自动化处理
  • 章节处理将书籍或文档 PDF 按章节标题拆分,以实现自动化内容管理
  • 发票处理:按文本模式拆分发票PDF,实现自动化会计工作流程
  • 报告处理按章节标题拆分报告 PDF,实现内容自动整理
  • 遵守按文本标识符拆分合规文档,以便进行自动化监管处理
  • 工作流自动化:实现企业级 PDF 拆分工作流程自动化
  • 内容管理:按文本类别拆分内容文档,以便自动组织
  • 批量处理利用自动化的文本分割功能处理大量文档

获取帮助