跳到主要内容

分裂 PDF 按文本 Power Automate

PDF4me 分裂 PDF 通过文本 操作自动分离 PDF 通过在文档内容中搜索特定文本短语来查找文档 Power Automate这项智能拆分功能会扫描文档文本中的唯一标识符、章节标题、小节标题或关键词,并在匹配页面之前或之后进行拆分,从而实现基于内容标记的自动文档组织,非常适合用于报告分段、文档路由和基于内容的跨平台分离。 Microsoft 365 工作流程。

相关博客文章
目前尚无关于此功能的博客文章——敬请期待。
在此期间,您可以浏览 PDF4me 博客,查看适用于各平台的教程和工作流程。
访问博客

验证您的身份 API 要求

要访问 PDF4me 网站 API 通过 Power Automate每个请求都必须包含正确的身份验证凭据。身份验证可确保通信安全,并验证您作为授权用户的身份,从而实现与您的系统之间的无缝集成。 Power Automate 流量和 PDF4me强大的基于文本的拆分服务。

Power Automate 按文本拆分 PDF

主要特点

  • 文本搜索拆分查找并拆分包含特定文本的页面
  • 短语检测在文档内容中搜索独特的短语
  • 分体式控制选择在匹配页面之前或之后拆分
  • 基于内容的路由按文本标记自动整理文档
  • 批量处理根据文本模式拆分多个文档

参数

Split 的完整参数列表 PDF 按文本操作。配置这些参数以控制基于文本的拆分。

重要的: 标有星号 (***) 的参数是必需的,必须提供这些参数才能使操作正常运行。

范围类型描述例子
文件内容***二进制来源 PDF 内容
• 地图 PDF 先前操作的文件内容
PDF 必须包含可搜索文本
• 可以来自 SharePointOneDrive, 电子邮件
• 必须有效 PDF 文档
[File Content from Get File]
文件名***StringPDF 文档名称
• 源文件名需包含正确的文件扩展名
• 用于处理身份识别
• 必须包含 .pdf 扩展名
• 支持动态命名
Report.pdf
文本***String搜索文本短语
• 使用哪个文本 PDF 需要拆分
• 应为文档中的唯一标识符
• 区分大小写的文本匹配
• 例如:“章节”、“部门:”、“发票号”
Chapter
分体式***选项分体位置
- PDF 在带有文本的页面之前分割。
- PDF 在包含文本的页面之后分割。
• 控制文本页是与上一个文档还是下一个文档一起显示。
Before

输出

PDF4me 分裂 PDF 通过文本 操作返回全面的输出数据,以实现无缝连接。 Power Automate 流量整合:

表格视图

以结构化表格格式呈现的响应数据:

范围类型描述
文件内容二进制分裂 PDF 通过文本检测分隔文档
文件名String每个拆分的名称 PDF 文档

工作流程示例

PDF4me 分裂 PDF 通过文本 行动 Power Automate 提供专为实际业务场景设计的全面工作流程模板:

自动化书籍章节分离工作流程

利用自动章节分割功能改进图书处理流程:

完整工作流程步骤:

  1. 扳机完整书籍 PDF 已上传进行处理
  2. 获取书籍获取完整书籍 PDFSharePoint
  3. 按章节划分搜索“章节”文本并在其之前拆分。
  4. 适用于每个逐章处理
  5. 摘录章节编号从首页解析章节号
  6. 重命名文件用章节编号命名每个文件。
  7. 上传章节将各个章节保存到图书馆
  8. 创建索引:构建包含文件引用的章节索引

商业优势:

  • 每月自动将 20 多本书分成章节。
  • 支持单独章节分发和访问
  • 图书处理时间缩短90%
  • 便于章节级内容管理

行业应用案例及应用

出版与媒体应用案例

  • 章节分离按章节标记分割书籍
  • 章节提取按文章标题分类杂志
  • 内容组织按内容标记拆分出版物
  • 文档分割按文本标题整理文档

获取帮助