跳到主要内容

按表达式提取文本 Power Automate

PDF4me 通过表达式提取文本 操作从中检索特定的文本模式 PDF 文件 Power Automate 利用强大的正则表达式匹配功能,这项精准提取功能可以针对发票号码、电子邮件地址、电话号码、日期和自定义格式等精确数据模式,并提供页面级控制,将匹配的文本以数组形式返回,以便进行跨页面的自动化数据处理和验证。 Microsoft 365 工作流程。

相关博客文章
目前尚无关于此功能的博客文章——敬请期待。
在此期间,您可以浏览 PDF4me 博客,查看适用于各平台的教程和工作流程。
访问博客

验证您的身份 API 要求

要访问 PDF4me 网站 API 通过 Power Automate每个请求都必须包含正确的身份验证凭据。身份验证可确保通信安全,并验证您作为授权用户的身份,从而实现与您的系统之间的无缝集成。 Power Automate 流量和 PDF4me强大的基于模式的提取服务。

Power Automate 通过表达式提取文本

主要特点

  • 正则表达式支持使用正则表达式模式进行精确的文本匹配
  • 基于模式的提取针对特定数据格式和结构
  • 页面特定控制:从特定页面或所有页面提取内容
  • Array 输出:接收所有匹配项作为数组以供迭代
  • 多场比赛提取文档中所有出现的模式

参数

以下是“按表达式提取文本”操作的完整参数列表。配置这些参数可控制模式提取。

重要的: 标有星号 (***) 的参数是必需的,必须提供这些参数才能使操作正常运行。

范围类型描述例子
文件内容***二进制来源 PDF 文件内容
• 地图 PDF 先前操作的文件
• 必须包含用于模式匹配的文本
• 支持 PDF来自 SharePointOneDrive, 电子邮件
• 可以从流中动态检索
[File Content from Get File]
文件名***StringPDF 文档名称
• 名称 PDF 文件
• 用于处理身份识别
• 应包含 .pdf 扩展名
• 支持动态命名
Invoice.pdf
表达***String正则表达式模式
• 用于匹配文本的正则表达式模式
• 使用标准正则表达式语法
• 例如: \\d{3}-\\d{3}-\\d{4} 手机方面, INV-\\d{5} 发票号码
• 必须是有效的正则表达式模式
INV-\\d{5}
页面顺序***String页面选择
• 需要提取内容的页面
• 使用数字: 1,2,3 针对特定页面
• 使用 all 所有页面
• 使用范围: 1-5 页面范围
all

输出

PDF4me 通过表达式提取文本 操作返回全面的输出数据,以实现无缝连接。 Power Automate 流量整合:

表格视图

以结构化表格格式呈现的响应数据:

范围类型描述
文本列表ArrayStrings包含表达式找到的所有文本匹配项的数组

工作流程示例

PDF4me 通过表达式提取文本 行动 Power Automate 提供专为实际业务场景设计的全面工作流程模板:

自动提取和验证发票号码

通过自动提取发票号码,革新发票处理流程:

完整工作流程步骤:

  1. 扳机: 发票 PDF 通过电子邮件收到
  2. 获取发票: 提炼 PDF 来自电子邮件附件
  3. 提取发票号码使用正则表达式 INV-\\d{5} 查找发票号码
  4. 验证格式检查提取的数字是否符合预期格式
  5. 检查重复项查询数据库中已有的发票号码
  6. 如果新在会计工作流程中处理新发票
  7. 如果重复标记为待审核并通知AP团队
  8. 存档发票:以提取的发票编号作为元数据存储

商业优势:

  • 每月从 300 多张发票中提取发票号码
  • 防止重复发票处理
  • 减少100%的人工数字输入错误
  • 发票验证速度提升 80%

行业应用案例及应用

财务与会计应用案例

  • 发票号码提取发票和订单号
  • 账号从报表中解析账户标识符
  • 交易 ID提取交易参考编号
  • 提取量从文档中解析货币值

获取帮助