跳到主要内容

从 Word 中提取文本 Power Automate

PDF4me 从 Word 中提取文本 操作从 Word 文档中检索文本内容 Power Automate 具备高级提取控制选项。这项全面的功能支持指定页面范围(起始页/结束页)、移除注释、接受跟踪更改,并返回文本内容和文本文件,从而实现跨内容分析、数据提取和文本处理。 Microsoft 365 工作流程。

相关博客文章
目前尚无关于此功能的博客文章——敬请期待。
在此期间,您可以浏览 PDF4me 博客,查看适用于各平台的教程和工作流程。
访问博客

验证您的身份 API 要求

要访问 PDF4me 网站 API 通过 Power Automate每个请求都必须包含正确的身份验证凭据。身份验证可确保通信安全,并验证您作为授权用户的身份,从而实现与您的系统之间的无缝集成。 Power Automate 流量和 PDF4me强大的 Word 文本提取服务。

从 Word 文档中提取文本 Power Automate

主要特点

  • 页面范围控制提取特定页面范围内的文本
  • 评论删除:提取前排除评论的选项
  • 轨道找零处理提取前接受跟踪更改
  • 文本文件输出:接收提取的文本,格式为可下载文件
  • 批量处理从多个 Word 文档中提取文本

参数

以下是“从 Word 文档中提取文本”操作的完整参数列表。配置这些参数可以控制文本提取。

重要的: 标有星号 (***) 的参数是必需的,必须提供这些参数才能使操作正常运行。

范围类型描述例子
文件内容***二进制源 Word 文件内容
• 从上一步操作映射 Word 文档
• 必须有效 DOCX 格式
• 支持来自以下来源的文件 SharePointOneDrive, 电子邮件
• 可以从流中动态检索
[File Content from Get File]
文件名***StringWord文档名称
• Word 文件名
• 用于处理身份识别
• 应包含 .docx 扩展名
• 支持动态命名
Document.docx
起始页码String提取起始页
• 开始文本提取的页码
• 特定起始点的数值
• 留空则从头开始
• 可用于提取特定部分
1
页码结束String提取结束页
• 页码到文本末尾提取
• 特定终点的数值
• 留空以便从末端取出
• 可用于提取特定部分
10
删除评论Boolean评论排除控制
真的 - 在提取文本之前移除注释
错误的 - 在提取的文本中包含注释
• 适用于提取干净的文本
• 如果未指定,则默认值为 False
true
接受更改Boolean找零处理
真的 - 提取前接受所有跟踪更改
错误的 - 原样提取更改后的文本
• 有助于最终确定内容
• 如果未指定,则默认值为 False
true

输出

PDF4me 从 Word 中提取文本 操作返回全面的输出数据,以实现无缝连接。 Power Automate 流量整合:

表格视图

以结构化表格格式呈现的响应数据:

范围类型描述
职位编号String提取操作的唯一标识符
文件内容二进制包含提取文本的文本文件内容
文本String提取的文本内容为字符串

工作流程示例

PDF4me 从 Word 中提取文本 行动 Power Automate 提供专为实际业务场景设计的全面工作流程模板:

自动化文档内容分析工作流程

利用自动化文本提取和分析技术改进内容审核:

完整工作流程步骤:

  1. 扳机政策文件已上传以供审核
  2. 获取文档从以下位置检索 Word 文档 SharePoint
  3. 提取文本获取所有文本内容(已移除评论)。
  4. 分析内容使用 AI Builder 进行关键词提取
  5. 检查合规性扫描文本以了解所需的合规条款
  6. 标记问题:识别缺失的必要内容
  7. 生成报告:创建合规性审查报告
  8. 电子邮件审阅者将分析结果发送给审核团队

商业优势:

  • 每季度分析 50 多份政策文件
  • 自动进行合规性内容检查
  • 将审核时间从 2 小时缩短至 15 分钟
  • 确保所有必需内容在批准前已准备就绪

行业应用案例及应用

企业及商业应用案例

  • 内容分析提取文本以进行人工智能内容分析
  • 文档索引创建可搜索的文本索引
  • 翻译准备提取文本以进行翻译服务
  • 内容迁移将 Word 内容迁移到其他平台

获取帮助