从 Word 中提取文本 Power Automate
PDF4me 从 Word 中提取文本 操作从 Word 文档中检索文本内容 Power Automate 具备高级提取控制选项。这项全面的功能支持指定页面范围(起始页/结束页)、移除注释、接受跟踪更改,并返回文本内容和文本文件,从而实现跨内容分析、数据提取和文本处理。 Microsoft 365 工作流程。
验证您的身份 API 要求
要访问 PDF4me 网站 API 通过 Power Automate每个请求都必须包含正确的身份验证凭据。身份验证可确保通信安全,并验证您作为授权用户的身份,从而实现与您的系统之间的无缝集成。 Power Automate 流量和 PDF4me强大的 Word 文本提取服务。

主要特点
- 页面范围控制提取特定页面范围内的文本
- 评论删除:提取前排除评论的选项
- 轨道找零处理提取前接受跟踪更改
- 文本文件输出:接收提取的文本,格式为可下载文件
- 批量处理从多个 Word 文档中提取文本
参数
以下是“从 Word 文档中提取文本”操作的完整参数列表。配置这些参数可以控制文本提取。
重要的: 标有星号 (***) 的参数是必需的,必须提供这些参数才能使操作正常运行。
| 范围 | 类型 | 描述 | 例子 |
|---|---|---|---|
| 文件内容*** | 二进制 | 源 Word 文件内容 • 从上一步操作映射 Word 文档 • 必须有效 DOCX 格式 • 支持来自以下来源的文件 SharePoint, OneDrive, 电子邮件 • 可以从流中动态检索 | [File Content from Get File] |
| 文件名*** | String | Word文档名称 • Word 文件名 • 用于处理身份识别 • 应包含 .docx 扩展名 • 支持动态命名 | Document.docx |
| 起始页码 | String | 提取起始页 • 开始文本提取的页码 • 特定起始点的数值 • 留空则从头开始 • 可用于提取特定部分 | 1 |
| 页码结束 | String | 提取结束页 • 页码到文本末尾提取 • 特定终点的数值 • 留空以便从末端取出 • 可用于提取特定部分 | 10 |
| 删除评论 | Boolean | 评论排除控制 • 真的 - 在提取文本之前移除注释 • 错误的 - 在提取的文本中包含注释 • 适用于提取干净的文本 • 如果未指定,则默认值为 False | true |
| 接受更改 | Boolean | 找零处理 • 真的 - 提取前接受所有跟踪更改 • 错误的 - 原样提取更改后的文本 • 有助于最终确定内容 • 如果未指定,则默认值为 False | true |
输出
这 PDF4me 从 Word 中提取文本 操作返回全面的输出数据,以实现无缝连接。 Power Automate 流量整合:
- Table
- JSON
- Flow Integration
表格视图
以结构化表格格式呈现的响应数据:
| 范围 | 类型 | 描述 |
|---|---|---|
| 职位编号 | String | 提取操作的唯一标识符 |
| 文件内容 | 二进制 | 包含提取文本的文本文件内容 |
| 文本 | String | 提取的文本内容为字符串 |
JSON 回复格式
{
"Job ID": "job_abc123xyz",
"File Content": "[Binary Content of Text File]",
"Text": "Extracted text content from Word document..."
}
Power Automate 流量使用情况
在后续操作中使用提取的文本:
- 文本分析使用 AI Builder 分析内容
- 搜索索引为便于搜索而对提取的文本进行索引
- 数据库存储:将文本内容存储在数据库中
- 内容迁移将文本移至 SharePoint 页面
- 翻译:将文本发送给翻译服务
- 关键词提取解析文本以查找重要术语
工作流程示例
这 PDF4me 从 Word 中提取文本 行动 Power Automate 提供专为实际业务场景设计的全面工作流程模板:
- Content Analysis
- Translation Workflow
- Search Indexing
- Plagiarism Detection
自动化文档内容分析工作流程
利用自动化文本提取和分析技术改进内容审核:
完整工作流程步骤:
- 扳机政策文件已上传以供审核
- 获取文档从以下位置检索 Word 文档 SharePoint
- 提取文本获取所有文本内容(已移除评论)。
- 分析内容使用 AI Builder 进行关键词提取
- 检查合规性扫描文本以了解所需的合规条款
- 标记问题:识别缺失的必要内容
- 生成报告:创建合规性审查报告
- 电子邮件审阅者将分析结果发送给审核团队
商业优势:
- 每季度分析 50 多份政策文件
- 自动进行合规性内容检查
- 将审核时间从 2 小时缩短至 15 分钟
- 确保所有必需内容在批准前已准备就绪
自动文档翻译准备
利用自动文本提取简化翻译流程:
完整工作流程步骤:
- 扳机:待翻译文件
- 获取文档:检索 Word 文档
- 提取文本获取已接受更改的文本
- 分段将文本分成易于管理的小块
- 翻译文本发送到 Azure 翻译器 API
- 接收翻译获取翻译后的文本
- 创建新文档:创建包含翻译文本的 Word 文档
- 电子邮件翻译团队:送去进行质量审核
商业优势:
- 每月翻译 30 多份文件
- 自动化翻译准备工作流程
- 减少 80% 的翻译设置时间
- 支持快速创建多语言文档
自动文档搜索索引创建
利用自动文本提取进行索引,优化文档发现:
完整工作流程步骤:
- 扳机:Word 文档已上传至文档库
- 获取文档从……检索 Word 文件 SharePoint
- 提取文本获取所有文本内容
- 解析关键字提取关键词和短语
- 生成摘要从文本创建文档摘要
- 更新元数据添加关键词和摘要 SharePoint
- 索引内容将全文添加到搜索索引
- 启用发现功能使文档可按内容搜索
商业优势:
- 每月自动索引 200 多份文档
- 支持跨文档库进行全文搜索
- 文档查找时间缩短 85%
- 创建全面的可搜索知识库
自动化抄袭检测工作流程
利用自动化文本提取和检查来增强学术诚信:
完整工作流程步骤:
- 扳机学生提交作业 Word 文档
- 获取提交从 SharePoint
- 提取文本获取文档的所有文本内容
- 删除标题:去除学生姓名和标题
- 检查抄袭提交文本进行抄袭检测 API
- 分析结果解析相似度得分和匹配结果
- 标记问题:识别高相似度提交
- 给讲师发邮件请发送查重报告以供审核
商业优势:
- 每学期检查 500 多份学生作业
- 自动化抄袭检测工作流程
- 将每项任务的检查时间从 30 分钟缩短至 2 分钟。
- 通过持续核查来维护学术诚信
行业应用案例及应用
- Corporate & Business
- Legal & Professional Services
- Education & Training
- Healthcare & Medical
企业及商业应用案例
- 内容分析提取文本以进行人工智能内容分析
- 文档索引创建可搜索的文本索引
- 翻译准备提取文本以进行翻译服务
- 内容迁移将 Word 内容迁移到其他平台
法律及专业服务用例
- 合同分析提取文本以供法律审查和分析
- 发现处理提取文本以用于电子取证
- 文件比较提取版本对比信息
- 合规性检查分析提取的文本,以确定其是否符合相关条款。
教育与培训应用案例
- 任务处理提取文本进行抄袭检测
- 内容分析分析学生作业内容
- 评分自动化提取文本以进行自动评估
- 研究分析从研究论文中提取文本
医疗保健应用案例
- 医疗记录处理从医疗文档中提取文本
- 报告分析分析提取的医疗报告文本
- 数据提取解析文本以获取特定医疗数据
- 内容迁移提取文本以导入电子病历系统