转变 PDF 可编辑 PDF 使用 OCR 在 Power Automate
PDF4me PDF OCR 动作转换扫描和基于图像 PDF将文档转换为可搜索、可编辑的文档 Power Automate 利用先进的光学字符识别技术。这项强大的数字化功能提供草稿和高质量选项、针对已可搜索文本的智能跳过逻辑、多语言支持,并可创建可搜索的文本。 PDF支持全文搜索、内容提取和数据处理 Microsoft 365 工作流程。
验证您的身份 API 要求
要访问 PDF4me 网站 API 通过 Power Automate每个请求都必须包含正确的身份验证凭据。身份验证可确保通信安全,并验证您作为授权用户的身份,从而实现与您的系统之间的无缝集成。 Power Automate 流量和 PDF4me强大的 OCR 服务。

主要特点
- OCR 技术将扫描的图像和照片转换为可搜索的文本
- 智能识别: 跳过 OCR 如果文本已可搜索,则保存 API 呼叫
- 质量选项根据文档复杂程度选择“草稿”或“高质量”
- 多语言支持:指定源语言以便准确识别
- 批量处理转换多个扫描件 PDF自动化工作流程中的
参数
Convert 函数的完整参数列表 PDF 可编辑 PDF 使用 OCR 操作。配置这些参数以控制 OCR 加工。
重要的: 标有星号 (***) 的参数是必需的,必须提供这些参数才能使操作正常运行。
| 范围 | 类型 | 描述 | 例子 |
|---|---|---|---|
| 文件内容*** | 二进制 | 来源 PDF 文件内容 • 地图 PDF 来自先前操作输出的文件 • 支持扫描和基于图像的格式 PDFs • 可以来自 SharePoint, OneDrive, 电子邮件 • 必须有效 PDF 文档 | [File Content from Get File] |
| 文件名*** | String | PDF 文档名称 • 源文件名需包含正确的文件扩展名 • 用于处理和输出识别 • 必须包含 .pdf 扩展名 • 支持从流程中动态命名 | ScannedDocument.pdf |
| 质量类型 | 选项 | OCR 质量水平 • 草稿 - 适用于正常 PDFs,消耗1 API 每个文件的调用 • 高的 - 适用于 PDF由图像和扫描文档生成的s,消耗2 API 每页调用次数 • 如果未指定,则默认值为草稿 | High |
| 仅在需要时进行OCR识别*** | Boolean | 聪明的 OCR 优化 • 是的 - 跳过 OCR 如果文本已经可搜索。 • 不 - 始终执行 OCR 无论文本状态如何 • 节省 API 首先检查可搜索性,然后进行呼叫。 • 建议设置为“是” | Yes |
| 语言 | String | 源文档语言 • 指定源文件中的文本语言 • 仅当输出无法识别时才使用 • 有所改善 OCR 特定语言的准确性 • 可选,如果未指定则自动检测 | en |
输出
这 PDF4me 转变 PDF 可编辑 PDF 使用 OCR 操作返回全面的输出数据,以实现无缝连接。 Power Automate 流量整合:
- Table
- JSON
- Flow Integration
表格视图
以结构化表格格式呈现的响应数据:
| 范围 | 类型 | 描述 |
|---|---|---|
| 文件内容 | 二进制 | 可搜索 PDF 文件 OCR-提取的文本层 |
| 文件名 | String | 输出可搜索项的名称 PDF 文件 |
JSON 回复格式
{
"File Content": "[Binary Content of Searchable PDF]",
"File Name": "ScannedDocument_OCR.pdf"
}
Power Automate 流量使用情况
使用可搜索功能 PDF 在后续行动中:
- 文本提取提取可搜索文本以进行数据处理
- 内容分析:分析文档内容 AI 建造者
- 搜索索引启用文档库中的全文搜索
- 数据提取从可搜索内容中提取结构化数据
- SharePoint 贮存上传可搜索内容 PDF便于查找
- 进一步处理用于查找/替换和其他文本操作
工作流程示例
这 PDF4me 转变 PDF 可编辑 PDF 使用 OCR 行动 Power Automate 提供专为实际业务场景设计的全面工作流程模板:
- Archive Digitization
- Invoice Processing
- Form Processing
自动化文档归档数字化工作流程
利用自动化技术改造您的纸质档案 OCR 加工:
完整工作流程步骤:
- 扳机扫描文档 PDF 已上传至数字化文件夹
- 获取扫描:检索扫描件 PDF 从 SharePoint
- 申请 OCR转换为可搜索格式 PDF 高品质
- 提取文本提取全文内容以进行索引
- 分类文件: 使用 AI 对文档类型进行分类
- 更新元数据将提取的数据添加到 SharePoint 元数据
- 移至存档:可搜索的转移 PDF 永久存档
- 更新索引将文档添加到可搜索数据库
商业优势:
- 每月数字化 500 多份历史文档
- 可对历史档案进行全文检索
- 将文档检索时间从数小时缩短至数秒。
- 利用纸质档案创建易于访问的数字图书馆
自动化扫描发票处理工作流程
简化发票处理流程 OCR 以及数据提取:
完整工作流程步骤:
- 扳机扫描发票 PDF 通过电子邮件接收
- 获取发票从附件中提取扫描的发票
- 申请 OCR转换为可搜索格式 PDF
- 提取发票数据解析发票编号、日期和金额
- 验证数据:将提取的数据与采购订单数据库进行核对
- 导入系统:将发票数据过账到会计系统
- 电子邮件 AP向应付账款部门发送可搜索的发票
- 可搜索的存档: 店铺 OCR PDF 在已处理的文件夹中
商业优势:
- 每天自动处理 200 多张扫描发票。
- 无需手动录入发票数据
- 将发票处理时间从 30 分钟缩短至 3 分钟
- 提高准确性 OCR 提取与手动录入
从扫描件中自动提取表单数据
优化表单处理 OCR 以及智能数据提取:
完整工作流程步骤:
- 扳机已填写完毕的表格已扫描并上传。 PDF
- 获取表单:检索已扫描的表单 PDF 从上传文件夹
- 申请 OCR转换为可搜索文本 PDF
- 提取表单数据解析表单字段和值
- 验证条目检查数据完整性和格式
- 导入数据库:将表单数据加载到 SQL 或者 Dataverse
- 电子邮件确认向表单提交者发送确认信息
- 存档已处理:将可搜索表单存储在存档中
商业优势:
- 每周处理 300 多份扫描表格。
- 自动从纸质表单中提取数据
- 表单处理时间缩短85%
- 消除人工转录错误
行业应用案例及应用
- Legal & Professional Services
- Finance & Banking
- Healthcare & Medical
- Education & Training
法律及专业服务用例
- 案件文件数字化:对案件文件进行OCR扫描,以提高其可搜索性
- 合同处理将扫描的合同转换为可搜索的PDF文件
- 法院文件处理:OCR提交的案件管理文件
- 文件发现创建可搜索的PDF文件以用于电子取证
金融与银行业应用案例
- 支票处理OCR扫描检查数据提取
- 账单数字化将纸质账单转换为可搜索的PDF文件
- 应用程序处理:OCR贷款申请扫描
- 文件归档从纸质文档创建可搜索的档案
医疗保健应用案例
- 医疗记录数字化:OCR 患者记录扫描
- 保险理赔处理将扫描的索赔文件转换为可搜索的PDF文件
- 实验室结果处理:用于数据提取的 OCR 实验室结果扫描
- 历史记录将纸质医疗记录数字化
教育与培训应用案例
- 任务扫描:OCR学生作业扫描
- 研究数字化转换研究文档扫描件
- 档案保存从历史文档创建可搜索的 PDF 文件
- 表单处理OCR注册表格