跳到主要内容

转变 PDF 可编辑 PDF 使用 OCRPower Automate

PDF4me PDF OCR 动作转换扫描和基于图像 PDF将文档转换为可搜索、可编辑的文档 Power Automate 利用先进的光学字符识别技术。这项强大的数字化功能提供草稿和高质量选项、针对已可搜索文本的智能跳过逻辑、多语言支持,并可创建可搜索的文本。 PDF支持全文搜索、内容提取和数据处理 Microsoft 365 工作流程。

相关博客文章
目前尚无关于此功能的博客文章——敬请期待。
在此期间,您可以浏览 PDF4me 博客,查看适用于各平台的教程和工作流程。
访问博客

验证您的身份 API 要求

要访问 PDF4me 网站 API 通过 Power Automate每个请求都必须包含正确的身份验证凭据。身份验证可确保通信安全,并验证您作为授权用户的身份,从而实现与您的系统之间的无缝集成。 Power Automate 流量和 PDF4me强大的 OCR 服务。

使用 OCR Power Automate 将 PDF 转换为可编辑 PDF

主要特点

  • OCR 技术将扫描的图像和照片转换为可搜索的文本
  • 智能识别: 跳过 OCR 如果文本已可搜索,则保存 API 呼叫
  • 质量选项根据文档复杂程度选择“草稿”或“高质量”
  • 多语言支持:指定源语言以便准确识别
  • 批量处理转换多个扫描件 PDF自动化工作流程中的

参数

Convert 函数的完整参数列表 PDF 可编辑 PDF 使用 OCR 操作。配置这些参数以控制 OCR 加工。

重要的: 标有星号 (***) 的参数是必需的,必须提供这些参数才能使操作正常运行。

范围类型描述例子
文件内容***二进制来源 PDF 文件内容
• 地图 PDF 来自先前操作输出的文件
• 支持扫描和基于图像的格式 PDFs
• 可以来自 SharePointOneDrive, 电子邮件
• 必须有效 PDF 文档
[File Content from Get File]
文件名***StringPDF 文档名称
• 源文件名需包含正确的文件扩展名
• 用于处理和输出识别
• 必须包含 .pdf 扩展名
• 支持从流程中动态命名
ScannedDocument.pdf
质量类型选项OCR 质量水平
草稿 - 适用于正常 PDFs,消耗1 API 每个文件的调用
高的 - 适用于 PDF由图像和扫描文档生成的s,消耗2 API 每页调用次数
• 如果未指定,则默认值为草稿
High
仅在需要时进行OCR识别***Boolean聪明的 OCR 优化
是的 - 跳过 OCR 如果文本已经可搜索。
- 始终执行 OCR 无论文本状态如何
• 节省 API 首先检查可搜索性,然后进行呼叫。
• 建议设置为“是”
Yes
语言String源文档语言
• 指定源文件中的文本语言
• 仅当输出无法识别时才使用
• 有所改善 OCR 特定语言的准确性
• 可选,如果未指定则自动检测
en

输出

PDF4me 转变 PDF 可编辑 PDF 使用 OCR 操作返回全面的输出数据,以实现无缝连接。 Power Automate 流量整合:

表格视图

以结构化表格格式呈现的响应数据:

范围类型描述
文件内容二进制可搜索 PDF 文件 OCR-提取的文本层
文件名String输出可搜索项的名称 PDF 文件

工作流程示例

PDF4me 转变 PDF 可编辑 PDF 使用 OCR 行动 Power Automate 提供专为实际业务场景设计的全面工作流程模板:

自动化文档归档数字化工作流程

利用自动化技术改造您的纸质档案 OCR 加工:

完整工作流程步骤:

  1. 扳机扫描文档 PDF 已上传至数字化文件夹
  2. 获取扫描:检索扫描件 PDFSharePoint
  3. 申请 OCR转换为可搜索格式 PDF 高品质
  4. 提取文本提取全文内容以进行索引
  5. 分类文件: 使用 AI 对文档类型进行分类
  6. 更新元数据将提取的数据添加到 SharePoint 元数据
  7. 移至存档:可搜索的转移 PDF 永久存档
  8. 更新索引将文档添加到可搜索数据库

商业优势:

  • 每月数字化 500 多份历史文档
  • 可对历史档案进行全文检索
  • 将文档检索时间从数小时缩短至数秒。
  • 利用纸质档案创建易于访问的数字图书馆

行业应用案例及应用

法律及专业服务用例

  • 案件文件数字化:对案件文件进行OCR扫描,以提高其可搜索性
  • 合同处理将扫描的合同转换为可搜索的PDF文件
  • 法院文件处理:OCR提交的案件管理文件
  • 文件发现创建可搜索的PDF文件以用于电子取证

获取帮助