跳到主要内容

2 篇博文 含有标签「extract text」

查看所有标签

如何在 Zapier 中从扫描的 PDF 文件中提取文本:观看 → OCR → 提取(3 个步骤)

· 阅读需 11 分钟
SEO and Content Writer

扫描的发票、传真表格或保存为 PDF 格式的屏幕截图,看起来像文档,但其中的文字只是像素。您无法选中、复制或将其导入到 Zap 中。解决方法:运行 OCR优先 要使 PDF 文件可搜索,然后提取文本。这里有一个三步 Zap 教程,使用 Dropbox 和 PDF4me 即可轻松完成此操作。

在 Power Automate 中从 PDF 文件中提取文本:包括扫描文档和图像文档

· 阅读需 14 分钟
SEO and Content Writer

您的Dropbox、SharePoint或电子邮件中存储着PDF文件,其中一些是纯文本文件,另一些是扫描件或图像文件,您需要将所有文本整合到一个可靠的流程中。问题在于: 基于图像的 PDF 文件没有可选择的文本。它们首先需要OCR技术。一旦它们可以搜索, PDF4me 提取文本和图像 将所有东西都拉进来 一次通话无需二次读取,不浪费 API 积分。

本指南将引导您完成一个可以同时处理以下两件事的流程: 扳机获取文件内容 (Dropbox)→ 使用 OCR 将 PDF 转换为可编辑 PDF。 (针对扫描文档)→ 提取文本和图像 (PDF4me)。您可以获得完整的输出结构和链接,以便自行排查问题并尝试使用 API。