跳到主要内容

1 篇博文 含有标签「split-pdf-by-text」

查看所有标签

在 Power Automate 中按文本拆分 PDF:使用 PDF4me 将一批扫描件拆分为多个文件

· 阅读需 24 分钟
SEO and Content Writer

PDF4me 按文本拆分 PDF 这是一个 Power Automate 操作,它会将一个 PDF 文件分割成多个文件,分割位置取决于文本标记的出现。此流程会监视 SharePoint 文件夹,并在每次扫描时根据标记进行分割。 Serial#: 标记后,将结果循环导入 Dropbox。一次批量扫描会生成三个命名文件,无需手动选择页面。

任何使用扫描仪的人都知道这个问题。有人把一叠文件放进进纸器,按一下扫描键,结果得到的是一个包含二十条毫不相干记录的PDF文件。谷歌首页上的所有在线文件分割工具都能轻松解决这个问题,前提是需要人工上传文件,点击页面选择器,然后下载分割后的文件。偶尔一次没问题。但如果扫描仪每天早上都要运行,那就麻烦了。这种流程完全不需要人工干预。

流程概览
1. When a file is created in a folder
SharePoint trigger watching /Shared Documents/ScanSplitInput.
2. PDF - Split PDF by Text
PDF4me cuts the scan before every page carrying the Serial#: marker.
3. For each
Loops over body/splitedDocuments, once per split file.
4. Create file
Dropbox writes each piece into /ScanSplitOutput under its own name.