提取文本和图像 Power Automate
PDF4me 提取文本和图像 该操作会从文本中检索所有文本内容和嵌入的图像。 PDF 文件 Power Automate 用于全面提取内容。这项多功能功能可独立控制文本和图像提取,将全文以字符串形式返回,将图像以对象数组形式返回,从而支持内容重用、数据分析、图像处理以及跨平台多格式内容分发。 Microsoft 365 工作流程。
验证您的身份 API 要求
要访问 PDF4me 网站 API 通过 Power Automate每个请求都必须包含正确的身份验证凭据。身份验证可确保通信安全,并验证您作为授权用户的身份,从而实现与您的系统之间的无缝集成。 Power Automate 流量和 PDF4me强大的内容提取服务。

主要特点
- 文本提取从中检索所有文本内容 PDF 文件
- 图像提取将所有嵌入的图像提取为单独的文件
- 独立控制您可以选择仅提取文本、仅提取图像或两者都提取。
- Array 输出接收图像数组以进行迭代和处理
- 批量处理:从多个来源提取内容 PDF工作流程中的 s
参数
以下是“提取文本和图像”操作的完整参数列表。配置这些参数可控制内容提取。
重要的: 标有星号 (***) 的参数是必需的,必须提供这些参数才能使操作正常运行。
| 范围 | 类型 | 描述 | 例子 |
|---|---|---|---|
| 文件内容*** | 二进制 | 来源 PDF 文件内容 • 地图 PDF 来自先前操作输出的文件 • 支持 PDF来自 SharePoint, OneDrive, 电子邮件 • 可以从流变量中动态检索 • 必须有效 PDF 文档 | [File Content from Get File] |
| 姓名*** | String | PDF 文档名称 • 来源 PDF 文件名带有 .pdf 扩展名 • 用于处理身份识别 • 必须包含正确的文件扩展名 • 支持从流程中动态命名 | Document.pdf |
| 提取图像*** | Boolean | 图像提取控制 • 真的 - 提取所有嵌入图像 • 错误的 - 跳过图像提取 • 如果不需要图片,请设置为 false • 仅需文本时减少处理量 | true |
| 提取文本*** | Boolean | 文本提取控制 • 真的 提取所有文本内容 • 错误的 - 跳过文本提取 • 如果不需要文本,请设置为 false • 当仅需图像时,可减少处理量 | true |
输出
这 PDF4me 提取文本和图像 操作返回全面的输出数据,以实现无缝连接。 Power Automate 流量整合:
- Table
- JSON
- Flow Integration
表格视图
以结构化表格格式呈现的响应数据:
| 范围 | 类型 | 描述 |
|---|---|---|
| 文本 | String | 从以下文本中提取的完整内容 PDF |
| 图片 | Array | 返回提取出的图像列表,以对象数组的形式返回。 |
JSON 回复格式
{
"Texts": "Extracted text content from entire PDF document...",
"Images": [
{
"ImageData": "[Base64 Image Content]",
"ImageName": "image_1.png"
},
{
"ImageData": "[Base64 Image Content]",
"ImageName": "image_2.png"
}
]
}
Power Automate 流量使用情况
在后续操作中使用提取的内容:
- 文本分析使用 AI Builder 分析提取的文本
- 图像处理单独处理提取的图像
- 数据库存储:将文本和图像存储在数据库中
- 内容再利用:将提取的内容重新用于新文档
- 搜索索引为便于搜索而对提取的文本进行索引
- 单独存档以有组织的格式存储文本和图像
工作流程示例
这 PDF4me 提取文本和图像 行动 Power Automate 提供专为实际业务场景设计的全面工作流程模板:
- Content Archival
- Content Analysis
- Content Migration
- Translation Preparation
自动化内容分离与归档
利用自动化提取和存储,革新您的内容管理方式:
完整工作流程步骤:
- 扳机文档已上传至处理文件夹
- 获取文档: 取回 PDF 从 SharePoint
- 提取内容提取文本和图像
- 保存文本:将提取的文本存储在归档文件的文本文件中。
- 应用于每张图片遍历提取的图像
- 保存图片:将每张图片单独存储在图片文件夹中
- 创建索引生成包含文本和图像引用的元数据
- 更新数据库日志提取详情和位置
商业优势:
- 将内容从 200 多个中分离出来 PDF每月
- 支持独立的文本和图像管理
- 减少 60% 的存储冗余
- 促进内容重用和再利用
自动化 PDF 内容分析工作流程
利用自动化文本和图像提取功能简化内容分析:
完整工作流程步骤:
- 扳机研究论文 PDF 已上传以供分析
- 得到 PDF: 取回 PDF 来自研究图书馆
- 提取文本获取所有文本内容
- 分析文本使用 AI Builder 进行情感和关键词分析
- 提取图像获取所有嵌入的图片和图表
- 过程图像使用AI视觉分析图像
- 编制报告:撰写包含调查结果的分析报告
- 电子邮件研究人员发送分析摘要
商业优势:
- 每月分析 50 多份研究文件
- 自动进行全面的内容分析
- 将分析时间从 4 小时缩短至 20 分钟
- 实现人工智能驱动的洞察 PDF 内容
自动内容迁移到 SharePoint
利用自动化提取和导入优化内容迁移:
完整工作流程步骤:
- 扳机: 遗产 PDF 已上传以进行迁移
- 得到 PDF: 取回 PDF 来自迁移源
- 提取文本获取所有要索引的文本内容
- 提取图像检索所有嵌入图像
- 创造 SharePoint 页建造现代化的 SharePoint 页
- 添加文本内容将提取的文本导入页面
- 上传图片添加图片 SharePoint 资产
- 链接内容页面内容中的参考图片
商业优势:
- 迁移 100 多个旧系统 PDF从月刊到现代格式
- 支持内容搜索和发现 SharePoint
- 手动迁移时间减少 85%
- 保持内容的可访问性和易用性
用于翻译的自动化内容提取
利用自动化内容提取增强翻译工作流程:
完整工作流程步骤:
- 扳机:待翻译文件
- 获取文档: 取回 PDF 需要翻译
- 提取文本获取所有文本内容
- 提取图像单独检索嵌入的图像
- 发送给翻译向 Azure 翻译器提交文本 API
- 翻译文本将文本转换为目标语言
- 重新创建文档新建 PDF 包含翻译文本和原始图片
- 给利益相关者发邮件发送翻译后的文件
商业优势:
- 每月翻译 40 多份文件
- 在翻译文本的同时保留原始图像
- 缩短翻译准备时间75%
- 支持快速创建多语言文档
行业应用案例及应用
- Publishing & Media
- Legal & Professional Services
- Marketing & Communications
- Education & Training
出版与媒体应用案例
- 内容提取提取文本和图像以供内容重用
- 数字资产管理:分离并编目文档资产
- 内容迁移提取平台迁移所需的内容
- 档案管理将内容分开整理,以便更好地访问
法律及专业服务用例
- 文件审查提取文本以供法律审查和分析
- 证据收集从案例文件中提取图像和文本
- 发现处理:单独的电子取证内容
- 内容分析:摘录以供合规性和审核
市场营销与传播应用案例
- 内容再利用提取内容以供营销再利用
- 资产收集收集营销库图片
- 竞选材料提取内容以创建营销活动
- 品牌资产管理收集徽标和品牌图片
教育与培训应用案例
- 课程内容提取从课程材料中提取文本和图像
- 学习对象创建:用于 LMS 上传的单独内容
- 内容迁移:平台过渡提取
- 档案管理整理教育内容资源