转变 PDF 使用 Excel n8n 行动
PDF4me 转变 PDF 卓越 变换 PDF 通过以下方式将文档转换为结构化的 Excel 电子表格: n8n 自动化工作流程。流程 PDF离开 n8n 触发器、二进制数据、base64 字符串或公共 URLs 用于提取表格、表单和数据,具备智能表格检测、精确单元格格式化、列/行保留、多工作表支持等功能,以及 OCR 具备扫描文档处理能力。该解决方案非常适合需要精确数据的财务报告、数据分析、发票处理、表单数字化、商业智能工作流程和自动化数据提取。 PDF 采用专业Excel格式进行解析,并实现无缝集成。
相关博客文章(1)
设置
添加 PDF4me “转变 PDF 将“Excel”节点添加到您的 n8n 工作流程并配置所需参数。有关初始设置说明,请参阅我们的 n8n 集成指南。
先决条件:
- PDF4me API 证书
- n8n 工作流访问
配置:
- 添加 PDF4me 节点到工作流
- 选择“转换” PDF 到 Excel 操作
- 配置输入参数(见下文)

参数
Convert 函数的完整参数列表 PDF 执行 Excel 操作。配置这些参数以控制 PDF 转换为Excel格式。
重要的: 标有星号 (***) 的参数是必需的,必须提供这些参数才能使操作正常运行。
| 范围 | 类型 | 描述 | 例子 |
|---|---|---|---|
| 输入数据类型*** | String | PDF 输入格式选择 • 选择您的格式 PDF 数据输入 • PDF4me 支持多种输入类型 • 选项:二进制数据、Base64 字符串或 URL | Binary Data |
| 输入二进制字段 | Binary | 二进制 PDF 文件输入 (二进制数据必填) • 参考 PDF 来自前一个文件 n8n 节点或文件上传 • PDF4me 二进制进程 PDF 文件自动格式检测 • 当输入数据类型为“二进制数据”时为必填项 | {{ $binary.data }} |
| Base64 文档内容 | String | Base64 编码 PDF 输入 (如果是 Base64 字符串则为必填项) • 提供 PDF 数据以 base64 编码字符串的形式呈现 • PDF4me 自动解码和处理 PDF 内容 • 当输入数据类型为“Base64 字符串”时为必填项 | UEsDBBQABgAI... |
| 文件 URL | String | 民众 PDF URL 输入 (如果是 URL,则为必填项) • 提供公开/开放权限 URL 到 PDF 文件 • PDF4me 从……下载并处理文件 URL • 当输入数据类型为“URL”时为必填项 | https://abc.com/sample.pdf |
| 质量类型*** | 枚举 | 转换质量设置 • 选择质量等级 PDF 转换为 Excel • 草稿:快速转换,1 API 按文件调用(简单 PDF) • 高:转换准确,2 API 每页调用次数(复杂/扫描 PDF) 不同的质量等级提供不同的精度。 | Draft |
| 语言*** | String | OCR 语言设置 • 指定源文本的语言 PDF 文件 • 仅当输出文本无法识别时使用 • 优化 OCR 处理以提高文本识别率 • 通用语言:英语、德语、法语、西班牙语 | English |
| 合并所有工作表*** | Boolean | 多页合并 • 控制是否将所有检测到的表格合并到一个工作表中 • true = 将所有表格合并到一个工作表中 • false = 为每个表格创建单独的工作表 • 默认值为 false | true |
| 输出格式*** | String | Excel 输出格式规范 • 定义输出格式结构 • 控制 Excel 电子表格的显示和布局 • 必须以字符串格式提供 • 确定Excel文件格式 | "formatted" |
| 必要时进行光学字符识别*** | String | OCR 加工控制 • 控制是否 OCR 处理过程已应用 • 适用于基于图像的 PDF 或扫描文档 • 确定是否 OCR 应提取文本和表格数据 • 必须采用字符串格式 | "true" |
| 输出文件名*** | String | Excel 输出文件名 • 指定生成的 Excel 文件的名称 • 必须包含 .xlsx 扩展名 • PDF4me 确保唯一命名和格式验证 | PDF_to_EXCEL_output.xlsx |
| 文件名称*** | String | 来源 PDF 参考 • 指定源的名称 PDF 文件 • 供参考和跟踪之用 • 有助于处理跟踪 | output.pdf |
| 二进制数据输出名称*** | String | 二进制数据输出映射 • 定义用于访问生成的 Excel 二进制数据的变量名 • 用于后续工作流程操作 • 对工作流程自动化至关重要 | data |
输出
输出参数
| 范围 | 类型 | 描述 | 例子 |
|---|---|---|---|
| 文件名 | String | PDF4me 生成的 Excel 文件名 - 成功生成的带有正确 .xlsx 扩展名的 Excel 文档的完整文件名。 PDF4me 确保唯一命名并验证文件格式合规性,以便与下游流程无缝集成。 | PDF_to_EXCEL_output.xlsx |
| 文件大小 | 数字 | PDF4me Excel 文件大小(字节) - 生成的 Excel 文件的确切大小(以字节为单位),由……提供 PDF4me 用于存储规划、带宽优化和文件传输监控。对企业文档管理和工作流自动化至关重要。 | 7817 |
| 成功 | Boolean | PDF4me 转换状态指示器 - 布尔标志,指示成功或失败 PDF到 Excel 的转换过程。 PDF4me 返回 true 为了成功转化和 false 针对任何错误,在自动化工作流程中实现强大的错误处理能力。 | true |
| 原始文件名 | String | PDF4me 来源 PDF 参考 - 原版 PDF 被处理的文件名 PDF4me的转换引擎。此参考信息用于审计跟踪、调试以及追踪企业工作流程中生成的 Excel 文档的来源。 | output.pdf |
| 质量类型 | String | PDF4me 转换质量使用 - 表示在生产过程中应用的质量水平 PDF 转换为 Excel 的过程。显示转换过程中使用的质量设置(草稿、标准或高)。 | Draft |
| 语言 | String | PDF4me OCR 使用的语言 - 显示转换过程中应用的语言设置,以实现最佳文本识别和数据提取精度。 | English |
| ocr已使用 | Boolean | PDF4me OCR 加工指标 - 布尔标志,指示是否 OCR 在转换过程中应用了光学字符识别(OCR)。这有助于理解所使用的处理方法。 PDF 文档 | true |
| 合并所有工作表 | Boolean | PDF4me 表格合并指标 - 布尔标志,指示是否从所有检测到的表中 PDF 合并到单个 Excel 工作表中,或保留为单独的工作表 | true |
| 信息 | String | PDF4me 转换状态消息 - 提供转换过程结果详细信息的易于理解的状态消息。包括成功确认或错误详情,以便进行故障排除。 | PDF converted to Excel successfully |
N8N 行动反应
这 PDF4me 转变 PDF 卓越 API 返回的结果可以以多种格式查看。请选择最符合您需求的视图:
- JSON
- Table
- Schema
- Binary
JSON 回复格式
原始 JSON 来自 API:
{
"fileName": "PDF_to_EXCEL_output.xlsx",
"fileSize": 7817,
"success": true,
"originalFileName": "output.pdf",
"qualityType": "Draft",
"language": "English",
"ocrUsed": true,
"mergeAllSheets": true,
"message": "PDF converted to Excel successfully"
}
表格视图
以结构化表格格式呈现的响应数据:
| 范围 | 价值 |
|---|---|
| fileName | PDF_to_EXCEL_output.xlsx |
| fileSize | 7817 |
| success | true |
| originalFileName | output.pdf |
| qualityType | Draft |
| language | English |
| ocrUsed | true |
| mergeAllSheets | true |
| message | PDF 已成功转换为 Excel 格式 |
架构视图
响应的数据结构和类型:
1 item
fileName: AB PDF_to_EXCEL_output.xlsx
fileSize: # 7817
success: ☑ true
originalFileName: AB output.pdf
qualityType: AB Draft
language: AB English
ocrUsed: ☑ true
mergeAllSheets: ☑ true
message: AB PDF converted to Excel successfully
类型指示器:
AB= String#= 数字☑= Boolean
二进制数据视图
实际的Excel文件数据和元数据:
data
─────────────────────────────
File Name: PDF_to_EXCEL_output.xlsx
File Extension: xlsx
Mime Type: application/vnd.openxmlformats-officedocument.spreadsheetml.sheet
File Size: 7.6 KB
二进制数据访问:
- n8n 二进制对象:
$binary.data.data - Base64 内容可直接使用
- 文件操作可供下载、通过电子邮件发送或存储
用例
财务数据分析与报告
- 将 PDF 格式的财务报表、发票和会计报告转换为 Excel 格式,用于数据分析、财务建模和商业智能应用。
- 将PDF格式的银行对账单、交易报告和财务文件转换为Excel格式,用于预算分析、费用跟踪和财务规划。
- 将 PDF 格式的审计报告、合规文件和监管文件转换为 Excel 格式,以便进行数据处理、趋势分析和监管报告。
商业智能和数据处理
- 将 PDF 报告、分析仪表板和业务指标转换为 Excel 格式,以便进行进一步分析、数据可视化和决策支持。
- 将PDF格式的调查结果、市场调研数据和客户数据转换为Excel格式,以便进行统计分析、报告撰写和商业洞察。
- 将 PDF 格式的库存报告、销售数据和运营指标转换为 Excel 格式,用于绩效分析、预测和战略规划。
研究与学术数据分析
- 将 PDF 格式的研究数据、科学报告和学术论文转换为 Excel 格式,以便进行统计分析、数据可视化和研究协作。
- 将PDF格式的调查数据、实验结果和研究发现转换为Excel格式,以便进行数据分析、假设检验和学术报告撰写。
- 将PDF格式的人口普查数据、人口统计报告和统计出版物转换为Excel格式,用于研究分析、趋势识别和学术研究。