使用以下方式对文档进行分类 n8n 行动
PDF4me 分类文件 自动分析和分类 PDF 使用文档 AI通过机器学习 n8n 自动化工作流程。流程 PDF离开 n8n 触发器、二进制数据、base64 字符串或公共 URL用于识别文档类型(发票、合同、收据、表格、报告)、提取分类元数据、置信度评分、替代分类和结构化数据 JSON 用于智能文档路由的输出。此解决方案非常适合自动化文档分类、内容管理系统、合规工作流程、邮件室自动化、发票处理以及需要精确输出的智能文档路由。 AI- 具备实时分析和无缝集成功能的强大分类能力。
相关博客文章(1)
设置
添加 PDF4me 将“文档分类”节点添加到您的 n8n 工作流程并配置所需参数。有关初始设置说明,请参阅我们的 n8n 集成指南。
先决条件:
- PDF4me API 证书
- n8n 工作流访问
配置:
- 添加 PDF4me 节点到工作流
- 选择“对文档进行分类”操作
- 配置输入参数(见下文)

参数
以下是“对文档进行分类”操作的完整参数列表。配置这些参数可以控制文档分类。
重要的: 标有星号 (***) 的参数是必需的,必须提供这些参数才能使操作正常运行。
| 范围 | 类型 | 描述 | 例子 |
|---|---|---|---|
| 输入数据类型*** | String | PDF 输入格式选择 • 选择您的格式 PDF 数据输入 • PDF4me 支持多种输入类型 • 选项:二进制数据, Base64 字符串,或 URL | Binary Data |
| 输入二进制字段 | 二进制 | 二进制 PDF 文件输入 (二进制数据必填) • 参考 PDF 来自前一个文件 n8n 节点或文件上传 • PDF4me 二进制进程 PDF 文件自动格式检测 • 当输入数据类型为“二进制数据”时为必填项 | {{ $binary.data }} |
| Base64 文档内容 | String | Base64 编码 PDF 输入 (如果是 Base64 字符串则为必填项) • 提供 PDF 数据以 base64 编码字符串的形式呈现 • PDF4me 自动解码和处理 PDF 内容 • 当输入数据类型为“Base64 细绳” | UEsDBBQABgAI... |
| 文件 URL | String | 民众 PDF URL 输入 (如果是 URL,则为必填项) • 提供公开/开放权限 URL 到 PDF 文件 • PDF4me 从……下载并处理文件 URL • 当输入数据类型为“URL“ | https://abc.com/sample.pdf |
| 文件名称*** | String | 来源 PDF 参考 • 指定源的名称 PDF 文件 • 用于分类参考和跟踪 • 有助于处理跟踪 | invoice_2024.pdf |
高级选项
以下参数可在“高级选项”部分中找到,且为可选参数:
| 范围 | 类型 | 描述 | 例子 |
|---|---|---|---|
| 自定义配置文件 | String | 自定义配置配置文件 • 使用自定义配置文件设置其他选项 • JSON包含预定义参数的类似格式 • 启用高级分类处理设置 • 特殊需求可选 | { "OutputDataFormat": "json" } |
输出
输出参数
| 范围 | 类型 | 描述 | 例子 |
|---|---|---|---|
| 文件名 | String | PDF4me 输出文件名 - 生成的名称 JSON 包含分类结果的文件。该文件包含所有文档分类信息。 JSON 格式 | classification_results_1756990750241.json |
| mimeType | String | PDF4me 文件 MIME 类型 - MIME 输出文件类型,始终为“application/json”。 JSON 格式分类数据 | application/json |
| 文件大小 | 数字 | PDF4me 文件大小(字节) 生成的文件大小 JSON 文件以字节为单位,用于存储规划和传输监控 | 221 |
| 成功 | Boolean | PDF4me 分类状态指标 - Boolean 指示文档分类过程成功或失败的标志。 PDF4me 返回 true 为了成功分类和 false 任何错误 | true |
| 信息 | String | PDF4me 分类状态消息 - 提供分类过程结果详细信息的易于理解的状态消息。包括成功确认或错误详情,以便进行故障排除。 | Document classification completed successfully |
| 文档名称 | String | PDF4me 源文档参考 - 原始文件名 PDF 已进行分类处理的文件 | document.pdf |
JSON 文件结构
可下载 JSON 该文件包含文档分类数据,格式如下:
| 场地 | 类型 | 描述 | 例子 |
|---|---|---|---|
| 类名 | String | PDF4me 文档类标识符 - 由以下方式标识的特定文档类别或类别 AI 分类引擎 | invoice |
| 信心 | 数字 | PDF4me 分类置信度 - 置信度得分(0-1),表示分类结果的可靠性 | 0.95 |
| 模板 ID | String | PDF4me 模板标识符 - 用于分类的文档模板的唯一标识符 | 00000000-0000-0000-0000-000000000000 |
| 分类时间戳 | String | PDF4me 分类时间戳 - ISO 8601 时间戳,指示分类完成时间 | 2025-09-23T18:33:43.457Z |
| 替代分类 | Array | PDF4me 其他分类 - 备选文档类型及其置信度评分的数组 | [{"type": "receipt", "confidence": 0.15}] |
N8N 行动反应
这 PDF4me 分类文件 API 返回的结果可以以多种格式查看。请选择最符合您需求的视图:
- JSON
- Table
- Schema
- Binary
JSON 回复格式
原始 JSON 来自 API:
[
{
"fileName": "classification_results_1756990750241.json",
"mimeType": "application/json",
"fileSize": 221,
"success": true,
"message": "Document classification completed successfully",
"docName": "document.pdf"
}
]
表格视图
以结构化表格格式呈现的响应数据:
| 范围 | 价值 |
|---|---|
| fileName | classification_results_1756990750241.json |
| mimeType | application/json |
| fileSize | 221 |
| success | true |
| message | Document classification completed successfully |
| docName | document.pdf |
架构视图
响应的数据结构和类型:
1 item
fileName: AB classification_results_1756990750241.json
mimeType: AB application/json
fileSize: # 221
success: ☑ true
message: AB Document classification completed successfully
docName: AB document.pdf
类型指示器:
AB= String#= 数字☑= Boolean{}= Object[]= Array
二进制数据视图
实际 JSON 文件数据和元数据:
data
─────────────────────────────
File Name: classification_results_1756990750241.json
File Extension: json
Mime Type: application/json
File Size: 0.22 KB
JSON 文件内容示例:
{
"className": "invoice",
"templateId": "00000000-0000-0000-0000-000000000000",
"classificationTimestamp": "2025-09-23T18:33:43.457Z",
}
用例
文件分类和路由
- 智能文档路由下载并处理 JSON 要提取的文件
className用于根据文档类型自动将文档路由到相应部门、系统或处理队列的字段 - 基于模板的处理利用
templateId从 JSON 文件用于应用特定的文档模板和处理规则,以便对类似文档类型进行一致的处理。 - 自动化工作流程触发器解析 JSON 文件和触发器特定 n8n 基于工作流程
className启动特定文档业务流程的价值
审计和合规跟踪
- 请求可追溯性使用生成的 JSON 文件用于在整个文档处理流程中提供完整的审计跟踪和请求跟踪。
- 处理时间戳监控利用
classificationTimestamp从 JSON 文件用于监控处理时间并确保服务水平协议 (SLA) 合规性 - 操作日志:使用以下方式跟踪所有分类操作 JSON 文件用于全面记录活动日志和合规性报告
文档管理与组织
- 源文件跟踪使用
docName用于维护文档沿袭关系并在处理工作流程中跟踪原始文件名的字段 - 成功状态监控:根据以下情况实现错误处理和重试逻辑:
success稳健文档处理的状态 - 基于文件的管理通过处理生成的文件来整理文档 JSON 用于一致分类和文档标准化的文件