跳到主要内容

使用以下方式对文档进行分类 n8n 行动

PDF4me 分类文件 自动分析和分类 PDF 使用文档 AI通过机器学习 n8n 自动化工作流程。流程 PDF离开 n8n 触发器、二进制数据、base64 字符串或公共 URL用于识别文档类型(发票、合同、收据、表格、报告)、提取分类元数据、置信度评分、替代分类和结构化数据 JSON 用于智能文档路由的输出。此解决方案非常适合自动化文档分类、内容管理系统、合规工作流程、邮件室自动化、发票处理以及需要精确输出的智能文档路由。 AI- 具备实时分析和无缝集成功能的强大分类能力。

相关博客文章(1)

设置

添加 PDF4me 将“文档分类”节点添加到您的 n8n 工作流程并配置所需参数。有关初始设置说明,请参阅我们的 n8n 集成指南

先决条件:

  • PDF4me API 证书
  • n8n 工作流访问

配置:

  1. 添加 PDF4me 节点到工作流
  2. 选择“对文档进行分类”操作
  3. 配置输入参数(见下文)
分类文件

参数

以下是“对文档进行分类”操作的完整参数列表。配置这些参数可以控制文档分类。

重要的: 标有星号 (***) 的参数是必需的,必须提供这些参数才能使操作正常运行。

范围类型描述例子
输入数据类型***StringPDF 输入格式选择
• 选择您的格式 PDF 数据输入
PDF4me 支持多种输入类型
• 选项:二进制数据, Base64 字符串,或 URL
Binary Data
输入二进制字段二进制二进制 PDF 文件输入 (二进制数据必填)
• 参考 PDF 来自前一个文件 n8n 节点或文件上传
PDF4me 二进制进程 PDF 文件自动格式检测
• 当输入数据类型为“二进制数据”时为必填项
{{ $binary.data }}
Base64 文档内容StringBase64 编码 PDF 输入 (如果是 Base64 字符串则为必填项)
• 提供 PDF 数据以 base64 编码字符串的形式呈现
PDF4me 自动解码和处理 PDF 内容
• 当输入数据类型为“Base64 细绳”
UEsDBBQABgAI...
文件 URLString民众 PDF URL 输入 (如果是 URL,则为必填项)
• 提供公开/开放权限 URLPDF 文件
PDF4me 从……下载并处理文件 URL
• 当输入数据类型为“URL
https://abc.com/sample.pdf
文件名称***String来源 PDF 参考
• 指定源的名称 PDF 文件
• 用于分类参考和跟踪
• 有助于处理跟踪
invoice_2024.pdf

高级选项

以下参数可在“高级选项”部分中找到,且为可选参数:

范围类型描述例子
自定义配置文件String自定义配置配置文件
• 使用自定义配置文件设置其他选项
JSON包含预定义参数的类似格式
• 启用高级分类处理设置
• 特殊需求可选
{ "OutputDataFormat": "json" }

输出

输出参数

范围类型描述例子
文件名StringPDF4me 输出文件名 - 生成的名称 JSON 包含分类结果的文件。该文件包含所有文档分类信息。 JSON 格式classification_results_1756990750241.json
mimeTypeStringPDF4me 文件 MIME 类型 - MIME 输出文件类型,始终为“application/json”。 JSON 格式分类数据application/json
文件大小数字PDF4me 文件大小(字节) 生成的文件大小 JSON 文件以字节为单位,用于存储规划和传输监控221
成功BooleanPDF4me 分类状态指标 - Boolean 指示文档分类过程成功或失败的标志。 PDF4me 返回 true 为了成功分类和 false 任何错误true
信息StringPDF4me 分类状态消息 - 提供分类过程结果详细信息的易于理解的状态消息。包括成功确认或错误详情,以便进行故障排除。Document classification completed successfully
文档名称StringPDF4me 源文档参考 - 原始文件名 PDF 已进行分类处理的文件document.pdf

JSON 文件结构

可下载 JSON 该文件包含文档分类数据,格式如下:

场地类型描述例子
类名StringPDF4me 文档类标识符 - 由以下方式标识的特定文档类别或类别 AI 分类引擎invoice
信心数字PDF4me 分类置信度 - 置信度得分(0-1),表示分类结果的可靠性0.95
模板 IDStringPDF4me 模板标识符 - 用于分类的文档模板的唯一标识符00000000-0000-0000-0000-000000000000
分类时间戳StringPDF4me 分类时间戳 - ISO 8601 时间戳,指示分类完成时间2025-09-23T18:33:43.457Z
替代分类ArrayPDF4me 其他分类 - 备选文档类型及其置信度评分的数组[{"type": "receipt", "confidence": 0.15}]

N8N 行动反应

PDF4me 分类文件 API 返回的结果可以以多种格式查看。请选择最符合您需求的视图:

JSON 回复格式

原始 JSON 来自 API

[
{
"fileName": "classification_results_1756990750241.json",
"mimeType": "application/json",
"fileSize": 221,
"success": true,
"message": "Document classification completed successfully",
"docName": "document.pdf"
}
]

用例

文件分类和路由

  • 智能文档路由下载并处理 JSON 要提取的文件 className 用于根据文档类型自动将文档路由到相应部门、系统或处理队列的字段
  • 基于模板的处理利用 templateIdJSON 文件用于应用特定的文档模板和处理规则,以便对类似文档类型进行一致的处理。
  • 自动化工作流程触发器解析 JSON 文件和触发器特定 n8n 基于工作流程 className 启动特定文档业务流程的价值

审计和合规跟踪

  • 请求可追溯性使用生成的 JSON 文件用于在整个文档处理流程中提供完整的审计跟踪和请求跟踪。
  • 处理时间戳监控利用 classificationTimestampJSON 文件用于监控处理时间并确保服务水平协议 (SLA) 合规性
  • 操作日志:使用以下方式跟踪所有分类操作 JSON 文件用于全面记录活动日志和合规性报告

文档管理与组织

  • 源文件跟踪使用 docName 用于维护文档沿袭关系并在处理工作流程中跟踪原始文件名的字段
  • 成功状态监控:根据以下情况实现错误处理和重试逻辑: success 稳健文档处理的状态
  • 基于文件的管理通过处理生成的文件来整理文档 JSON 用于一致分类和文档标准化的文件

获取帮助