得到 PDF 使用元数据 n8n 行动
PDF4me 得到 PDF 元数据 从文档中提取全面的文档信息和技术属性 PDF 通过文件 n8n 自动化工作流程。流程 PDFs 通过 n8n 触发器、二进制数据、base64 字符串或公共 URLs 检索包括文档属性、页数、文件大小、创建日期、作者信息和技术规格在内的详细元数据。这款企业级解决方案非常适合需要精确属性分析和可靠元数据提取的文档管理系统、合规性工作流程、内容分析、审计跟踪和自动化文档检查,并能实现无缝衔接。 n8n 一体化。
相关博客文章
目前尚无关于此功能的博客文章——敬请期待。
在此期间,您可以浏览 PDF4me 博客,查看适用于各平台的教程和工作流程。
访问博客 →
设置
添加 PDF4me 将“获取 PDF 元数据”节点添加到您的 n8n 工作流程并配置所需参数。有关初始设置说明,请参阅我们的 n8n 集成指南。
先决条件:
- PDF4me API 证书
- n8n 工作流访问
配置:
- 添加 PDF4me 节点到工作流
- 选择“获取 PDF 元数据”操作
- 配置输入参数(见下文)

参数
获取 PDF 元数据操作的完整参数列表。配置这些参数以控制 PDF 元数据提取。
重要的: 标有星号 (***) 的参数是必需的,必须提供这些参数才能使操作正常运行。
| 范围 | 类型 | 描述 | 例子 |
|---|---|---|---|
| 输入数据类型*** | String | PDF 输入格式选择 • 选择您的格式 PDF 数据输入 • PDF4me 支持多种输入类型 • 选项:二进制数据, Base64 字符串,或 URL | Binary Data |
| 输入二进制字段 | 二进制 | 二进制 PDF 文件输入 (二进制数据必填) • 参考 PDF 来自前一个文件 n8n 节点或文件上传 • PDF4me 二进制进程 PDF 文件自动格式检测 • 当输入数据类型为“二进制数据”时为必填项 | {{ $binary.data }} |
| Base64 文档内容 | String | Base64 编码 PDF 输入 (如果是 Base64 字符串则为必填项) • 提供 PDF 数据以 base64 编码字符串的形式呈现 • PDF4me 自动解码和处理 PDF 内容 • 当输入数据类型为“Base64 细绳” | UEsDBBQABgAI... |
| 文件 URL | String | 民众 PDF URL 输入 (如果是 URL,则为必填项) • 提供公开/开放权限 URL 到 PDF 文件 • PDF4me 从提供的目录中下载并处理文件。 URL • 当输入数据类型为“URL“ | https://abc.com/sample.pdf |
| 输出文件名*** | String | 元数据输出文件名 • 指定生成的元数据文件的名称 • 必须包含 .json 扩展名 • PDF4me 确保唯一命名和格式验证 | pdf_metadata.json |
| 二进制数据输出名称*** | String | 二进制数据映射 • 定义用于访问生成的元数据二进制数据的变量名 • 用于后续工作流程操作 • 对工作流程数据流至关重要 | data |
| 异步 | Boolean | 异步处理 • 启用大文件的异步处理 • 启用此功能后,操作将在后台运行并立即返回。 • 推荐用于大尺寸 PDF 文件 | true |
高级选项
以下参数可在“高级选项”部分中找到,且为可选参数:
| 范围 | 类型 | 描述 | 例子 | |
|---|---|---|---|---|
| 自定义配置文件 | String | 不 | PDF4me 自定义配置配置文件 - 设置其他选项 PDF4me 使用自定义配置文件执行获取 PDF 元数据操作。自定义配置文件是一个字符串。 JSON类似格式,包含用于高级元数据提取设置的预定义参数。支持诸如 outputDataFormat、preserveMetadata、optimizeForPrinting、compressionLevel、detectionSensitivity、preserveAnnotations 和 colorSpaceOptimization 等选项。 | { "outputDataFormat": "json", "preserveMetadata": true, "optimizeForPrinting": false, "compressionLevel": "medium" } |
输出
输出参数
| 范围 | 类型 | 描述 | 例子 |
|---|---|---|---|
| 成功 | Boolean | PDF4me 元数据提取状态指示器 - Boolean 指示元数据提取过程成功或失败的标志。 PDF4me 返回 true 为了成功运营和 false 针对任何错误,在自动化工作流程中实现强大的错误处理能力。 | true |
| 信息 | String | PDF4me 元数据提取状态消息 - 提供易于理解的状态消息,详细说明元数据提取过程的结果。包括成功确认或错误详情,以便进行故障排除。 | PDF metadata extracted successfully |
| 文件名 | String | PDF4me 生成的元数据文件名 - 成功生成的元数据文件的完整文件名,并带有正确的 .json 扩展名。 PDF4me 确保唯一命名并验证文件格式合规性,以便与下游流程无缝集成。 | pdf_metadata.json |
| mimeType | String | PDF4me 输出 MIME 类型 - MIME 生成的元数据文件的类型,始终为“application/json”。 JSON 元数据文件。对 Web 应用程序中的内容类型验证和正确的文件处理非常有用。 | application/json |
| 文件大小 | 数字 | PDF4me 元数据文件大小(字节) - 生成的元数据文件的确切大小(以字节为单位),由……提供 PDF4me 用于存储规划、带宽优化和文件传输监控。对企业文档管理和工作流自动化至关重要。 | 125430 |
| 文档名称 | String | PDF4me 文档名称引用 - 用于参考和跟踪的已处理文档名称。此名称与文件名一致,以确保文档管理工作流程的一致性。 | pdf_metadata.json |
| 元数据提取 | Boolean | PDF4me 元数据提取确认 - Boolean 标记确认已成功从中提取元数据 PDF 文档。可用于验证元数据提取是否正确应用。 | true |
| 元数据字段 | 数字 | PDF4me 元数据字段计数 - 从以下位置成功提取的元数据字段数量 PDF 文档。可用于跟踪提取完整性和文档分析结果。 | 25 |
N8N 行动反应
这 PDF4me 获取 PDF 元数据 API 返回的结果可以以多种格式查看。请选择最符合您需求的视图:
- JSON
- Table
- Schema
- Binary
JSON 回复格式
原始 JSON 来自……的回应 API:
[
{
"success": true,
"message": "PDF metadata extracted successfully",
"fileName": "pdf_metadata.json",
"mimeType": "application/json",
"fileSize": 125430,
"docName": "pdf_metadata.json",
"metadataExtracted": true,
"metadataFields": 25
}
]
表格视图
以结构化表格格式呈现的响应数据:
| 范围 | 价值 |
|---|---|
| success | true |
| message | PDF metadata extracted successfully |
| fileName | pdf_metadata.json |
| mimeType | application/json |
| fileSize | 125430 |
| docName | pdf_metadata.json |
| metadataExtracted | true |
| metadataFields | 25 |
架构视图
响应的数据结构和类型:
1 item
success: ☑ true
message: AB PDF metadata extracted successfully
fileName: AB pdf_metadata.json
mimeType: AB application/json
fileSize: # 125430
docName: AB pdf_metadata.json
metadataExtracted: ☑ true
metadataFields: # 25
类型指示器:
AB= String#= 数字☑= Boolean
二进制数据视图
实际的元数据文件数据和信息:
data
─────────────────────────────
File Name: pdf_metadata.json
File Extension: json
Mime Type: application/json
File Size: 122.5 KB
二进制数据访问:
- n8n 二进制对象:
$binary.data.data - Base64 内容可直接使用
- 文件操作可供下载、通过电子邮件发送或存储
用例
文件分析与检查
- 提取文档属性和技术信息以进行合规性审计
- 分析 PDF 质量评估和验证的结构和内容
- 检查文档元数据以进行安全分析和内容验证
内容管理与组织
- 提取元数据以实现文档的自动分类和标记
- 分析文档属性以进行搜索引擎优化和索引
- 内容管理系统集成流程文档信息
企业文档智能
- 在文档处理工作流程中自动提取元数据
- 分析文档属性,用于商业智能和报告
- 提取文档生命周期管理和归档的技术细节