使用拆分 Word 文档 n8n 行动
PDF4me 拆分 Word 文档 能够将 Word 文档拆分成多个较小的文档 n8n 自动化工作流程提供灵活的拆分选项和全面的配置控制。这项强大的文档拆分功能支持基于页面、基于章节、基于标题的拆分以及自定义页面范围,并可完全控制拆分条件、文档命名和输出组织方式,是文档管理、内容分发和工作流程自动化的理想之选。
相关博客文章
目前尚无关于此功能的博客文章——敬请期待。
在此期间,您可以浏览 PDF4me 博客,查看适用于各平台的教程和工作流程。
访问博客 →
设置
添加 PDF4me 将“拆分 Word 文档”节点添加到您的 n8n 工作流程并配置所需参数。有关初始设置说明,请参阅我们的 n8n 集成指南。
先决条件:
- PDF4me API 证书
- n8n 工作流访问
配置:
- 添加 PDF4me 节点到工作流
- 选择“拆分 Word 文档”操作
- 配置输入参数(见下文)

参数
以下是“拆分 Word 文档”操作的完整参数列表。配置这些参数可以控制文档拆分行为。
重要的: 标有星号 (***) 的参数为必填项。高级参数可对拆分标准和文档处理进行更精细的控制。
| 范围 | 类型 | 描述 | 例子 |
|---|---|---|---|
| 输入数据类型*** | String | Word文档输入格式选择 • 选择 Word 文档数据输入格式 • PDF4me 支持多种输入类型 • 选项:二进制数据, Base64 字符串,或 URL | Binary Data |
| 输入二进制字段*** | 二进制 | 二进制字文件输入 (二进制数据必填) • 参考先前文档中的 Word 文件(.docx、.doc)。 n8n 节点或文件上传 • PDF4me 处理具有自动格式检测功能的二进制 Word 文件 • 当输入数据类型为“二进制数据”时为必填项 | {{ $binary.data }} |
| Base64 文字内容*** | String | Base64 编码词输入 (如果是 Base64 字符串则为必填项) • 提供以 base64 编码字符串形式保存的 Word 文档内容(.docx、.doc),以确保安全传输。 • PDF4me 自动解码和处理 Word 内容 • 当输入数据类型为“Base64 字符串”时为必填项 | UEsDBBQABgAI... |
| Word文档URL*** | String | 公开文档 URL 输入 (如果是 URL,则为必填项) • 提供公开/开放权限 URL 到待处理的 Word 文件(.docx、.doc) • PDF4me 从提供的源下载并处理 Word 文件。 URL • 当输入数据类型为“URL”时为必填项 | https://abc.com/document.docx |
| Word 文档名称*** | String | Word文档输入文件名 • 请指定输入 Word 文件的名称,并带有正确的扩展名(.docx、.doc)。 • PDF4me 此功能用于格式检测和处理优化 | document.docx |
| 分体式 | String | 文档拆分类型 • 所有页面 - 拆分为多个页面(默认) • 数组 - 按页码范围拆分(例如,“1-3,4,5-7”) • numberofpages - 按页码范围拆分(与“数组”相同) • 部分 - 按文档部分拆分 • 标题 - 按标题样式拆分(例如,“标题 1”) | "allpages" |
| 拆分配置 | String | 拆分配置 • 页码范围:“1-3,4,5-7”(第 1-3 页,第 4 页,第 5-7 页) • 单页:“1,3,5”(第 1、3 和 5 页) • 标题样式:“一级标题”或“二级标题” • 当拆分类型为“数组”、“页数”或“标题”时为必填项 | "1-3,4,5-7" |
| 文化名称 | String | 文件文化/本地化 • 文档处理的文化代码(例如“en-US”、“de-DE”、“fr-FR”) • 默认值:"en-US" • 影响文档语言和格式 | en-US |
输出
输出参数
| 范围 | 类型 | 描述 | 例子 |
|---|---|---|---|
| 文件名 | String | 拆分文档文件名 - 输出拆分后的 Word 文档文件名 | document_part1.docx |
| 文件大小 | 数字 | 文件大小(字节) - 拆分后的 Word 文档的大小(以字节为单位) | 13398 |
| 零件编号 | 数字 | 零件编号 - 此分割部分的序号(从 1 开始) | 1 |
| 总零件数 | 数字 | 零件总数 - 从原始文档创建的拆分部分总数 | 1 |
| 成功 | Boolean | PDF4me 运行状态 - Boolean 指示文档拆分操作成功或失败的标志。 PDF4me 返回 true 为了成功运营和 false 任何错误 | true |
| 原始文件名 | String | 原始 Word 文档文件名 - 输入的 Word 文档文件名 | document.docx |
| 分体式 | String | 使用的分体式 - 应用的拆分类型(例如,“页面”、“章节”、“标题”) | Pages |
| 页面范围 | String | 页面范围 - 用于拆分的页面范围(例如,“1,2,3”或“1-3,4,5-7”) | 1,2,3 |
| 文化名称 | String | 文件文化/地域 - 用于文档处理的区域代码(例如,“en-US”、“de-DE”、“fr-FR”) | en-US |
| 信息 | String | 操作消息 - 描述拆分操作结果的消息,包括部件信息 | Split document part 1 of 1 |
N8N 行动反应
这 PDF4me 拆分 Word 文档 API 返回的结果可以以多种格式查看。请选择最符合您需求的视图:
- JSON
- Table
- Schema
- Binary
JSON 回复格式
原始 JSON 来自 API:
[
{
"fileName": "document_part1.docx",
"fileSize": 13398,
"partNumber": 1,
"totalParts": 1,
"success": true,
"originalFileName": "document.docx",
"splitType": "Pages",
"pageRanges": "1,2,3",
"cultureName": "en-US",
"message": "Split document part 1 of 1"
}
]
表格视图
以结构化表格格式呈现的响应数据(显示第一个拆分文档):
| 范围 | 价值 |
|---|---|
| fileName | document_part1.docx |
| fileSize | 13398 |
| partNumber | 1 |
| totalParts | 1 |
| success | true |
| originalFileName | document.docx |
| splitType | Pages |
| pageRanges | 1,2,3 |
| cultureName | en-US |
| message | Split document part 1 of 1 |
注意:数组中返回多个文档,每个拆分部分对应一个文档。
架构视图
响应的数据结构和类型:
1 item
[0]
fileName: T document_part1.docx
fileSize: # 13398
partNumber: # 1
totalParts: # 1
success: ☑ true
originalFileName: T document.docx
splitType: T Pages
pageRanges: T 1,2,3
cultureName: T en-US
message: T Split document part 1 of 1
类型指示器:
T= String (文本)#= 数字☑= Boolean[]= Array
二进制数据视图
实际的 Word 文档文件数据和元数据(针对每个拆分文档):
data
─────────────────────────────
File Name: document_part1.docx
File Extension: docx
Mime Type: application/vnd.openxmlformats-officedocument.wordprocessingml.document
File Size: 13.4 kB
二进制数据访问:
- n8n 二进制对象:
$binary.data.data(针对每个拆分文档) - Base64 内容可直接使用
- 文件操作可供下载、通过电子邮件发送或存储
- 多个文件每个分割部分都可作为单独的二进制项使用。
用例
企业文档自动化
- 文档管理将大型文档拆分成易于管理的部分
- 内容分发:拆分文档以进行定向分发
- 工作流自动化分别处理文档的各个部分。
- 档案管理将文档拆分成逻辑部分进行整理。
人工智能驱动的文档处理
- 多格式支持处理 .docx 和 .doc 格式的 Word 文档
- 多语言处理支持不同语言和地区
- 智能分割:基于文档结构的自动拆分
商业智能与分析
- 文件组织:按适当结构整理文档
- 内容管理通过将内容拆分为逻辑单元来管理内容
- 绩效指标跟踪处理准确性和效率