使用图像提取文本 n8n 行动
PDF4me 图像提取文本 使用以下方法从图像中提取文本内容 OCR 通过技术 n8n 自动化工作流程。通过以下方式处理图像 n8n 触发器、二进制数据、base64 字符串或公共 URL该解决方案能够自动识别和提取文本,支持多语言,具备高精度字符识别、保持布局完整性以及输出结构化文本等特性,适用于文档数字化和数据提取。它是扫描文档处理、数据录入自动化和名片制作的理想选择。 OCR收据扫描、照片文本提取和自动化 OCR 需要精确文本识别、支持多语言和无缝集成的工作流程。
相关博客文章
目前尚无关于此功能的博客文章——敬请期待。
在此期间,您可以浏览 PDF4me 博客,查看适用于各平台的教程和工作流程。
访问博客 →
设置
添加 PDF4me 将“图像提取文本”节点添加到您的 n8n 工作流程并配置所需参数。有关初始设置说明,请参阅我们的 n8n 集成指南。
先决条件:
- PDF4me API 证书
- n8n 工作流访问
配置:
- 添加 PDF4me 节点到工作流
- 选择“图像提取文本”操作
- 配置输入参数(见下文)

参数
图像提取文本操作的完整参数列表。配置这些参数可控制从图像中提取文本。
重要的: 标有星号 (***) 的参数是必需的,必须提供这些参数才能使操作正常运行。
| 范围 | 类型 | 描述 | 例子 | |
|---|---|---|---|---|
| 输入数据类型 | String | 是的 | PDF4me 图像输入格式选择 选择源图像数据输入的格式。 PDF4me 支持多种输入类型,并具有不同的字段要求。 | |
| 1)二进制数据 | 是的(至少需要一项) | 1)二进制数据 - 使用“输入二进制字段”引用上一个节点中的图像文件 | Binary Data | |
| 2) Base64 字符串 | 是的(至少需要一项) | 2) Base64 细绳 - 使用 ”Base64 用于编码图像数据的“图像内容”字段 | Base64 String | |
| 3)网址 | 是的(至少需要一项) | 3) URL - 使用“图像” URL用于提供公共/开放权限的字段 URL 处理图像文件 | URL | |
| 输入二进制字段 | 二进制 | 是的(如果是二进制数据) | PDF4me 输入二进制图像文件 - 参考源图像文件(.jpg、.png、.gif、.bmp),来自之前的 n8n 节点或文件上传。 PDF4me 处理二进制图像文件,并自动检测和验证文件格式。当输入数据类型为“二进制数据”时需要此功能。 | {{ $binary.data }} |
| Base64 图像内容 | String | 是的(如果是 Base64 字符串) | PDF4me base64编码图像输入 - 提供源图像数据(.jpg、.png、.gif、.bmp)作为 base64 编码字符串,以便安全传输。 PDF4me 自动解码和处理图像内容。当输入数据类型为“Base64 细绳” | /9j/4AAQSkZJRgAB... |
| 图片网址 | String | 是的(如果是网址) | PDF4me 公众形象 URL 输入 - 提供公开/开放权限 URL 处理源图像文件(.jpg、.png、.gif、.bmp)以提取文本。 PDF4me 从提供的目录中下载并处理文件。 URL当输入数据类型为“URL“ | https://abc.com/demo.jpg |
| 输出文件名 | String | 是的 | PDF4me 输出文件名配置 - 指定生成的文本提取文件的名称,并带有正确的扩展名(.json、.txt)。这是一个输入参数,用于配置输出文件的名称。 PDF4me 确保唯一命名并验证文件格式合规性 | image_text_extract.json |
| Async | Boolean | 不 | PDF4me 异步处理 - 启用异步处理功能,用于处理大型图像或处理时间要求不高的情况。启用后,操作将在后台运行并立即返回结果。 | true |
| 二进制数据输出名称 | String | 是的 | PDF4me 输出变量配置 - 定义用于访问生成的文本提取数据的变量名。 n8n 工作流程。此数据可用作工作流程中后续操作的输入数据。 | data |
支持的图像格式
| 格式 | 描述 | 文件扩展名 | 最大尺寸 | 最佳应用案例 |
|---|---|---|---|---|
| JPEG | 联合图像专家组(JPEG)采用有损压缩技术,针对照片进行了优化。 | .jpg, .jpeg | 50MB | 扫描文档、带文字的照片、网页内容 |
| PNG | 支持无损压缩和透明度的便携式网络图形 | .png | 50MB | 屏幕截图、带文字的图形、高质量文档 |
| GIF | 支持动画和有限调色板的图形交换格式 | .gif | 50MB | 动画文本,带有文本内容的简单图形 |
| 骨形态发生蛋白 | 位图图像格式,包含未压缩的像素数据 | .bmp | 50MB | 高质量扫描文档,专业图形 |
输出
输出参数
| 范围 | 类型 | 描述 | 例子 |
|---|---|---|---|
| 成功 | Boolean | PDF4me 文本提取状态指示器 - Boolean 指示文本提取过程成功或失败的标志。 PDF4me 返回 true 为了成功运营和 false 针对任何错误,在自动化工作流程中实现强大的错误处理能力。 | true |
| 信息 | String | PDF4me 文本提取状态消息 - 提供易于理解的状态消息,详细说明文本提取过程的结果。包括成功确认或错误详情,以便进行故障排除。 | Image text extracted successfully |
| 文件名 | String | PDF4me 生成的文本提取文件名 - 成功生成的文本提取文件的完整文件名(含正确扩展名)。 PDF4me 确保唯一命名并验证文件格式合规性,以便与下游流程无缝集成。 | image_text_extract.json |
| mimeType | String | PDF4me 输出 MIME 类型 - MIME 生成的文本提取文件的类型(例如,“application/json”、“text/plain”)。这对于 Web 应用程序中的内容类型验证和正确的文件处理非常有用。 | application/json |
| 文件大小 | 数字 | PDF4me 文本提取文件大小(字节) - 生成的文本提取文件的确切大小(以字节为单位),由……提供 PDF4me 用于存储规划和文件传输监控 | 0 |
N8N 行动反应
这 PDF4me 图像提取文本 API 返回的结果可以以多种格式查看。请选择最符合您需求的视图:
- JSON
- Table
- Schema
- Binary
JSON 回复格式
原始 JSON 来自……的回应 API:
[
{
"success": true,
"message": "Image text extracted successfully",
"fileName": "image_text_extract.json",
"mimeType": "application/json",
"fileSize": 0
}
]
表格视图
以结构化表格格式呈现的响应数据:
| 范围 | 价值 |
|---|---|
| success | true |
| message | Image text extracted successfully |
| fileName | image_text_extract.json |
| mimeType | application/json |
| fileSize | 0 |
架构视图
响应的数据结构和类型:
1 item
success: ☑ true
message: AB Image text extracted successfully
fileName: AB image_text_extract.json
mimeType: AB application/json
fileSize: # 0
类型指示器:
AB= String#= 数字☑= Boolean[]= Array
二进制数据视图
实际文本提取文件数据和信息:
data
─────────────────────────────
File Name: image_text_extract.json
File Extension: json
Mime Type: application/json
File Size: 0 bytes
Status: Image text extracted successfully
二进制数据访问:
- n8n 二进制对象:
$binary.data.data - Base64 内容可直接使用
- 文件操作可供下载、通过电子邮件发送或存储
用例
OCR 文本识别与数字化
- 从扫描文档、收据和表格中提取文本以进行数字化处理
- 将手写笔记和打印材料转换为可搜索文本格式
- 处理名片和联系信息,以便自动数据录入
基于图像的内容分析
- 从屏幕截图和图像中提取文本,用于内容分析和索引
- 处理带有文字叠加层的社交媒体图像以进行情感分析
- 分析产品包装和标签,以用于库存管理系统
无障碍和翻译服务
- 从图像中提取文本,为视障用户创建可访问内容
- 处理多语言文档以进行自动翻译工作流程
- 将基于图像的文本转换为音频格式,以用于辅助功能应用程序
研究与数据挖掘
- 从研究论文、文章和学术文件中提取文本
- 处理历史文献和档案,用于数字化研究项目
- 分析基于图像的调查和反馈表以收集数据