跳到主要内容

使用图像提取文本 n8n 行动

PDF4me 图像提取文本 使用以下方法从图像中提取文本内容 OCR 通过技术 n8n 自动化工作流程。通过以下方式处理图像 n8n 触发器、二进制数据、base64 字符串或公共 URL该解决方案能够自动识别和提取文本,支持多语言,具备高精度字符识别、保持布局完整性以及输出结构化文本等特性,适用于文档数字化和数据提取。它是扫描文档处理、数据录入自动化和名片制作的理想选择。 OCR收据扫描、照片文本提取和自动化 OCR 需要精确文本识别、支持多语言和无缝集成的工作流程。

相关博客文章
目前尚无关于此功能的博客文章——敬请期待。
在此期间,您可以浏览 PDF4me 博客,查看适用于各平台的教程和工作流程。
访问博客

设置

添加 PDF4me 将“图像提取文本”节点添加到您的 n8n 工作流程并配置所需参数。有关初始设置说明,请参阅我们的 n8n 集成指南

先决条件:

  • PDF4me API 证书
  • n8n 工作流访问

配置:

  1. 添加 PDF4me 节点到工作流
  2. 选择“图像提取文本”操作
  3. 配置输入参数(见下文)
图像提取文本

参数

图像提取文本操作的完整参数列表。配置这些参数可控制从图像中提取文本。

重要的: 标有星号 (***) 的参数是必需的,必须提供这些参数才能使操作正常运行。

范围类型描述例子
输入数据类型String是的PDF4me 图像输入格式选择
选择源图像数据输入的格式。
PDF4me 支持多种输入类型,并具有不同的字段要求。
1)二进制数据是的(至少需要一项)1)二进制数据 - 使用“输入二进制字段”引用上一个节点中的图像文件Binary Data
2) Base64 字符串是的(至少需要一项)2) Base64 细绳 - 使用 ”Base64 用于编码图像数据的“图像内容”字段Base64 String
3)网址是的(至少需要一项)3) URL - 使用“图像” URL用于提供公共/开放权限的字段 URL 处理图像文件URL
输入二进制字段二进制是的(如果是二进制数据)PDF4me 输入二进制图像文件 - 参考源图像文件(.jpg、.png、.gif、.bmp),来自之前的 n8n 节点或文件上传。 PDF4me 处理二进制图像文件,并自动检测和验证文件格式。当输入数据类型为“二进制数据”时需要此功能。{{ $binary.data }}
Base64 图像内容String是的(如果是 Base64 字符串)PDF4me base64编码图像输入 - 提供源图像数据(.jpg、.png、.gif、.bmp)作为 base64 编码字符串,以便安全传输。 PDF4me 自动解码和处理图像内容。当输入数据类型为“Base64 细绳”/9j/4AAQSkZJRgAB...
图片网址String是的(如果是网址)PDF4me 公众形象 URL 输入 - 提供公开/开放权限 URL 处理源图像文件(.jpg、.png、.gif、.bmp)以提取文本。 PDF4me 从提供的目录中下载并处理文件。 URL当输入数据类型为“URLhttps://abc.com/demo.jpg
输出文件名String是的PDF4me 输出文件名配置 - 指定生成的文本提取文件的名称,并带有正确的扩展名(.json、.txt)。这是一个输入参数,用于配置输出文件的名称。 PDF4me 确保唯一命名并验证文件格式合规性image_text_extract.json
AsyncBooleanPDF4me 异步处理 - 启用异步处理功能,用于处理大型图像或处理时间要求不高的情况。启用后,操作将在后台运行并立即返回结果。true
二进制数据输出名称String是的PDF4me 输出变量配置 - 定义用于访问生成的文本提取数据的变量名。 n8n 工作流程。此数据可用作工作流程中后续操作的输入数据。data

支持的图像格式

格式描述文件扩展名最大尺寸最佳应用案例
JPEG联合图像专家组(JPEG)采用有损压缩技术,针对照片进行了优化。.jpg.jpeg50MB扫描文档、带文字的照片、网页内容
PNG支持无损压缩和透明度的便携式网络图形.png50MB屏幕截图、带文字的图形、高质量文档
GIF支持动画和有限调色板的图形交换格式.gif50MB动画文本,带有文本内容的简单图形
骨形态发生蛋白位图图像格式,包含未压缩的像素数据.bmp50MB高质量扫描文档,专业图形

输出

输出参数

范围类型描述例子
成功BooleanPDF4me 文本提取状态指示器 - Boolean 指示文本提取过程成功或失败的标志。 PDF4me 返回 true 为了成功运营和 false 针对任何错误,在自动化工作流程中实现强大的错误处理能力。true
信息StringPDF4me 文本提取状态消息 - 提供易于理解的状态消息,详细说明文本提取过程的结果。包括成功确认或错误详情,以便进行故障排除。Image text extracted successfully
文件名StringPDF4me 生成的文本提取文件名 - 成功生成的文本提取文件的完整文件名(含正确扩展名)。 PDF4me 确保唯一命名并验证文件格式合规性,以便与下游流程无缝集成。image_text_extract.json
mimeTypeStringPDF4me 输出 MIME 类型 - MIME 生成的文本提取文件的类型(例如,“application/json”、“text/plain”)。这对于 Web 应用程序中的内容类型验证和正确的文件处理非常有用。application/json
文件大小数字PDF4me 文本提取文件大小(字节) - 生成的文本提取文件的确切大小(以字节为单位),由……提供 PDF4me 用于存储规划和文件传输监控0

N8N 行动反应

PDF4me 图像提取文本 API 返回的结果可以以多种格式查看。请选择最符合您需求的视图:

JSON 回复格式

原始 JSON 来自……的回应 API

[
{
"success": true,
"message": "Image text extracted successfully",
"fileName": "image_text_extract.json",
"mimeType": "application/json",
"fileSize": 0
}
]

用例

OCR 文本识别与数字化

  • 从扫描文档、收据和表格中提取文本以进行数字化处理
  • 将手写笔记和打印材料转换为可搜索文本格式
  • 处理名片和联系信息,以便自动数据录入

基于图像的内容分析

  • 从屏幕截图和图像中提取文本,用于内容分析和索引
  • 处理带有文字叠加层的社交媒体图像以进行情感分析
  • 分析产品包装和标签,以用于库存管理系统

无障碍和翻译服务

  • 从图像中提取文本,为视障用户创建可访问内容
  • 处理多语言文档以进行自动翻译工作流程
  • 将基于图像的文本转换为音频格式,以用于辅助功能应用程序

研究与数据挖掘

  • 从研究论文、文章和学术文件中提取文本
  • 处理历史文献和档案,用于数字化研究项目
  • 分析基于图像的调查和反馈表以收集数据

获取帮助