Saltar al contenido principal

Extracción de texto de imágenes mediante n8n acción

PDF4me Texto extraído de la imagen extrae contenido de texto de imágenes usando OCR tecnología a través de n8n flujos de trabajo de automatización. Procesar imágenes mediante n8n disparadores, datos binarios, cadenas base64 o público URLPermite reconocer y extraer texto automáticamente con soporte multilingüe, reconocimiento de caracteres de alta precisión, preservación del diseño y salida de texto estructurado para la digitalización de documentos y la extracción de datos. Esta solución es ideal para el procesamiento de documentos escaneados, la automatización de la entrada de datos y las tarjetas de visita. OCRescaneo de recibos, extracción de texto de fotos y automatización OCR Flujos de trabajo que requieren un reconocimiento de texto preciso con soporte multilingüe e integración perfecta.

Entradas de blog relacionadas
Aún no hay ninguna entrada de blog sobre esta función; estará disponible próximamente.
Mientras tanto, echa un vistazo al blog de PDF4me para encontrar tutoriales y flujos de trabajo para todas las plataformas.
Visita el blog

Configuración

Añade el PDF4me Nodo "Extraer texto de imagen" para su n8n flujo de trabajo y configure los parámetros necesarios. Para obtener instrucciones de configuración inicial, consulte nuestra n8n Guía de integración.

Requisitos previos:

  • PDF4me API credenciales
  • n8n acceso al flujo de trabajo

Configuración:

  1. Agregar PDF4me nodo a flujo de trabajo
  2. Seleccione la acción "Extraer texto de la imagen".
  3. Configure los parámetros de entrada (véase más abajo).
Texto extraído de la imagen

Parámetros

Lista completa de parámetros para la acción de extracción de texto de imágenes. Configure estos parámetros para controlar la extracción de texto de las imágenes.

Importante: Los parámetros marcados con un asterisco (***) son obligatorios y deben proporcionarse para que la acción funcione correctamente.

ParámetroTipoDescripciónEjemplo
Tipo de datos de entradaStringPDF4me Selección del formato de entrada de imagen
Elija el formato de entrada de datos de su imagen de origen.
PDF4me admite múltiples tipos de entrada con diferentes requisitos de campo
1) Datos binariosSí (Se requiere uno)1) Datos binarios - Utilice "Campo binario de entrada" para hacer referencia al archivo de imagen del nodo anterior.Binary Data
2) Cadena Base64Sí (Se requiere uno)2) Base64 Cadena - Usar "Base64 Campo "Contenido de la imagen" para datos de imagen codificadosBase64 String
3) URLSí (Se requiere uno)3) URL - Usar "Imagen" URL"campo para proporcionar un permiso público/abierto URL al archivo de imagen para procesarURL
Campo binario de entradaBinarioSí (si son datos binarios)PDF4me Entrada de archivo de imagen binaria - Referencia el archivo de imagen fuente (.jpg, .png, .gif, .bmp) de la versión anterior. n8n carga de nodos o archivos. PDF4me Procesa archivos de imagen binarios con detección y validación automática del formato. Requerido cuando el tipo de datos de entrada es "Datos binarios".{{ $binary.data }}
Contenido de imagen Base64StringSí (si es una cadena Base64)PDF4me Entrada de imagen codificada en base64 - Proporcione los datos de la imagen de origen (.jpg, .png, .gif, .bmp) como una cadena codificada en base64 para una transmisión segura. PDF4me decodifica y procesa automáticamente el contenido de la imagen. Obligatorio cuando el tipo de datos de entrada es "Base64 Cadena"/9j/4AAQSkZJRgAB...
URL de la imagenStringSí (si es una URL)PDF4me imagen pública URL aporte - Proporcionar un permiso público/abierto URL al archivo de imagen de origen (.jpg, .png, .gif, .bmp) que se procesará para la extracción de texto. PDF4me descarga y procesa el archivo desde el proporcionado URL. Obligatorio cuando el tipo de datos de entrada es "URL"https://abc.com/demo.jpg
Nombre del archivo de salidaStringPDF4me configuración del nombre del archivo de salida - Especifique el nombre del archivo de extracción de texto generado con la extensión adecuada (.json, .txt). Este es un parámetro de entrada que configura el nombre del archivo de salida. PDF4me Garantiza una nomenclatura única y valida el cumplimiento del formato de archivo.image_text_extract.json
AsyncBooleanNoPDF4me procesamiento asíncrono - Habilite el procesamiento asíncrono para imágenes grandes o cuando el tiempo de procesamiento no sea crítico. Cuando está habilitado, la operación se ejecuta en segundo plano y regresa inmediatamente.true
Nombre de salida de datos binariosStringPDF4me configuración de la variable de salida - Defina el nombre de la variable para acceder a los datos de extracción de texto generados en su n8n flujo de trabajo. Estos datos se pueden utilizar como datos de entrada en acciones posteriores dentro de su flujo de trabajo.data

Formatos de imagen compatibles

FormatoDescripciónExtensiones de archivoTamaño máximoMejores casos de uso
JPEGGrupo Conjunto de Expertos en Fotografía con compresión con pérdida optimizada para fotografías.jpg, .jpeg50 MBDocumentos escaneados, fotografías con texto, contenido web
PNGGráficos de red portátiles con compresión sin pérdidas y compatibilidad con transparencia..png50 MBCapturas de pantalla, gráficos con texto, documentos de alta calidad
GIFFormato de intercambio de gráficos con soporte para animación y paleta de colores limitada..gif50 MBTexto animado, gráficos sencillos con contenido de texto.
BMPFormato de imagen de mapa de bits con datos de píxeles sin comprimir.bmp50 MBDocumentos escaneados de alta calidad, gráficos profesionales.

Producción

Parámetros de salida

ParámetroTipoDescripciónEjemplo
éxitoBooleanPDF4me Indicador de estado de extracción de texto - Boolean Indicador que señala si el proceso de extracción de texto fue exitoso o fallido. PDF4me devoluciones true para operaciones exitosas y false para cualquier error, lo que permite un manejo de errores robusto en flujos de trabajo automatizadostrue
mensajeStringPDF4me Mensaje de estado de extracción de texto - Mensaje de estado legible para humanos que proporciona detalles sobre el resultado del proceso de extracción de texto. Incluye confirmación de éxito o detalles de error para la resolución de problemas.Image text extracted successfully
Nombre del archivoStringPDF4me nombre de archivo de extracción de texto generado - El nombre completo del archivo de extracción de texto generado correctamente, con la extensión adecuada. PDF4me Garantiza una nomenclatura única y valida el cumplimiento del formato de archivo para una integración perfecta con los procesos posteriores.image_text_extract.json
tipo mimeStringPDF4me producción MIME tipo - MIME Tipo de archivo de extracción de texto generado (por ejemplo, "application/json", "text/plain"). Útil para la validación del tipo de contenido y el manejo adecuado de archivos en aplicaciones web.application/json
Tamaño del archivoNúmeroPDF4me Tamaño del archivo de extracción de texto en bytes - El tamaño exacto del archivo de extracción de texto generado en bytes, proporcionado por PDF4me para la planificación del almacenamiento y la monitorización de la transferencia de archivos0

N8N Respuesta a la acción

El PDF4me Texto extraído de la imagen API Devuelve una respuesta que se puede visualizar en varios formatos. Elija la vista que mejor se adapte a sus necesidades:

JSON Formato de respuesta

El crudo JSON respuesta de la API:

[
{
"success": true,
"message": "Image text extracted successfully",
"fileName": "image_text_extract.json",
"mimeType": "application/json",
"fileSize": 0
}
]

Casos de uso

OCR Reconocimiento y digitalización de textos

  • Extraer texto de documentos escaneados, recibos y formularios para su procesamiento digital.
  • Convierta notas manuscritas y materiales impresos a formato de texto con capacidad de búsqueda.
  • Procesar tarjetas de visita e información de contacto para la introducción automatizada de datos.

Análisis de contenido basado en imágenes

  • Extraer texto de capturas de pantalla e imágenes para análisis e indexación de contenido.
  • Procesar imágenes de redes sociales con superposiciones de texto para análisis de sentimiento.
  • Analizar el embalaje y las etiquetas de los productos para los sistemas de gestión de inventario.

Servicios de accesibilidad y traducción

  • Extraer texto de imágenes para crear contenido accesible para usuarios con discapacidad visual.
  • Procesar documentos multilingües para flujos de trabajo de traducción automatizada.
  • Convertir texto basado en imágenes a formato de audio para aplicaciones de accesibilidad.

Investigación y minería de datos

  • Extraer texto de artículos de investigación, artículos y documentos académicos.
  • Procesar documentos históricos y archivos para proyectos de investigación digital.
  • Analizar encuestas basadas en imágenes y formularios de retroalimentación para la recopilación de datos.

Obtén ayuda