Saltar al contenido principal

Convertir PDF a editable PDF Usando OCR usando n8n acción

PDF4me Convertir PDF a editable PDF Usando OCR transforma escaneado PDFconvertir documentos basados en imágenes y en documentos editables y con capacidad de búsqueda PDFs a través de n8n Flujos de trabajo de automatización. Proceso PDFs lejos n8n disparadores, datos binarios, cadenas base64 o público URLs para aplicar OCR tecnología con soporte multilingüe, selección de nivel de calidad (Borrador/Alto), condicional OCR procesamiento, creación de capas de texto, preservación del diseño y generación de contenido con capacidad de búsqueda. Esta solución es ideal para la digitalización de documentos, el procesamiento de documentos escaneados y la facturación. OCRconversión de archivo, con capacidad de búsqueda PDF creación y automatización OCR flujos de trabajo que requieren un reconocimiento de texto preciso con formato preservado y una integración perfecta.

Entradas de blog relacionadas
Aún no hay ninguna entrada de blog sobre esta función; estará disponible próximamente.
Mientras tanto, echa un vistazo al blog de PDF4me para encontrar tutoriales y flujos de trabajo para todas las plataformas.
Visita el blog

Configuración

Añade el PDF4me "Convertir PDF a editable PDF Usando OCR" nodo a tu n8n flujo de trabajo y configure los parámetros necesarios. Para obtener instrucciones de configuración inicial, consulte nuestra n8n Guía de integración.

Requisitos previos:

  • PDF4me API credenciales
  • n8n acceso al flujo de trabajo

Configuración:

  1. Agregar PDF4me nodo a flujo de trabajo
  2. Seleccione "Convertir" PDF a editable PDF Usando OCR" acción
  3. Configure los parámetros de entrada (véase más abajo).
Convierta un PDF a un PDF editable mediante la configuración OCR.

Parámetros

Lista completa de parámetros para la conversión PDF a editable PDF Usando OCR acción. Configure estos parámetros para controlar OCR conversión.

Importante: Los parámetros marcados con un asterisco (***) son obligatorios y deben proporcionarse para que la acción funcione correctamente.

ParámetroTipoDescripciónEjemplo
Tipo de datos de entrada***StringPDF Selección del formato de entrada
• Elija el formato de su PDF entrada de documentos
PDF4me admite múltiples tipos de entrada para OCR conversión
• Opciones: Datos binarios, Base64 Cuerda o URL
Binary Data
Campo binario de entradaBinarioBinario PDF Entrada de archivo (Obligatorio si se trata de datos binarios)
• Referencia PDF archivo de anterior n8n carga de nodos o archivos
• Funciona con escaneos PDFs, basado en imágenes PDFs, y contenido mixto
• Obligatorio cuando el tipo de datos de entrada es "Datos binarios".
{{ $binary.data }}
Contenido PDF en Base64StringBase64 Codificado PDF Aporte (Obligatorio si Base64 Cadena)
• Proporcionar PDF contenido como cadena codificada en base64
• Admite varios PDF formatos que incluyen documentos escaneados
• Obligatorio cuando el tipo de datos de entrada es "Base64 Cadena"
JVBE...
URL del PDFStringPúblico PDF URL Aporte (Obligatorio si URL)
• Proporcionar un permiso público/abierto URL hacia PDF archivo
• Descarga y procesa el documento para OCR conversión
• Obligatorio cuando el tipo de datos de entrada es "URL"
https://abc.com/scanned.pdf
Nombre del documento***StringNombre del archivo de entrada
• Especifique el nombre de la entrada PDF archivo
• Importante para OCR calidad y precisión en el reconocimiento de texto
• Debe incluir la extensión .pdf
scanned_document.pdf
Tipo de calidad***StringOCR Selección de calidad
• Elija el OCR nivel de calidad de procesamiento
• Borrador: adecuado para uso normal PDFs (1 API llamada por archivo)
• Alto: adecuado para imágenes/documentos escaneados (2 API llamadas por página)
Draft
OCR solo cuando sea necesario***BooleanCondicional OCR Procesamiento
• Verdadero: aplicar OCR solo cuando PDF es basado en imágenes o no se puede buscar
• Falso: aplicar OCR a todo el contenido, independientemente de las capas de texto existentes
• Optimiza el procesamiento y API consumo
True
Idioma***StringOCR Configuración de idioma
• Especifique el idioma principal del texto en el PDF
• Optimiza OCR precisión para un mejor reconocimiento de texto
• El inglés es el idioma predeterminado; hay otros idiomas disponibles.
English
Formato de salida***BooleanControl del formato de salida
• Verdadero: habilitar opciones de formato avanzadas para la edición PDF
• Garantiza una mejor conservación del diseño y la estructura.
• Recomendado para mantener el formato del documento.
true
Combinar todas las hojas***BooleanControl de fusión de hojas
• Verdadero: fusionar todas las hojas/páginas en un único documento continuo.
• Falso: mantener la estructura y el formato de cada página individual.
• Seleccione en función de la estructura de salida deseada.
True
Nombre del archivo de salida***StringNombre del archivo de salida
• Especifique el nombre para el elemento editable generado. PDF archivo
• Debe incluir la extensión .pdf
PDF4me garantiza la validación de nombres y formatos únicos.
editable_pdf_output.pdf
Nombre del campo binario de salida***StringMapeo de datos binarios
• Defina el nombre de la variable para acceder a los elementos editables generados. PDF datos
• Se utiliza en acciones de flujo de trabajo posteriores
• Esencial para el flujo de datos del flujo de trabajo
data

Opciones avanzadas

Los siguientes parámetros están disponibles en la sección Opciones avanzadas y son opcionales:

ParámetroTipoDescripciónEjemplo
Perfiles personalizadosStringPerfiles de configuración personalizados
• Configure opciones adicionales mediante perfiles personalizados.
JSONformato similar que contiene predefinido OCR parámetros
• Incluye detección de idioma, precisión en el reconocimiento de texto y preservación del formato.
• Opcional para requisitos especializados
{ "language": "auto", "accuracy": "high", "preserveFormatting": true }

Producción

Parámetros de salida

ParámetroTipoDescripciónEjemplo
éxitoBooleanPDF4me OCR indicador de estado de conversión - Indicador booleano que señala el éxito o el fracaso de la operación. OCR Proceso de conversión. Devoluciones true para conversiones exitosas y false para cualquier error, lo que permite un manejo de errores robusto en flujos de trabajo automatizadostrue
mensajeStringPDF4me OCR mensaje de estado de conversión - Mensaje descriptivo que indica el resultado de la OCR Proceso de conversión. Proporciona mensajes de estado claros para conversiones exitosas e información detallada sobre errores para fines de resolución de problemas.PDF converted to editable PDF using OCR successfully
Nombre del archivoStringPDF4me nombre de archivo generado - El nombre de archivo completo del archivo editable procesado correctamente PDF documento con la extensión adecuada. PDF4me Garantiza una nomenclatura única y valida el cumplimiento del formato de archivo para una integración perfecta con los procesos posteriores.editable_pdf_output.pdf
tipo mimeStringPDF4me MIME identificador de tipo - El estandarizado MIME tipo para el editable generado PDF archivo, siempre configurado en application/pdf por PDF4me's OCR Motor de procesamiento. Esto garantiza el correcto manejo y reconocimiento de archivos en todos los sistemas y aplicaciones.application/pdf
Tamaño del archivoNúmeroPDF4me Tamaño del archivo en bytes - El tamaño exacto del elemento editable generado PDF Archivo en bytes, proporcionado para la planificación del almacenamiento, la optimización del ancho de banda y la monitorización de la transferencia de archivos. Esencial para la gestión de documentos empresariales y la automatización del flujo de trabajo.121875
tipo de calidadStringPDF4me OCR Configuración de calidad utilizada - La configuración de calidad que se aplicó durante el OCR Proceso de conversión. Muestra el nivel de calidad real utilizado para el reconocimiento de texto y el procesamiento de documentos. Los valores comunes incluyen "Borrador", "Alto" y "Archivo".Draft
ocrCuandoSeaNecesarioStringPDF4me OCR configuración de procesamiento condicional - Indica si OCR Se aplicó de forma condicional (solo cuando fuese necesario) o a todo el contenido. Muestra la configuración real utilizada durante el procesamiento con fines de verificación y depuración.true
idiomaStringPDF4me OCR Configuración de idioma utilizada - La configuración de idioma que se aplicó durante el OCR Proceso de conversión. Muestra el idioma real utilizado para el reconocimiento de texto para optimizar la precisión y el procesamiento.English
combinarTodasLasHojasBooleanPDF4me Configuración de combinación de hojas utilizada - Indica si todas las hojas o páginas se fusionaron en un solo documento durante el procesamiento. Muestra la configuración real aplicada para la gestión de la estructura del documento.false

N8N Respuesta a la acción

El PDF4me Convertir PDF a editable PDF Usando OCR API Devuelve una respuesta que se puede visualizar en varios formatos. Elija la vista que mejor se adapte a sus necesidades:

JSON Formato de respuesta

El crudo JSON respuesta de la API:

{
"success": true,
"message": "PDF converted to editable PDF using OCR successfully",
"fileName": "editable_pdf_output.pdf",
"mimeType": "application/pdf",
"fileSize": 121875,
"qualityType": "Draft",
"ocrWhenNeeded": "true",
"language": "English",
"mergeAllSheets": false
}

Casos de uso

Digitalización y archivo de documentos

  • Convierta documentos en papel y archivos escaneados en formatos digitales editables y con capacidad de búsqueda.
  • Digitalizar archivos históricos y documentos legados para su acceso y conservación en la actualidad.
  • Transforme formularios y documentos físicos en versiones digitales editables.

Gestión de contenido y capacidad de búsqueda

  • Permitir la búsqueda de documentos escaneados en sistemas de gestión de contenido.
  • Habilitar la búsqueda de texto completo en documentos que antes no se podían buscar.
  • Convertir imágenes PDFs en contenido accesible y editable para una mejor experiencia de usuario.

Automatización y procesamiento de flujos de trabajo

  • Automatice la conversión de documentos escaneados en los flujos de trabajo de procesamiento de documentos.
  • Procesar los documentos en papel entrantes para la extracción y el análisis automatizados de datos.
  • Habilitar el procesamiento posterior de contenido de documentos previamente estático.

Obtén ayuda