Saltar al contenido principal

Convertir PDF para editar PDF usando OCR en Power Automate

PDF4me PDF OCR La acción transforma imágenes escaneadas y basadas en imágenes. PDFs en documentos editables y con capacidad de búsqueda en Power Automate utilizando tecnología avanzada de reconocimiento óptico de caracteres. Esta potente función de digitalización ofrece opciones de Borrador y Alta calidad, lógica de salto inteligente para texto ya buscable, soporte multilingüe y crea texto buscable. PDFs que permite la búsqueda de texto completo, la extracción de contenido y el procesamiento de datos en Microsoft 365 flujos de trabajo.

Entradas de blog relacionadas
Aún no hay ninguna entrada de blog sobre esta función; estará disponible próximamente.
Mientras tanto, echa un vistazo al blog de PDF4me para encontrar tutoriales y flujos de trabajo para todas las plataformas.
Visita el blog

Autenticando su API Pedido

Para acceder al PDF4me Web API a través de Power AutomateCada solicitud debe incluir las credenciales de autenticación adecuadas. La autenticación garantiza una comunicación segura y valida su identidad como usuario autorizado, lo que permite una integración perfecta entre su Power Automate flujos y PDF4mesu potente OCR servicios.

Convierta un PDF a un PDF editable usando OCR Power Automate.

Características principales

  • OCR Tecnología: Convertir imágenes y fotos escaneadas en texto con capacidad de búsqueda
  • Reconocimiento inteligente: Saltar OCR si el texto ya se puede buscar para guardarlo API llamadas
  • Opciones de calidad: Elija Borrador o Alta calidad según la complejidad del documento.
  • Soporte multilingüe: Especifique el idioma de origen para un reconocimiento preciso.
  • Procesamiento por lotes: Convertir múltiples escaneos PDFs en flujos de trabajo automatizados

Parámetros

Lista completa de parámetros para la conversión PDF para editar PDF usando OCR acción. Configure estos parámetros para controlar OCR procesamiento.

Importante: Los parámetros marcados con un asterisco (***) son obligatorios y deben proporcionarse para que la acción funcione correctamente.

ParámetroTipoDescripciónEjemplo
Contenido del archivo***BinarioFuente PDF Contenido del archivo
• Mapa PDF archivo de la salida de la acción anterior
• Admite escaneos y documentos basados en imágenes. PDFs
• Puede ser de SharePoint, OneDrive, correo electrónico
• Debe ser válido PDF documento
[File Content from Get File]
Nombre del archivo***StringPDF Nombre del documento
• Nombre del archivo fuente con la extensión de archivo adecuada
• Se utiliza para el procesamiento y la identificación de la salida.
• Debe incluir la extensión .pdf
• Admite la asignación dinámica de nombres desde flujos
ScannedDocument.pdf
Tipo de calidadOpciónOCR Nivel de calidad
Borrador - Adecuado para uso normal PDFs, consume 1 API llamada por archivo
Alto - Adecuado para PDFs generado a partir de imágenes y documentos escaneados, consume 2 API llamadas por página
• Si no se especifica, el valor predeterminado es Borrador.
High
OCR solo cuando sea necesario***BooleanElegante OCR Optimización
- Saltar OCR si el texto ya es buscable
No - Realizar siempre OCR independientemente del estado del texto
• Ahorra API llamadas comprobando primero la capacidad de búsqueda
• Se recomienda configurarlo como Sí
Yes
IdiomaStringIdioma del documento fuente
• Especificar el idioma del texto en el archivo fuente
• Úselo únicamente si la salida no es reconocible.
• Mejora OCR precisión para idiomas específicos
• Opcional, se detecta automáticamente si no se especifica.
en

Producción

El PDF4me Convertir PDF para editar PDF usando OCR La acción devuelve datos de salida completos para una operación sin interrupciones. Power Automate integración de flujo:

Vista de tabla

Datos de respuesta en formato de tabla estructurada:

ParámetroTipoDescripción
Contenido del archivoBinarioBuscable PDF archivo con OCR-capa de texto extraída
Nombre del archivoStringNombre del resultado que se puede buscar PDF archivo

Ejemplos de flujo de trabajo

El PDF4me Convertir PDF para editar PDF usando OCR acción en Power Automate Proporciona plantillas de flujo de trabajo completas diseñadas para escenarios empresariales reales:

Flujo de trabajo automatizado para la digitalización de archivos documentales

Transforme sus archivos en papel con la automatización OCR Procesando:

Pasos completos del flujo de trabajo:

  1. Desencadenar: Documento escaneado PDF subido a la carpeta de digitalización
  2. Obtener escaneo: Recuperar escaneado PDF de SharePoint
  3. Aplicar OCR: Convertir a formato de búsqueda PDF con alta calidad
  4. Extraer texto: Extraer el contenido de texto completo para su indexación
  5. Documento clasificado: Usar AI para categorizar el tipo de documento
  6. Actualizar metadatos: Agregar datos extraídos a SharePoint metadatos
  7. Trasladar al archivoTransferencia con posibilidad de búsqueda PDF archivo permanente
  8. Índice de actualización: Agregar documento a la base de datos de búsqueda

Beneficios para la empresa:

  • Digitaliza más de 500 documentos antiguos al mes.
  • Permite la búsqueda de texto completo en archivos históricos.
  • Reduce el tiempo de recuperación de documentos de horas a segundos.
  • Crea una biblioteca digital accesible a partir de archivos en papel.

Casos de uso y aplicaciones en la industria

Casos de uso de servicios legales y profesionales

  • Digitalización de documentos de casos: Expedientes escaneados mediante OCR para facilitar la búsqueda
  • Procesamiento de contratosConvertir contratos escaneados en archivos PDF con capacidad de búsqueda.
  • Tramitación de documentos judiciales: Documentos presentados por OCR para la gestión del caso
  • Descubrimiento de documentos: Crear archivos PDF con capacidad de búsqueda para el descubrimiento electrónico de pruebas.

Obtén ayuda