Saltar al contenido principal

Extraer texto e imágenes en Power Automate

PDF4me Extraer texto e imágenes La acción recupera todo el contenido textual y las imágenes incrustadas de PDF documentos en Power Automate para una extracción de contenido integral. Esta función versátil ofrece control independiente sobre la extracción de texto e imágenes, devolviendo el texto completo como cadena y las imágenes como matriz de objetos, lo que permite la reutilización de contenido, el análisis de datos, el procesamiento de imágenes y la distribución de contenido en múltiples formatos. Microsoft 365 flujos de trabajo.

Entradas de blog relacionadas(1)

Autenticando su API Pedido

Para acceder al PDF4me Web API a través de Power AutomateCada solicitud debe incluir las credenciales de autenticación adecuadas. La autenticación garantiza una comunicación segura y valida su identidad como usuario autorizado, lo que permite una integración perfecta entre su Power Automate flujos y PDF4mesus potentes servicios de extracción de contenido.

Extraer texto e imágenes con Power Automate

Características principales

  • Extracción de texto: Recuperar todo el contenido de texto de PDF documentos
  • Extracción de imágenesExtraer todas las imágenes incrustadas como archivos separados.
  • Control independiente: Elija extraer solo texto, solo imágenes o ambas.
  • Array Producción: Recibir imágenes como un array para su iteración y procesamiento.
  • Procesamiento por lotes: Extraer contenido de múltiples PDFs en flujos de trabajo

Parámetros

Lista completa de parámetros para la acción Extraer texto e imágenes. Configure estos parámetros para controlar la extracción de contenido.

Importante: Los parámetros marcados con un asterisco (***) son obligatorios y deben proporcionarse para que la acción funcione correctamente.

ParámetroTipoDescripciónEjemplo
Contenido del archivo***BinarioFuente PDF Contenido del archivo
• Mapa PDF archivo de la salida de la acción anterior
• Apoya PDFs de SharePoint, OneDrive, correo electrónico
• Se puede recuperar dinámicamente a partir de variables de flujo.
• Debe ser válido PDF documento
[File Content from Get File]
Nombre***StringPDF Nombre del documento
• Fuente PDF Nombre del archivo con extensión .pdf
• Se utiliza para procesar la identificación
• Debe incluir la extensión de archivo correcta.
• Admite la asignación dinámica de nombres desde flujos
Document.pdf
Extraer imágenes***BooleanControl de extracción de imágenes
Verdadero - Extraer todas las imágenes incrustadas
FALSO - Omitir la extracción de imágenes
• Establecer en falso si no se requieren imágenes
• Reduce el procesamiento cuando solo se necesita texto.
true
Extraer texto***BooleanControl de extracción de texto
Verdadero - Extraer todo el contenido de texto
FALSO - Omitir la extracción de texto
• Establecer en falso si no se requiere texto
• Reduce el procesamiento cuando solo se necesitan imágenes
true

Producción

El PDF4me Extraer texto e imágenes La acción devuelve datos de salida completos para una operación sin interrupciones. Power Automate integración de flujo:

Vista de tabla

Datos de respuesta en formato de tabla estructurada:

ParámetroTipoDescripción
TextosStringContenido de texto completo extraído de PDF
ImágenesArrayLista de imágenes extraídas devueltas como una matriz de objetos

Ejemplos de flujo de trabajo

El PDF4me Extraer texto e imágenes acción en Power Automate Proporciona plantillas de flujo de trabajo completas diseñadas para escenarios empresariales reales:

Separación y archivo automatizado de contenido

Transforma la gestión de tu contenido con extracción y almacenamiento automatizados:

Pasos completos del flujo de trabajo:

  1. Desencadenar: Documento subido a la carpeta de procesamiento
  2. Obtener documento: Recuperar PDF de SharePoint
  3. Contenido del extracto: Extraer tanto texto como imágenes
  4. Guardar texto: Almacenar el texto extraído en un archivo de texto en el archivo comprimido.
  5. Aplicar a cada imagen: Iterar a través de las imágenes extraídas
  6. Guardar imágenes: Almacenar cada imagen individualmente en la carpeta de imágenes.
  7. Crear índiceGenerar metadatos con referencias de texto e imagen.
  8. Actualizar la base de datosDetalles y ubicaciones de extracción de registros

Beneficios para la empresa:

  • Separa el contenido de más de 200 PDFmensual
  • Permite la gestión independiente de texto e imágenes.
  • Reduce la redundancia de almacenamiento en un 60%.
  • Facilita la reutilización y la adaptación del contenido.

Casos de uso y aplicaciones en la industria

Casos de uso en el sector editorial y de medios de comunicación

  • Extracción de contenido: Extraer texto e imágenes para su reutilización.
  • Gestión de activos digitales: Separar y catalogar los activos de documentos
  • Migración de contenido: Extraer contenido para la migración de la plataforma
  • Gestión de archivos: Organice el contenido por separado para un mejor acceso.

Obtén ayuda