Extraer texto e imágenes en Power Automate
PDF4me Extraer texto e imágenes La acción recupera todo el contenido textual y las imágenes incrustadas de PDF documentos en Power Automate para una extracción de contenido integral. Esta función versátil ofrece control independiente sobre la extracción de texto e imágenes, devolviendo el texto completo como cadena y las imágenes como matriz de objetos, lo que permite la reutilización de contenido, el análisis de datos, el procesamiento de imágenes y la distribución de contenido en múltiples formatos. Microsoft 365 flujos de trabajo.
Autenticando su API Pedido
Para acceder al PDF4me Web API a través de Power AutomateCada solicitud debe incluir las credenciales de autenticación adecuadas. La autenticación garantiza una comunicación segura y valida su identidad como usuario autorizado, lo que permite una integración perfecta entre su Power Automate flujos y PDF4mesus potentes servicios de extracción de contenido.

Características principales
- Extracción de texto: Recuperar todo el contenido de texto de PDF documentos
- Extracción de imágenesExtraer todas las imágenes incrustadas como archivos separados.
- Control independiente: Elija extraer solo texto, solo imágenes o ambas.
- Array Producción: Recibir imágenes como un array para su iteración y procesamiento.
- Procesamiento por lotes: Extraer contenido de múltiples PDFs en flujos de trabajo
Parámetros
Lista completa de parámetros para la acción Extraer texto e imágenes. Configure estos parámetros para controlar la extracción de contenido.
Importante: Los parámetros marcados con un asterisco (***) son obligatorios y deben proporcionarse para que la acción funcione correctamente.
| Parámetro | Tipo | Descripción | Ejemplo |
|---|---|---|---|
| Contenido del archivo*** | Binario | Fuente PDF Contenido del archivo • Mapa PDF archivo de la salida de la acción anterior • Apoya PDFs de SharePoint, OneDrive, correo electrónico • Se puede recuperar dinámicamente a partir de variables de flujo. • Debe ser válido PDF documento | [File Content from Get File] |
| Nombre*** | String | PDF Nombre del documento • Fuente PDF Nombre del archivo con extensión .pdf • Se utiliza para procesar la identificación • Debe incluir la extensión de archivo correcta. • Admite la asignación dinámica de nombres desde flujos | Document.pdf |
| Extraer imágenes*** | Boolean | Control de extracción de imágenes • Verdadero - Extraer todas las imágenes incrustadas • FALSO - Omitir la extracción de imágenes • Establecer en falso si no se requieren imágenes • Reduce el procesamiento cuando solo se necesita texto. | true |
| Extraer texto*** | Boolean | Control de extracción de texto • Verdadero - Extraer todo el contenido de texto • FALSO - Omitir la extracción de texto • Establecer en falso si no se requiere texto • Reduce el procesamiento cuando solo se necesitan imágenes | true |
Producción
El PDF4me Extraer texto e imágenes La acción devuelve datos de salida completos para una operación sin interrupciones. Power Automate integración de flujo:
- Table
- JSON
- Flow Integration
Vista de tabla
Datos de respuesta en formato de tabla estructurada:
| Parámetro | Tipo | Descripción |
|---|---|---|
| Textos | String | Contenido de texto completo extraído de PDF |
| Imágenes | Array | Lista de imágenes extraídas devueltas como una matriz de objetos |
JSON Formato de respuesta
{
"Texts": "Extracted text content from entire PDF document...",
"Images": [
{
"ImageData": "[Base64 Image Content]",
"ImageName": "image_1.png"
},
{
"ImageData": "[Base64 Image Content]",
"ImageName": "image_2.png"
}
]
}
Power Automate Uso del flujo
Utilice el contenido extraído en acciones posteriores:
- Análisis de textoAnaliza el texto extraído con AI Builder.
- Procesamiento de imágenes: Procesar las imágenes extraídas individualmente
- Almacenamiento de bases de datosAlmacenar texto e imágenes en bases de datos.
- Reutilización de contenido: Reutilizar el contenido extraído en nuevos documentos
- Indexación de búsqueda: Indexar el texto extraído para facilitar la búsqueda.
- Archivar por separado: Almacenar texto e imágenes en una estructura organizada.
Ejemplos de flujo de trabajo
El PDF4me Extraer texto e imágenes acción en Power Automate Proporciona plantillas de flujo de trabajo completas diseñadas para escenarios empresariales reales:
- Content Archival
- Content Analysis
- Content Migration
- Translation Preparation
Separación y archivo automatizado de contenido
Transforma la gestión de tu contenido con extracción y almacenamiento automatizados:
Pasos completos del flujo de trabajo:
- Desencadenar: Documento subido a la carpeta de procesamiento
- Obtener documento: Recuperar PDF de SharePoint
- Contenido del extracto: Extraer tanto texto como imágenes
- Guardar texto: Almacenar el texto extraído en un archivo de texto en el archivo comprimido.
- Aplicar a cada imagen: Iterar a través de las imágenes extraídas
- Guardar imágenes: Almacenar cada imagen individualmente en la carpeta de imágenes.
- Crear índiceGenerar metadatos con referencias de texto e imagen.
- Actualizar la base de datosDetalles y ubicaciones de extracción de registros
Beneficios para la empresa:
- Separa el contenido de más de 200 PDFmensual
- Permite la gestión independiente de texto e imágenes.
- Reduce la redundancia de almacenamiento en un 60%.
- Facilita la reutilización y la adaptación del contenido.
Automatizado PDF Flujo de trabajo de análisis de contenido
Optimice el análisis de contenido con la extracción automatizada de texto e imágenes:
Pasos completos del flujo de trabajo:
- Desencadenar: Artículo de investigación PDF subido para análisis
- Conseguir PDF: Recuperar PDF de la biblioteca de investigación
- Extraer texto: Recuperar todo el contenido de texto
- Analizar textoUtilice AI Builder para el análisis de sentimientos y frases clave.
- Extraer imágenes: Obtener todas las imágenes y gráficos incrustados
- Procesar imágenes: Utilizar la visión artificial para analizar imágenes
- Elaborar informe: Crear informe de análisis con los resultados
- Investigadores de correo electrónico: Enviar resumen del análisis
Beneficios para la empresa:
- Analiza más de 50 documentos de investigación al mes.
- Automatiza el análisis integral del contenido.
- Reduce el tiempo de análisis de 4 horas a 20 minutos.
- Permite obtener información basada en IA a partir de PDF contenido
Migración automatizada de contenido a SharePoint
Optimice la migración de contenido con extracción e importación automatizadas:
Pasos completos del flujo de trabajo:
- Desencadenar: Legado PDF subido para migración
- Conseguir PDF: Recuperar PDF desde la fuente de migración
- Extraer texto: Obtener todo el contenido de texto para la indexación
- Extraer imágenes: Recuperar todas las imágenes incrustadas
- Crear SharePoint Página: Construir moderno SharePoint página
- Agregar contenido de texto: Importar el texto extraído a la página
- Subir imágenes: Agregar imágenes a SharePoint activos
- Contenido del enlace: Imágenes de referencia en el contenido de la página
Beneficios para la empresa:
- Migra más de 100 archivos heredados. PDFformato mensual a moderno
- Permite la búsqueda y el descubrimiento de contenido en SharePoint
- Reduce el tiempo de migración manual en un 85 %.
- Mantiene la accesibilidad y la usabilidad del contenido.
Extracción automatizada de contenido para traducción
Optimice los flujos de trabajo de traducción con la extracción automatizada de contenido:
Pasos completos del flujo de trabajo:
- DesencadenarDocumento marcado para traducción
- Obtener documento: Recuperar PDF que requiere traducción
- Extraer texto: Obtener todo el contenido de texto
- Extraer imágenes: Recuperar las imágenes incrustadas por separado
- Enviar al traductor: Enviar texto al Traductor de Azure API
- Traducir texto: Convertir texto al idioma de destino
- Recrear documento: Construir nuevo PDF con texto traducido e imágenes originales
- Enviar correo electrónico a las partes interesadas: Enviar documento traducido
Beneficios para la empresa:
- Traduce más de 40 documentos al mes.
- Conserva las imágenes originales mientras traduce el texto.
- Reduce el tiempo de preparación de la traducción en un 75%.
- Permite la creación rápida de documentos en varios idiomas.
Casos de uso y aplicaciones en la industria
- Publishing & Media
- Legal & Professional Services
- Marketing & Communications
- Education & Training
Casos de uso en el sector editorial y de medios de comunicación
- Extracción de contenido: Extraer texto e imágenes para su reutilización.
- Gestión de activos digitales: Separar y catalogar los activos de documentos
- Migración de contenido: Extraer contenido para la migración de la plataforma
- Gestión de archivos: Organice el contenido por separado para un mejor acceso.
Casos de uso de servicios legales y profesionales
- Revisión de documentos: Extraer texto para revisión y análisis legal
- Recopilación de pruebas: Extraer imágenes y texto de los documentos del caso
- Procesamiento de descubrimientoContenido independiente para el descubrimiento electrónico de pruebas.
- Análisis de contenido: Extracto para cumplimiento y revisión
Casos de uso de marketing y comunicaciones
- Reutilización de contenidoExtraer contenido para su reutilización en marketing.
- Recopilación de activosRecopilar imágenes para bibliotecas de marketing
- Materiales de campaña: Extraer contenido para la creación de campañas
- Gestión de activos de marca: Recopilar logotipos e imágenes de marca
Casos de uso en educación y formación
- Extracción de contenido del cursoExtraer texto e imágenes de los materiales del curso.
- Creación de objetos de aprendizajeContenido independiente para la carga en el LMS.
- Migración de contenido: Extraer para transiciones de plataforma
- Gestión de archivosOrganizar los recursos de contenido educativo