Saltar al contenido principal

Extraer texto de Word en Power Automate

PDF4me Extraer texto de Word La acción recupera el contenido de texto de los documentos de Word en Power Automate con opciones avanzadas de control de extracción. Esta función integral admite la especificación de rangos de páginas (página de inicio/fin), eliminación de comentarios, aceptación de cambios controlados y devuelve tanto el contenido de texto como el archivo de texto, lo que permite el análisis de contenido, la extracción de datos y el procesamiento de texto en Microsoft 365 flujos de trabajo.

Entradas de blog relacionadas
Aún no hay ninguna entrada de blog sobre esta función; estará disponible próximamente.
Mientras tanto, echa un vistazo al blog de PDF4me para encontrar tutoriales y flujos de trabajo para todas las plataformas.
Visita el blog

Autenticando su API Pedido

Para acceder al PDF4me Web API a través de Power AutomateCada solicitud debe incluir las credenciales de autenticación adecuadas. La autenticación garantiza una comunicación segura y valida su identidad como usuario autorizado, lo que permite una integración perfecta entre su Power Automate flujos y PDF4meLos potentes servicios de extracción de texto de Word.

Extraer texto de Word con Power Automate

Características principales

  • Control de rango de páginas: Extraer texto de rangos de páginas específicos
  • Eliminación de comentariosOpción para excluir comentarios antes de la extracción.
  • Control de cambios: Aceptar los cambios registrados antes de la extracción
  • Salida de archivo de texto: Recibir el texto extraído como archivo descargable
  • Procesamiento por lotes: Extraer texto de varios documentos de Word

Parámetros

Lista completa de parámetros para la acción Extraer texto de Word. Configure estos parámetros para controlar la extracción de texto.

Importante: Los parámetros marcados con un asterisco (***) son obligatorios y deben proporcionarse para que la acción funcione correctamente.

ParámetroTipoDescripciónEjemplo
Contenido del archivo***BinarioContenido del archivo Word de origen
• Mapear el documento de Word de la acción anterior
• Debe ser válido DOCX formato
• Admite archivos de SharePoint, OneDrive, correo electrónico
• Se puede recuperar dinámicamente de los flujos
[File Content from Get File]
Nombre del archivo***StringNombre del documento de Word
• Nombre del archivo de Word
• Se utiliza para procesar la identificación
• Debe incluir la extensión .docx
• Admite nombres dinámicos
Document.docx
Número de página inicialStringPágina de inicio de extracción
• Número de página para iniciar la extracción de texto
• Valor numérico para un punto de partida específico
• Déjelo vacío para empezar desde el principio.
• Útil para extraer secciones específicas
1
Número de página finalStringPágina final de extracción
• Número de página para finalizar la extracción de texto
• Valor numérico para un punto final específico
• Déjelo vacío para extraer hasta el final.
• Útil para extraer secciones específicas
10
Eliminar comentariosBooleanControl de exclusión de comentarios
Verdadero - Eliminar comentarios antes de la extracción del texto
FALSO - Incluir comentarios en el texto extraído
• Útil para la extracción de texto limpio
• El valor predeterminado es Falso si no se especifica.
true
Aceptar cambiosBooleanProcesamiento de control de cambios
Verdadero - Acepte todos los cambios registrados antes de la extracción.
FALSO - Extraer el texto con los cambios tal cual están
• Útil para finalizar el contenido
• El valor predeterminado es Falso si no se especifica.
true

Producción

El PDF4me Extraer texto de Word La acción devuelve datos de salida completos para una operación sin interrupciones. Power Automate integración de flujo:

Vista de tabla

Datos de respuesta en formato de tabla estructurada:

ParámetroTipoDescripción
ID del trabajoStringIdentificador único para la operación de extracción
Contenido del archivoBinarioContenido del archivo de texto que contiene el texto extraído
TextoStringContenido de texto extraído como cadena

Ejemplos de flujo de trabajo

El PDF4me Extraer texto de Word acción en Power Automate Proporciona plantillas de flujo de trabajo completas diseñadas para escenarios empresariales reales:

Flujo de trabajo automatizado para el análisis del contenido de documentos

Transforma la revisión de contenido con extracción y análisis de texto automatizados:

Pasos completos del flujo de trabajo:

  1. Desencadenar: Documento de política subido para su revisión
  2. Obtener documento: Recuperar documento de Word de SharePoint
  3. Extraer texto: Obtener todo el contenido de texto sin comentarios
  4. Analizar el contenido: Utilice AI Builder para la extracción de frases clave
  5. Verificar el cumplimiento: Analice el texto para verificar los términos de cumplimiento requeridos.
  6. Problemas con las banderas: Identificar el contenido obligatorio que falta
  7. Generar informe: Crear informe de revisión de cumplimiento
  8. Revisores de correo electrónico: Enviar los resultados del análisis al equipo de revisión

Beneficios para la empresa:

  • Analiza más de 50 documentos de políticas trimestralmente.
  • Automatiza la verificación del contenido de cumplimiento
  • Reduce el tiempo de revisión de 2 horas a 15 minutos.
  • Garantiza que todo el contenido requerido esté presente antes de su aprobación.

Casos de uso y aplicaciones en la industria

Casos de uso corporativos y empresariales

  • Análisis de contenido: Extraer texto para análisis de contenido mediante IA
  • Indexación de documentos: Crear índices de texto que permitan realizar búsquedas
  • Preparación de la traducción: Extraer texto para servicios de traducción
  • Migración de contenido: Trasladar contenido de Word a otras plataformas

Obtén ayuda