Pular para o conteúdo principal

Extrair texto e imagens em Power Automate

PDF4me Extrair texto e imagens A ação recupera todo o conteúdo textual e as imagens incorporadas de PDF documentos em Power Automate para extração de conteúdo abrangente. Este recurso versátil oferece controle independente sobre a extração de texto e imagem, retornando o texto completo como uma string e as imagens como uma matriz de objetos, permitindo a reutilização de conteúdo, análise de dados, processamento de imagens e distribuição de conteúdo em múltiplos formatos. Microsoft 365 fluxos de trabalho.

Artigos relacionados no blogue(1)

Autenticando seu API Solicitar

Para acessar o PDF4me Web API através Power AutomatePara que uma solicitação seja válida, é necessário incluir credenciais de autenticação adequadas. A autenticação garante uma comunicação segura e valida sua identidade como usuário autorizado, permitindo uma integração perfeita entre seus sistemas. Power Automate fluxos e PDF4meOs poderosos serviços de extração de conteúdo da [nome da empresa].

Extrair texto e imagens com o Power Automate

Principais características

  • Extração de textoRecuperar todo o conteúdo de texto de PDF documentos
  • Extração de ImagensExtraia todas as imagens incorporadas como arquivos separados.
  • Controle independenteEscolha extrair apenas o texto, apenas as imagens ou ambos.
  • Array SaídaReceber imagens como um array para iteração e processamento.
  • Processamento em loteExtrair conteúdo de múltiplas fontes PDFs em fluxos de trabalho

Parâmetros

Lista completa de parâmetros para a ação Extrair Texto e Imagens. Configure esses parâmetros para controlar a extração de conteúdo.

Importante: Os parâmetros marcados com um asterisco (***) são obrigatórios e devem ser fornecidos para que a ação funcione corretamente.

ParâmetroTipoDescriçãoExemplo
Conteúdo do arquivo***BinárioFonte PDF Conteúdo do arquivo
• Mapa PDF arquivo da saída da ação anterior
• Suporta PDFs de SharePoint, OneDrive, e-mail
• Pode ser recuperado dinamicamente a partir de variáveis de fluxo
• Deve ser válido PDF documento
[File Content from Get File]
Nome***StringPDF Nome do documento
• Fonte PDF nome do arquivo com extensão .pdf
• Utilizado para processamento de identificação
• Deve incluir a extensão de arquivo correta
• Suporta nomenclatura dinâmica a partir de fluxos
Document.pdf
Extrair imagens***BooleanControle de Extração de Imagens
Verdadeiro - Extrair todas as imagens incorporadas
Falso - Ignorar extração de imagem
• Defina como falso se as imagens não forem necessárias.
• Reduz o processamento quando apenas o texto é necessário
true
Extrair texto***BooleanControle de Extração de Texto
Verdadeiro - Extrair todo o conteúdo de texto
Falso - Ignorar extração de texto
• Defina como falso se o texto não for necessário
• Reduz o processamento quando apenas as imagens são necessárias.
true

Saída

O PDF4me Extrair texto e imagens A ação retorna dados de saída abrangentes para uma integração perfeita. Power Automate integração de fluxo:

Visualização em tabela

Dados de resposta em formato de tabela estruturada:

ParâmetroTipoDescrição
TextosStringConteúdo textual completo extraído de PDF
ImagensArrayLista de imagens extraídas retornada como um array de objetos.

Exemplos de fluxo de trabalho

O PDF4me Extrair texto e imagens ação em Power Automate Oferece modelos de fluxo de trabalho abrangentes, projetados para cenários de negócios do mundo real:

Separação e arquivamento automatizados de conteúdo

Transforme sua gestão de conteúdo com extração e armazenamento automatizados:

Etapas completas do fluxo de trabalho:

  1. AcionarDocumento enviado para a pasta de processamento.
  2. Obter documento: Recuperar PDF de SharePoint
  3. Extrair conteúdoExtrair texto e imagens
  4. Salvar textoArmazene o texto extraído em um arquivo de texto dentro do arquivo compactado.
  5. Aplicar a cada imagemPercorra as imagens extraídas.
  6. Salvar imagensArmazene cada imagem individualmente na pasta de imagens.
  7. Criar índiceGere metadados com referências de texto e imagem.
  8. Atualizar banco de dadosDetalhes e locais de extração de logs

Benefícios para as empresas:

  • Separa conteúdo de mais de 200 itens. PDFs mensalmente
  • Permite o gerenciamento independente de texto e imagem.
  • Reduz a redundância de armazenamento em 60%
  • Facilita a reutilização e o reaproveitamento de conteúdo.

Casos de uso e aplicações industriais

Casos de uso em publicação e mídia

  • Extração de ConteúdoExtrair texto e imagens para reutilização de conteúdo.
  • Gestão de Ativos Digitais: Separar e catalogar ativos de documentos
  • Migração de ConteúdoExtrair conteúdo para migração de plataforma
  • Gestão de ArquivosOrganize o conteúdo separadamente para facilitar o acesso.

Obtenha ajuda