Pular para o conteúdo principal

PDF OCR

Execute o reconhecimento óptico de caracteres em um arquivo digitalizado. PDF ou uma imagem, de forma que o texto dentro dela se torne texto real e selecionável. A ação lê os caracteres nas imagens da página e adiciona uma camada de texto por trás deles, o que permite pesquisar o documento, copiar texto e permitir que ferramentas de indexação leiam seu conteúdo. A entrada é uma única imagem digitalizada. PDF ou arquivo de imagem. A saída é um único arquivo. PDF Tem a mesma aparência, mas agora permite buscas por texto.

Recorra a ele quando precisar pesquisar por palavra-chave em uma pasta de contratos ou faturas digitalizadas, quando quiser copiar dados de um recibo ou formulário fotografado, ou quando precisar ler registros em papel arquivados por meio de uma busca de texto completo ou sistema de gerenciamento de documentos.


Configuração​

Configure o PDF OCR Etapa no construtor de fluxo de trabalho:

Configuração de OCR de PDF em fluxos de trabalho do PDF4me


Visão geral da ação​

EntradaUm único item digitalizado PDF documento ou arquivo de imagem
SaídaUm único pesquisável PDF com uma camada de texto selecionável

Propriedades​

Qualidade​

  • Tipo: Selecione
  • Padrão: Rascunho

Define a qualidade de reconhecimento para o OCR A opção "Rascunho" é a padrão e a mais rápida. O menu suspenso oferece configurações de maior qualidade que melhoram a precisão em digitalizações fracas, distorcidas ou de baixa resolução, ao custo de um tempo de processamento maior. Deixe em "Rascunho" para páginas nítidas e de alta resolução e aumente a qualidade quando as digitalizações originais forem difíceis de ler.

Fazer OCR Quando necessário​

  • Tipo: Booleano
  • Padrão: Desligado

Controla se a ação verifica cada documento antes de executar o reconhecimento. Quando ativada, ignora arquivos que já contêm uma camada de texto e executa o reconhecimento. OCR somente em documentos que precisam, o que evita processamento desnecessário em arquivos que já podem ser pesquisados. Quando desativado, ele é executado. OCR em todos os documentos que passam por esta etapa. Ative-a quando a entrada misturar arquivos digitalizados com PDFs que já podem ser pesquisadas.


Como executar PDF OCR usando fluxos de trabalho​

Quando você tem centenas de documentos digitalizados para processar, a automação é a única abordagem prática. PDF4me Os fluxos de trabalho podem ser executados. OCR em cada arquivo assim que ele chega. Aqui está um exemplo de fluxo de trabalho que reconhece texto em arquivos digitalizados. PDFs e imagens e produz um recurso pesquisável PDF.

Criar um fluxo de trabalho​

Abra o Painel de Fluxos de Trabalho e selecione Criar fluxo de trabalho Para começar a construir sua automação.

Criar um novo fluxo de trabalho

Adicionar um gatilho​

Adicione e configure um gatilho para iniciar o fluxo de trabalho. Assim que um novo arquivo chegar à pasta configurada, a automação será executada. Este exemplo usa um Google Drive acionar. PDF4me Os fluxos de trabalho também oferecem suporte Dropbox Existem gatilhos, então escolha o que melhor se adapta ao seu fluxo de trabalho.

Gatilho do Google Drive para o fluxo de trabalho de OCR de PDF

Adicione o PDF OCR Ação​

Adicione e configure o PDF OCR ação. Habilitar Fazer OCR quando necessário para que OCR Executa apenas em documentos que o exigem, evitando chamadas de processamento desnecessárias.

Ação de OCR de PDF para o fluxo de trabalho

Adicionar uma ação Salvar no Armazenamento​

Após o processamento dos arquivos, salve-os em seu armazenamento. Para este caso de uso, adicione e configure um Salvar em Google Drive A ação consiste em definir a pasta onde você deseja salvar os arquivos processados.

Ação "Salvar no Google Drive" para salvar arquivos de saída.

Publicar o fluxo de trabalho​

Quando a configuração estiver concluída, selecione Salvar Para publicar o fluxo de trabalho. O fluxo de trabalho finalizado se parece com o exemplo abaixo.

Fluxo de trabalho de automação de amostra OCR de PDF


Experimente em PDF4me Fluxos de trabalho​

Abra o painel de controle Fluxos de Trabalho, crie um fluxo de trabalho e adicione o PDF OCR Passo a passo para executar isso em seus próprios documentos.