Pular para o conteúdo principal

Converter PDF para Editável PDF Usando OCR usando n8n Ação

PDF4me Converter PDF para Editável PDF Usando OCR transforma digitalizado PDFe documentos baseados em imagens em formatos pesquisáveis e editáveis. PDFs através de n8n Fluxos de trabalho de automação. Processo PDFs de distância n8n gatilhos, dados binários, strings base64 ou públicos URLs para aplicar OCR Tecnologia com suporte multilíngue, seleção de nível de qualidade (Rascunho/Alta), condicional OCR Processamento, criação de camadas de texto, preservação do layout e geração de conteúdo pesquisável. Esta solução é ideal para digitalização de documentos, processamento de documentos digitalizados e faturas. OCR, conversão de arquivos, pesquisável PDF criação e automatizada OCR Fluxos de trabalho que exigem reconhecimento preciso de texto, com preservação da formatação e integração perfeita.

Artigos relacionados no blogue
Ainda não há nenhuma publicação no blogue sobre esta funcionalidade — em breve.
Entretanto, explore o blogue da PDF4me para encontrar tutoriais e fluxos de trabalho para todas as plataformas.
Visite o blogue

Configurar

Adicione o PDF4me "Converter PDF para Editável PDF Usando OCR"nó para o seu n8n fluxo de trabalho e configure os parâmetros necessários. Para obter instruções de configuração inicial, consulte nosso n8n Guia de integração.

Pré-requisitos:

  • PDF4me API credenciais
  • n8n acesso ao fluxo de trabalho

Configuração:

  1. Adicionar PDF4me nó para fluxo de trabalho
  2. Selecione "Converter". PDF para Editável PDF Usando OCR" Ação
  3. Configure os parâmetros de entrada (veja abaixo)
Converter PDF em PDF editável usando configuração de OCR

Parâmetros

Lista completa de parâmetros para a conversão. PDF para Editável PDF Usando OCR ação. Configure esses parâmetros para controlar OCR conversão.

Importante: Os parâmetros marcados com um asterisco (***) são obrigatórios e devem ser fornecidos para que a ação funcione corretamente.

ParâmetroTipoDescriçãoExemplo
Tipo de dados de entrada***StringPDF Seleção do formato de entrada
• Escolha o formato do seu PDF entrada de documento
PDF4me Suporta vários tipos de entrada para OCR conversão
• Opções: Dados binários, Base64 Corda, ou URL
Binary Data
Campo binário de entradaBinárioBinário PDF Entrada de arquivo (Obrigatório se os dados forem binários)
• Referência PDF arquivo do anterior n8n upload de nó ou arquivo
• Funciona com arquivos digitalizados PDFs, baseado em imagens PDFs e conteúdo misto
• Obrigatório quando o tipo de dados de entrada for "Dados binários"
{{ $binary.data }}
Conteúdo do PDF em Base64StringBase64 Codificado PDF Entrada (Obrigatório se) Base64 Corda)
• Fornecer PDF conteúdo como string codificada em base64
• Suporta várias PDF formatos incluindo documentos digitalizados
• Obrigatório quando o tipo de dados de entrada for "Base64 Corda"
JVBE...
URL do PDFStringPúblico PDF URL Entrada (Obrigatório se) URL)
• Fornecer uma permissão pública/aberta URL para o PDF arquivo
• Faz o download e processa o documento para OCR conversão
• Obrigatório quando o tipo de dados de entrada for "URL"
https://abc.com/scanned.pdf
Nome do documento***StringNome do arquivo de entrada
• Especifique o nome da entrada PDF arquivo
• Importante para OCR qualidade e precisão no reconhecimento de texto
• Deve incluir a extensão .pdf
scanned_document.pdf
Tipo de qualidade***StringOCR Seleção de Qualidade
• Escolha o OCR nível de qualidade do processamento
• Rascunho: adequado para normal PDFs (1 API chamada por arquivo)
• Alta: adequada para imagens/documentos digitalizados (2 API chamadas por página)
Draft
OCR somente quando necessário***BooleanCondicional OCR Processamento
• Verdadeiro: aplicar OCR somente quando PDF é baseado em imagens ou não pesquisável
• Falso: aplicar OCR para todo o conteúdo, independentemente das camadas de texto existentes.
• Otimiza o processamento e API consumo
True
Linguagem***StringOCR Configuração de idioma
• Especifique o idioma principal do texto no PDF
• Otimiza OCR precisão para melhor reconhecimento de texto
• O inglês é o idioma padrão, outros idiomas disponíveis.
English
Formato de saída***BooleanControle do formato de saída
• Verdadeiro: ativar opções avançadas de formatação para campos editáveis PDF
• Garante melhor preservação do layout e da estrutura
• Recomendado para manter a formatação do documento
true
Mesclar todas as planilhas***BooleanControle de Fusão de Planilhas
• Verdadeiro: mesclar todas as folhas/páginas em um único documento contínuo
• Falso: manter a estrutura e a formatação de cada página.
• Escolha com base na estrutura de saída desejada
True
Nome do arquivo de saída***StringNome do arquivo de saída
• Especifique o nome para o arquivo editável gerado. PDF arquivo
• Deve incluir a extensão .pdf
PDF4me garante a validação exclusiva de nomes e formatos.
editable_pdf_output.pdf
Nome do campo binário de saída***StringMapeamento de dados binários
• Defina o nome da variável para acessar o arquivo editável gerado. PDF dados
• Utilizado em ações subsequentes do fluxo de trabalho
• Essencial para o fluxo de dados do fluxo de trabalho
data

Opções avançadas

Os seguintes parâmetros estão disponíveis na seção Opções Avançadas e são opcionais:

ParâmetroTipoDescriçãoExemplo
Perfis personalizadosStringPerfis de configuração personalizados
• Defina opções adicionais usando perfis personalizados
JSONformato semelhante a - contendo predefinições OCR parâmetros
• Inclui detecção de idioma, precisão no reconhecimento de texto e preservação da formatação.
• Opcional para requisitos específicos
{ "language": "auto", "accuracy": "high", "preserveFormatting": true }

Saída

Parâmetros de saída

ParâmetroTipoDescriçãoExemplo
sucessoBooleanPDF4me OCR indicador de status de conversão - Indicador booleano que sinaliza o sucesso ou a falha da operação. OCR Processo de conversão. Devoluções. true para conversões bem-sucedidas e false para quaisquer erros, permitindo um tratamento robusto de erros em fluxos de trabalho automatizados.true
mensagemStringPDF4me OCR mensagem de status de conversão - Mensagem descritiva indicando o resultado do OCR Processo de conversão. Fornece mensagens de status claras para conversões bem-sucedidas e informações detalhadas sobre erros para fins de solução de problemas.PDF converted to editable PDF using OCR successfully
nome_do_arquivoStringPDF4me nome do arquivo gerado - O nome completo do arquivo editável processado com sucesso. PDF documento com a extensão correta. PDF4me Garante nomes exclusivos e valida a conformidade do formato do arquivo para uma integração perfeita com os processos subsequentes.editable_pdf_output.pdf
tipo mimeStringPDF4me MIME identificador de tipo - O padronizado MIME tipo para o editável gerado PDF arquivo, sempre definido para application/pdf por PDF4me's OCR mecanismo de processamento. Isso garante o manuseio e reconhecimento adequados de arquivos em todos os sistemas e aplicativos.application/pdf
tamanho do arquivoNúmeroPDF4me tamanho do arquivo em bytes - O tamanho exato do arquivo editável gerado PDF Arquivo em bytes, fornecido para planejamento de armazenamento, otimização de largura de banda e monitoramento de transferência de arquivos. Essencial para gerenciamento de documentos corporativos e automação de fluxo de trabalho.121875
tipo de qualidadeStringPDF4me OCR configuração de qualidade utilizada - A configuração de qualidade que foi aplicada durante o OCR Processo de conversão. Mostra o nível de qualidade real usado para reconhecimento de texto e processamento de documentos. Os valores comuns incluem "Rascunho", "Alta" e "Arquivo".Draft
ocrQuandoNecessárioStringPDF4me OCR configuração de processamento condicional - Indica se OCR Foi aplicado condicionalmente (somente quando necessário) ou a todo o conteúdo. Mostra a configuração real usada durante o processamento para fins de verificação e depuração.true
linguagemStringPDF4me OCR configuração de idioma utilizada - A configuração de idioma que foi aplicada durante o OCR Processo de conversão. Mostra o idioma real usado para o reconhecimento de texto, a fim de otimizar a precisão e o processamento.English
mesclarTodasAsPlanilhasBooleanPDF4me configuração de mesclagem de planilhas usada - Indica se todas as folhas ou páginas foram mescladas em um único documento durante o processamento. Mostra a configuração aplicada ao tratamento da estrutura do documento.false

N8N Resposta à ação

O PDF4me Converter PDF para Editável PDF Usando OCR API Retorna uma resposta que pode ser visualizada em vários formatos. Escolha a visualização que melhor se adapta às suas necessidades:

JSON Formato de resposta

O bruto JSON resposta do API:

{
"success": true,
"message": "PDF converted to editable PDF using OCR successfully",
"fileName": "editable_pdf_output.pdf",
"mimeType": "application/pdf",
"fileSize": 121875,
"qualityType": "Draft",
"ocrWhenNeeded": "true",
"language": "English",
"mergeAllSheets": false
}

Casos de uso

Digitalização e arquivamento de documentos

  • Converta documentos em papel e arquivos digitalizados em formatos digitais pesquisáveis e editáveis.
  • Digitalizar arquivos históricos e documentos antigos para acesso e preservação modernos.
  • Transforme formulários e documentos físicos em versões digitais editáveis.

Gestão de Conteúdo e Facilidade de Busca

  • Tornar os documentos digitalizados pesquisáveis para sistemas de gerenciamento de conteúdo
  • Habilitar a funcionalidade de busca de texto completo em documentos que anteriormente não permitiam busca.
  • Converter imagens PDFs em conteúdo acessível e editável para uma melhor experiência do usuário

Automação e processamento de fluxos de trabalho

  • Automatize a conversão de documentos digitalizados em fluxos de trabalho de processamento de documentos.
  • Processar documentos em papel recebidos para extração e análise automatizada de dados.
  • Habilitar o processamento subsequente de conteúdo de documento anteriormente estático.

Obtenha ajuda