Converter PDF para Editável PDF Usando OCR usando n8n Ação
PDF4me Converter PDF para Editável PDF Usando OCR transforma digitalizado PDFe documentos baseados em imagens em formatos pesquisáveis e editáveis. PDFs através de n8n Fluxos de trabalho de automação. Processo PDFs de distância n8n gatilhos, dados binários, strings base64 ou públicos URLs para aplicar OCR Tecnologia com suporte multilíngue, seleção de nível de qualidade (Rascunho/Alta), condicional OCR Processamento, criação de camadas de texto, preservação do layout e geração de conteúdo pesquisável. Esta solução é ideal para digitalização de documentos, processamento de documentos digitalizados e faturas. OCR, conversão de arquivos, pesquisável PDF criação e automatizada OCR Fluxos de trabalho que exigem reconhecimento preciso de texto, com preservação da formatação e integração perfeita.
Configurar
Adicione o PDF4me "Converter PDF para Editável PDF Usando OCR"nó para o seu n8n fluxo de trabalho e configure os parâmetros necessários. Para obter instruções de configuração inicial, consulte nosso n8n Guia de integração.
Pré-requisitos:
- PDF4me API credenciais
- n8n acesso ao fluxo de trabalho
Configuração:
- Adicionar PDF4me nó para fluxo de trabalho
- Selecione "Converter". PDF para Editável PDF Usando OCR" Ação
- Configure os parâmetros de entrada (veja abaixo)

Parâmetros
Lista completa de parâmetros para a conversão. PDF para Editável PDF Usando OCR ação. Configure esses parâmetros para controlar OCR conversão.
Importante: Os parâmetros marcados com um asterisco (***) são obrigatórios e devem ser fornecidos para que a ação funcione corretamente.
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| Tipo de dados de entrada*** | String | PDF Seleção do formato de entrada • Escolha o formato do seu PDF entrada de documento • PDF4me Suporta vários tipos de entrada para OCR conversão • Opções: Dados binários, Base64 Corda, ou URL | Binary Data |
| Campo binário de entrada | Binário | Binário PDF Entrada de arquivo (Obrigatório se os dados forem binários) • Referência PDF arquivo do anterior n8n upload de nó ou arquivo • Funciona com arquivos digitalizados PDFs, baseado em imagens PDFs e conteúdo misto • Obrigatório quando o tipo de dados de entrada for "Dados binários" | {{ $binary.data }} |
| Conteúdo do PDF em Base64 | String | Base64 Codificado PDF Entrada (Obrigatório se) Base64 Corda) • Fornecer PDF conteúdo como string codificada em base64 • Suporta várias PDF formatos incluindo documentos digitalizados • Obrigatório quando o tipo de dados de entrada for "Base64 Corda" | JVBE... |
| URL do PDF | String | Público PDF URL Entrada (Obrigatório se) URL) • Fornecer uma permissão pública/aberta URL para o PDF arquivo • Faz o download e processa o documento para OCR conversão • Obrigatório quando o tipo de dados de entrada for "URL" | https://abc.com/scanned.pdf |
| Nome do documento*** | String | Nome do arquivo de entrada • Especifique o nome da entrada PDF arquivo • Importante para OCR qualidade e precisão no reconhecimento de texto • Deve incluir a extensão .pdf | scanned_document.pdf |
| Tipo de qualidade*** | String | OCR Seleção de Qualidade • Escolha o OCR nível de qualidade do processamento • Rascunho: adequado para normal PDFs (1 API chamada por arquivo) • Alta: adequada para imagens/documentos digitalizados (2 API chamadas por página) | Draft |
| OCR somente quando necessário*** | Boolean | Condicional OCR Processamento • Verdadeiro: aplicar OCR somente quando PDF é baseado em imagens ou não pesquisável • Falso: aplicar OCR para todo o conteúdo, independentemente das camadas de texto existentes. • Otimiza o processamento e API consumo | True |
| Linguagem*** | String | OCR Configuração de idioma • Especifique o idioma principal do texto no PDF • Otimiza OCR precisão para melhor reconhecimento de texto • O inglês é o idioma padrão, outros idiomas disponíveis. | English |
| Formato de saída*** | Boolean | Controle do formato de saída • Verdadeiro: ativar opções avançadas de formatação para campos editáveis PDF • Garante melhor preservação do layout e da estrutura • Recomendado para manter a formatação do documento | true |
| Mesclar todas as planilhas*** | Boolean | Controle de Fusão de Planilhas • Verdadeiro: mesclar todas as folhas/páginas em um único documento contínuo • Falso: manter a estrutura e a formatação de cada página. • Escolha com base na estrutura de saída desejada | True |
| Nome do arquivo de saída*** | String | Nome do arquivo de saída • Especifique o nome para o arquivo editável gerado. PDF arquivo • Deve incluir a extensão .pdf • PDF4me garante a validação exclusiva de nomes e formatos. | editable_pdf_output.pdf |
| Nome do campo binário de saída*** | String | Mapeamento de dados binários • Defina o nome da variável para acessar o arquivo editável gerado. PDF dados • Utilizado em ações subsequentes do fluxo de trabalho • Essencial para o fluxo de dados do fluxo de trabalho | data |
Opções avançadas
Os seguintes parâmetros estão disponíveis na seção Opções Avançadas e são opcionais:
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| Perfis personalizados | String | Perfis de configuração personalizados • Defina opções adicionais usando perfis personalizados • JSONformato semelhante a - contendo predefinições OCR parâmetros • Inclui detecção de idioma, precisão no reconhecimento de texto e preservação da formatação. • Opcional para requisitos específicos | { "language": "auto", "accuracy": "high", "preserveFormatting": true } |
Saída
Parâmetros de saída
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| sucesso | Boolean | PDF4me OCR indicador de status de conversão - Indicador booleano que sinaliza o sucesso ou a falha da operação. OCR Processo de conversão. Devoluções. true para conversões bem-sucedidas e false para quaisquer erros, permitindo um tratamento robusto de erros em fluxos de trabalho automatizados. | true |
| mensagem | String | PDF4me OCR mensagem de status de conversão - Mensagem descritiva indicando o resultado do OCR Processo de conversão. Fornece mensagens de status claras para conversões bem-sucedidas e informações detalhadas sobre erros para fins de solução de problemas. | PDF converted to editable PDF using OCR successfully |
| nome_do_arquivo | String | PDF4me nome do arquivo gerado - O nome completo do arquivo editável processado com sucesso. PDF documento com a extensão correta. PDF4me Garante nomes exclusivos e valida a conformidade do formato do arquivo para uma integração perfeita com os processos subsequentes. | editable_pdf_output.pdf |
| tipo mime | String | PDF4me MIME identificador de tipo - O padronizado MIME tipo para o editável gerado PDF arquivo, sempre definido para application/pdf por PDF4me's OCR mecanismo de processamento. Isso garante o manuseio e reconhecimento adequados de arquivos em todos os sistemas e aplicativos. | application/pdf |
| tamanho do arquivo | Número | PDF4me tamanho do arquivo em bytes - O tamanho exato do arquivo editável gerado PDF Arquivo em bytes, fornecido para planejamento de armazenamento, otimização de largura de banda e monitoramento de transferência de arquivos. Essencial para gerenciamento de documentos corporativos e automação de fluxo de trabalho. | 121875 |
| tipo de qualidade | String | PDF4me OCR configuração de qualidade utilizada - A configuração de qualidade que foi aplicada durante o OCR Processo de conversão. Mostra o nível de qualidade real usado para reconhecimento de texto e processamento de documentos. Os valores comuns incluem "Rascunho", "Alta" e "Arquivo". | Draft |
| ocrQuandoNecessário | String | PDF4me OCR configuração de processamento condicional - Indica se OCR Foi aplicado condicionalmente (somente quando necessário) ou a todo o conteúdo. Mostra a configuração real usada durante o processamento para fins de verificação e depuração. | true |
| linguagem | String | PDF4me OCR configuração de idioma utilizada - A configuração de idioma que foi aplicada durante o OCR Processo de conversão. Mostra o idioma real usado para o reconhecimento de texto, a fim de otimizar a precisão e o processamento. | English |
| mesclarTodasAsPlanilhas | Boolean | PDF4me configuração de mesclagem de planilhas usada - Indica se todas as folhas ou páginas foram mescladas em um único documento durante o processamento. Mostra a configuração aplicada ao tratamento da estrutura do documento. | false |
N8N Resposta à ação
O PDF4me Converter PDF para Editável PDF Usando OCR API Retorna uma resposta que pode ser visualizada em vários formatos. Escolha a visualização que melhor se adapta às suas necessidades:
- JSON
- Table
- Schema
- Binary
JSON Formato de resposta
O bruto JSON resposta do API:
{
"success": true,
"message": "PDF converted to editable PDF using OCR successfully",
"fileName": "editable_pdf_output.pdf",
"mimeType": "application/pdf",
"fileSize": 121875,
"qualityType": "Draft",
"ocrWhenNeeded": "true",
"language": "English",
"mergeAllSheets": false
}
Visualização em tabela
Dados de resposta em formato de tabela estruturada:
| Parâmetro | Valor |
|---|---|
| success | true |
| message | PDF convertido para editável PDF usando OCR com sucesso |
| fileName | editable_pdf_output.pdf |
| mimeType | application/pdf |
| fileSize | 121875 |
| qualityType | Draft |
| ocrWhenNeeded | true |
| language | English |
| mergeAllSheets | false |
Visão do esquema
A estrutura de dados e os tipos de resposta:
success: ✓ true
message: AB PDF converted to editable PDF using OCR successfully
fileName: AB editable_pdf_output.pdf
mimeType: AB application/pdf
fileSize: # 121875
qualityType: AB Draft
ocrWhenNeeded: AB true
language: AB English
mergeAllSheets: ✓ false
Indicadores de tipo:
AB= String#= Número✓= Boolean
Visualização de Dados Binários
O arquivo editável real PDF Dados e metadados do arquivo:
data
─────────────────────────────────────────
File Name: editable_pdf_output.pdf
File Extension: pdf
Mime Type: application/pdf
File Size: 119.0 KB
Casos de uso
Digitalização e arquivamento de documentos
- Converta documentos em papel e arquivos digitalizados em formatos digitais pesquisáveis e editáveis.
- Digitalizar arquivos históricos e documentos antigos para acesso e preservação modernos.
- Transforme formulários e documentos físicos em versões digitais editáveis.
Gestão de Conteúdo e Facilidade de Busca
- Tornar os documentos digitalizados pesquisáveis para sistemas de gerenciamento de conteúdo
- Habilitar a funcionalidade de busca de texto completo em documentos que anteriormente não permitiam busca.
- Converter imagens PDFs em conteúdo acessível e editável para uma melhor experiência do usuário
Automação e processamento de fluxos de trabalho
- Automatize a conversão de documentos digitalizados em fluxos de trabalho de processamento de documentos.
- Processar documentos em papel recebidos para extração e análise automatizada de dados.
- Habilitar o processamento subsequente de conteúdo de documento anteriormente estático.