Pular para o conteúdo principal

Extração de texto de imagem usando n8n Ação

PDF4me Texto extraído da imagem Extrai conteúdo de texto de imagens usando OCR tecnologia através de n8n Fluxos de trabalho de automação. Processar imagens via n8n gatilhos, dados binários, strings base64 ou públicos URLO sistema reconhece e extrai texto automaticamente, com suporte a vários idiomas, reconhecimento de caracteres de alta precisão, preservação do layout e saída de texto estruturado para digitalização de documentos e extração de dados. Essa solução é ideal para processamento de documentos digitalizados, automação de entrada de dados e cartões de visita. OCRdigitalização de recibos, extração de texto de fotos e automatização OCR Fluxos de trabalho que exigem reconhecimento de texto preciso com suporte a vários idiomas e integração perfeita.

Artigos relacionados no blogue
Ainda não há nenhuma publicação no blogue sobre esta funcionalidade — em breve.
Entretanto, explore o blogue da PDF4me para encontrar tutoriais e fluxos de trabalho para todas as plataformas.
Visite o blogue

Configurar

Adicione o PDF4me nó "Extrair Texto da Imagem" para o seu n8n fluxo de trabalho e configure os parâmetros necessários. Para obter instruções de configuração inicial, consulte nosso n8n Guia de integração.

Pré-requisitos:

  • PDF4me API credenciais
  • n8n acesso ao fluxo de trabalho

Configuração:

  1. Adicionar PDF4me nó para fluxo de trabalho
  2. Selecione a ação "Extrair texto da imagem".
  3. Configure os parâmetros de entrada (veja abaixo)
Texto extraído da imagem

Parâmetros

Lista completa de parâmetros para a ação Extrair Texto da Imagem. Configure esses parâmetros para controlar a extração de texto das imagens.

Importante: Os parâmetros marcados com um asterisco (***) são obrigatórios e devem ser fornecidos para que a ação funcione corretamente.

ParâmetroTipoDescriçãoExemplo
Tipo de dados de entradaStringSimPDF4me seleção do formato de entrada de imagem
Escolha o formato dos dados da sua imagem de origem.
PDF4me Suporta vários tipos de entrada com diferentes requisitos de campo.
1) Dados BináriosSim (um obrigatório)1) Dados Binários - Use o "Campo Binário de Entrada" para referenciar o arquivo de imagem do nó anterior.Binary Data
2) String Base64Sim (um obrigatório)2) Base64 Corda - Usar "Base64 Campo "Conteúdo da Imagem" para dados de imagem codificadosBase64 String
3) URLSim (um obrigatório)3) URL - Use "Image URL"campo para fornecer uma permissão pública/aberta URL para o arquivo de imagem a ser processadoURL
Campo binário de entradaBinárioSim (se os dados forem binários)PDF4me entrada de arquivo de imagem binária - Arquivo de imagem de referência (.jpg, .png, .gif, .bmp) do arquivo anterior. n8n Envio de nó ou arquivo. PDF4me Processa arquivos de imagem binários com detecção e validação automática de formato. Necessário quando o Tipo de Dados de Entrada for "Dados Binários".{{ $binary.data }}
Conteúdo da imagem Base64StringSim (se for uma string Base64)PDF4me entrada de imagem codificada em base64 - Forneça os dados da imagem de origem (.jpg, .png, .gif, .bmp) como uma string codificada em base64 para transmissão segura. PDF4me Decodifica e processa automaticamente o conteúdo da imagem. Obrigatório quando o Tipo de Dados de Entrada for "Base64 Corda"/9j/4AAQSkZJRgAB...
URL da imagemStringSim (se for URL)PDF4me imagem pública URL entrada - Fornecer uma permissão pública/aberta URL para o arquivo de imagem de origem (.jpg, .png, .gif, .bmp) a ser processado para extração de texto. PDF4me Baixa e processa o arquivo a partir do local fornecido. URLObrigatório quando o tipo de dados de entrada for "URL"https://abc.com/demo.jpg
Nome do arquivo de saídaStringSimPDF4me configuração do nome do arquivo de saída - Especifique o nome do arquivo de texto extraído gerado, com a extensão adequada (.json, .txt). Este é um parâmetro de entrada que configura o nome do arquivo de saída. PDF4me Garante nomes exclusivos e valida a conformidade do formato do arquivo.image_text_extract.json
AsyncBooleanNãoPDF4me processamento assíncrono - Habilite o processamento assíncrono para imagens grandes ou quando o tempo de processamento não for crítico. Quando habilitado, a operação é executada em segundo plano e retorna imediatamente.true
Nome da saída de dados bináriosStringSimPDF4me configuração da variável de saída Defina o nome da variável para acessar os dados de extração de texto gerados em seu n8n fluxo de trabalho. Esses dados podem ser usados como dados de entrada em ações subsequentes dentro do seu fluxo de trabalho.data

Formatos de imagem suportados

FormatarDescriçãoExtensões de arquivoTamanho máximoMelhores casos de uso
JPEGGrupo Conjunto de Especialistas em Fotografia com compressão com perdas otimizada para fotografias.jpg, .jpeg50 MBDocumentos digitalizados, fotografias com texto, conteúdo da web
PNGGráficos de rede portáteis com compressão sem perdas e suporte a transparência..png50 MBCapturas de tela, gráficos com texto, documentos de alta qualidade
GIFFormato de Intercâmbio de Gráficos (GIF) com suporte a animação e paleta de cores limitada..gif50 MBTexto animado, gráficos simples com conteúdo textual
BMPFormato de imagem bitmap com dados de pixel não comprimidos.bmp50 MBDocumentos digitalizados de alta qualidade, gráficos profissionais.

Saída

Parâmetros de saída

ParâmetroTipoDescriçãoExemplo
sucessoBooleanPDF4me indicador de status da extração de texto - Boolean Sinalizador indicando o sucesso ou a falha do processo de extração de texto. PDF4me retornos true para operações bem-sucedidas e false para quaisquer erros, permitindo um tratamento robusto de erros em fluxos de trabalho automatizados.true
mensagemStringPDF4me mensagem de status da extração de texto - Mensagem de status legível por humanos, fornecendo detalhes sobre o resultado do processo de extração de texto. Inclui confirmação de sucesso ou detalhes de erro para solução de problemas.Image text extracted successfully
nome_do_arquivoStringPDF4me nome do arquivo de extração de texto gerado - O nome completo do arquivo de texto extraído com sucesso, incluindo a extensão correta. PDF4me Garante nomes exclusivos e valida a conformidade do formato do arquivo para uma integração perfeita com os processos subsequentes.image_text_extract.json
tipo mimeStringPDF4me saída MIME tipo - MIME Tipo do arquivo de extração de texto gerado (por exemplo, "application/json", "text/plain"). Útil para validação do tipo de conteúdo e manipulação adequada de arquivos em aplicações web.application/json
tamanho do arquivoNúmeroPDF4me tamanho do arquivo de extração de texto em bytes - O tamanho exato do arquivo de extração de texto gerado, em bytes, fornecido por PDF4me para planejamento de armazenamento e monitoramento de transferência de arquivos0

N8N Resposta à ação

O PDF4me Texto extraído da imagem API Retorna uma resposta que pode ser visualizada em vários formatos. Escolha a visualização que melhor se adapta às suas necessidades:

JSON Formato de resposta

O bruto JSON resposta do API:

[
{
"success": true,
"message": "Image text extracted successfully",
"fileName": "image_text_extract.json",
"mimeType": "application/json",
"fileSize": 0
}
]

Casos de uso

OCR Reconhecimento e digitalização de texto

  • Extrair texto de documentos digitalizados, recibos e formulários para processamento digital.
  • Converter anotações manuscritas e materiais impressos em formato de texto pesquisável
  • Processar cartões de visita e informações de contato para entrada automatizada de dados.

Análise de conteúdo baseada em imagens

  • Extrair texto de capturas de tela e imagens para análise e indexação de conteúdo.
  • Processar imagens de redes sociais com sobreposições de texto para análise de sentimentos.
  • Analisar embalagens e rótulos de produtos para sistemas de gestão de estoque

Serviços de Acessibilidade e Tradução

  • Extrair texto de imagens para criar conteúdo acessível para usuários com deficiência visual.
  • Processar documentos multilíngues para fluxos de trabalho de tradução automatizada.
  • Converter texto baseado em imagens para formato de áudio para aplicações de acessibilidade

Pesquisa e Mineração de Dados

  • Extrair texto de trabalhos de pesquisa, artigos e documentos acadêmicos.
  • Processar documentos e arquivos históricos para projetos de pesquisa digital.
  • Analisar pesquisas baseadas em imagens e formulários de feedback para coleta de dados.

Obtenha ajuda