Extração de texto de imagem usando n8n Ação
PDF4me Texto extraído da imagem Extrai conteúdo de texto de imagens usando OCR tecnologia através de n8n Fluxos de trabalho de automação. Processar imagens via n8n gatilhos, dados binários, strings base64 ou públicos URLO sistema reconhece e extrai texto automaticamente, com suporte a vários idiomas, reconhecimento de caracteres de alta precisão, preservação do layout e saída de texto estruturado para digitalização de documentos e extração de dados. Essa solução é ideal para processamento de documentos digitalizados, automação de entrada de dados e cartões de visita. OCRdigitalização de recibos, extração de texto de fotos e automatização OCR Fluxos de trabalho que exigem reconhecimento de texto preciso com suporte a vários idiomas e integração perfeita.
Configurar
Adicione o PDF4me nó "Extrair Texto da Imagem" para o seu n8n fluxo de trabalho e configure os parâmetros necessários. Para obter instruções de configuração inicial, consulte nosso n8n Guia de integração.
Pré-requisitos:
- PDF4me API credenciais
- n8n acesso ao fluxo de trabalho
Configuração:
- Adicionar PDF4me nó para fluxo de trabalho
- Selecione a ação "Extrair texto da imagem".
- Configure os parâmetros de entrada (veja abaixo)

Parâmetros
Lista completa de parâmetros para a ação Extrair Texto da Imagem. Configure esses parâmetros para controlar a extração de texto das imagens.
Importante: Os parâmetros marcados com um asterisco (***) são obrigatórios e devem ser fornecidos para que a ação funcione corretamente.
| Parâmetro | Tipo | Descrição | Exemplo | |
|---|---|---|---|---|
| Tipo de dados de entrada | String | Sim | PDF4me seleção do formato de entrada de imagem Escolha o formato dos dados da sua imagem de origem. PDF4me Suporta vários tipos de entrada com diferentes requisitos de campo. | |
| 1) Dados Binários | Sim (um obrigatório) | 1) Dados Binários - Use o "Campo Binário de Entrada" para referenciar o arquivo de imagem do nó anterior. | Binary Data | |
| 2) String Base64 | Sim (um obrigatório) | 2) Base64 Corda - Usar "Base64 Campo "Conteúdo da Imagem" para dados de imagem codificados | Base64 String | |
| 3) URL | Sim (um obrigatório) | 3) URL - Use "Image URL"campo para fornecer uma permissão pública/aberta URL para o arquivo de imagem a ser processado | URL | |
| Campo binário de entrada | Binário | Sim (se os dados forem binários) | PDF4me entrada de arquivo de imagem binária - Arquivo de imagem de referência (.jpg, .png, .gif, .bmp) do arquivo anterior. n8n Envio de nó ou arquivo. PDF4me Processa arquivos de imagem binários com detecção e validação automática de formato. Necessário quando o Tipo de Dados de Entrada for "Dados Binários". | {{ $binary.data }} |
| Conteúdo da imagem Base64 | String | Sim (se for uma string Base64) | PDF4me entrada de imagem codificada em base64 - Forneça os dados da imagem de origem (.jpg, .png, .gif, .bmp) como uma string codificada em base64 para transmissão segura. PDF4me Decodifica e processa automaticamente o conteúdo da imagem. Obrigatório quando o Tipo de Dados de Entrada for "Base64 Corda" | /9j/4AAQSkZJRgAB... |
| URL da imagem | String | Sim (se for URL) | PDF4me imagem pública URL entrada - Fornecer uma permissão pública/aberta URL para o arquivo de imagem de origem (.jpg, .png, .gif, .bmp) a ser processado para extração de texto. PDF4me Baixa e processa o arquivo a partir do local fornecido. URLObrigatório quando o tipo de dados de entrada for "URL" | https://abc.com/demo.jpg |
| Nome do arquivo de saída | String | Sim | PDF4me configuração do nome do arquivo de saída - Especifique o nome do arquivo de texto extraído gerado, com a extensão adequada (.json, .txt). Este é um parâmetro de entrada que configura o nome do arquivo de saída. PDF4me Garante nomes exclusivos e valida a conformidade do formato do arquivo. | image_text_extract.json |
| Async | Boolean | Não | PDF4me processamento assíncrono - Habilite o processamento assíncrono para imagens grandes ou quando o tempo de processamento não for crítico. Quando habilitado, a operação é executada em segundo plano e retorna imediatamente. | true |
| Nome da saída de dados binários | String | Sim | PDF4me configuração da variável de saída Defina o nome da variável para acessar os dados de extração de texto gerados em seu n8n fluxo de trabalho. Esses dados podem ser usados como dados de entrada em ações subsequentes dentro do seu fluxo de trabalho. | data |
Formatos de imagem suportados
| Formatar | Descrição | Extensões de arquivo | Tamanho máximo | Melhores casos de uso |
|---|---|---|---|---|
| JPEG | Grupo Conjunto de Especialistas em Fotografia com compressão com perdas otimizada para fotografias | .jpg, .jpeg | 50 MB | Documentos digitalizados, fotografias com texto, conteúdo da web |
| PNG | Gráficos de rede portáteis com compressão sem perdas e suporte a transparência. | .png | 50 MB | Capturas de tela, gráficos com texto, documentos de alta qualidade |
| GIF | Formato de Intercâmbio de Gráficos (GIF) com suporte a animação e paleta de cores limitada. | .gif | 50 MB | Texto animado, gráficos simples com conteúdo textual |
| BMP | Formato de imagem bitmap com dados de pixel não comprimidos | .bmp | 50 MB | Documentos digitalizados de alta qualidade, gráficos profissionais. |
Saída
Parâmetros de saída
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| sucesso | Boolean | PDF4me indicador de status da extração de texto - Boolean Sinalizador indicando o sucesso ou a falha do processo de extração de texto. PDF4me retornos true para operações bem-sucedidas e false para quaisquer erros, permitindo um tratamento robusto de erros em fluxos de trabalho automatizados. | true |
| mensagem | String | PDF4me mensagem de status da extração de texto - Mensagem de status legível por humanos, fornecendo detalhes sobre o resultado do processo de extração de texto. Inclui confirmação de sucesso ou detalhes de erro para solução de problemas. | Image text extracted successfully |
| nome_do_arquivo | String | PDF4me nome do arquivo de extração de texto gerado - O nome completo do arquivo de texto extraído com sucesso, incluindo a extensão correta. PDF4me Garante nomes exclusivos e valida a conformidade do formato do arquivo para uma integração perfeita com os processos subsequentes. | image_text_extract.json |
| tipo mime | String | PDF4me saída MIME tipo - MIME Tipo do arquivo de extração de texto gerado (por exemplo, "application/json", "text/plain"). Útil para validação do tipo de conteúdo e manipulação adequada de arquivos em aplicações web. | application/json |
| tamanho do arquivo | Número | PDF4me tamanho do arquivo de extração de texto em bytes - O tamanho exato do arquivo de extração de texto gerado, em bytes, fornecido por PDF4me para planejamento de armazenamento e monitoramento de transferência de arquivos | 0 |
N8N Resposta à ação
O PDF4me Texto extraído da imagem API Retorna uma resposta que pode ser visualizada em vários formatos. Escolha a visualização que melhor se adapta às suas necessidades:
- JSON
- Table
- Schema
- Binary
JSON Formato de resposta
O bruto JSON resposta do API:
[
{
"success": true,
"message": "Image text extracted successfully",
"fileName": "image_text_extract.json",
"mimeType": "application/json",
"fileSize": 0
}
]
Visualização em tabela
Dados de resposta em formato de tabela estruturada:
| Parâmetro | Valor |
|---|---|
| success | true |
| message | Image text extracted successfully |
| fileName | image_text_extract.json |
| mimeType | application/json |
| fileSize | 0 |
Visão do esquema
A estrutura de dados e os tipos de resposta:
1 item
success: ☑ true
message: AB Image text extracted successfully
fileName: AB image_text_extract.json
mimeType: AB application/json
fileSize: # 0
Indicadores de tipo:
AB= String#= Número☑= Boolean[]= Array
Visualização de Dados Binários
Os dados e informações reais do arquivo de extração de texto:
data
─────────────────────────────
File Name: image_text_extract.json
File Extension: json
Mime Type: application/json
File Size: 0 bytes
Status: Image text extracted successfully
Acesso a dados binários:
- n8n Objeto Binário:
$binary.data.data - Base64 ContenteDisponível para uso direto.
- Operações com arquivosPronto para download, envio por e-mail ou armazenamento.
Casos de uso
OCR Reconhecimento e digitalização de texto
- Extrair texto de documentos digitalizados, recibos e formulários para processamento digital.
- Converter anotações manuscritas e materiais impressos em formato de texto pesquisável
- Processar cartões de visita e informações de contato para entrada automatizada de dados.
Análise de conteúdo baseada em imagens
- Extrair texto de capturas de tela e imagens para análise e indexação de conteúdo.
- Processar imagens de redes sociais com sobreposições de texto para análise de sentimentos.
- Analisar embalagens e rótulos de produtos para sistemas de gestão de estoque
Serviços de Acessibilidade e Tradução
- Extrair texto de imagens para criar conteúdo acessível para usuários com deficiência visual.
- Processar documentos multilíngues para fluxos de trabalho de tradução automatizada.
- Converter texto baseado em imagens para formato de áudio para aplicações de acessibilidade
Pesquisa e Mineração de Dados
- Extrair texto de trabalhos de pesquisa, artigos e documentos acadêmicos.
- Processar documentos e arquivos históricos para projetos de pesquisa digital.
- Analisar pesquisas baseadas em imagens e formulários de feedback para coleta de dados.