Passa al contenuto principale

Estrazione di testo dall'immagine n8n azione

PDF4me Testo estratto immagine estrae il contenuto testuale dalle immagini utilizzando OCR tecnologia attraverso n8n flussi di lavoro di automazione. Elabora le immagini tramite n8n trigger, dati binari, stringhe base64 o pubblico URLper riconoscere ed estrarre automaticamente il testo con supporto multilingue, riconoscimento dei caratteri ad alta precisione, conservazione del layout e output di testo strutturato per la digitalizzazione dei documenti e l'estrazione dei dati. Questa soluzione è ideale per l'elaborazione di documenti scansionati, l'automazione dell'immissione dati, i biglietti da visita OCR, scansione delle ricevute, estrazione del testo dalle foto e automatizzato OCR Flussi di lavoro che richiedono un riconoscimento del testo accurato con supporto multilingue e integrazione perfetta.

Articoli correlati del blog
Non ci sono ancora post sul blog dedicati a questa funzionalità — in arrivo a breve.
Nel frattempo, dai un'occhiata al blog di PDF4me per trovare tutorial e procedure operative su tutte le piattaforme.
Visita il blog

Impostare

Aggiungi il PDF4me nodo "Image Extract Text" al tuo n8n flusso di lavoro e configurare i parametri richiesti. Per le istruzioni di configurazione iniziale, consultare il nostro n8n Guida all'integrazione.

Prerequisiti:

  • PDF4me API credenziali
  • n8n accesso al flusso di lavoro

Configurazione:

  1. Aggiungere PDF4me nodo al flusso di lavoro
  2. Seleziona l'azione "Estrazione testo immagine"
  3. Configura i parametri di input (vedi sotto)
Testo estratto immagine

Parametri

Elenco completo dei parametri per l'azione "Estrazione testo dalle immagini". Configura questi parametri per controllare l'estrazione del testo dalle immagini.

Importante: I parametri contrassegnati da un asterisco (***) sono obbligatori e devono essere forniti affinché l'azione funzioni correttamente.

ParametroTipoDescrizioneEsempio
Tipo di dati di inputStringPDF4me selezione del formato di input dell'immagine
Scegli il formato dei dati dell'immagine sorgente da inserire.
PDF4me supporta più tipi di input con requisiti di campo differenti
1) Dati binariSì (ne occorre uno)1) Dati binari - Utilizzare "Campo binario di input" per fare riferimento al file immagine del nodo precedenteBinary Data
2) Stringa Base64Sì (ne occorre uno)2) Base64 Corda - Utilizzo "Base64 Campo "Contenuto immagine" per i dati dell'immagine codificataBase64 String
3) URLSì (ne occorre uno)3) URL - Utilizzare "Immagine URL"campo per fornire un'autorizzazione pubblica/aperta URL al file immagine da elaborareURL
Campo binario di inputBinarioSì (se si tratta di dati binari)PDF4me input di file immagine binario - Fare riferimento al file immagine sorgente (.jpg, .png, .gif, .bmp) dal precedente n8n Caricamento di nodi o file. PDF4me Elabora file immagine binari con rilevamento e convalida automatici del formato. Obbligatorio quando il tipo di dati di input è "Dati binari".{{ $binary.data }}
Contenuto dell'immagine in Base64StringSì (se stringa Base64)PDF4me input immagine codificato in base64 - Fornire i dati dell'immagine sorgente (.jpg, .png, .gif, .bmp) come stringa codificata in base64 per una trasmissione sicura. PDF4me decodifica ed elabora automaticamente il contenuto dell'immagine. Obbligatorio quando il tipo di dati di input è "Base64 Corda"/9j/4AAQSkZJRgAB...
URL dell'immagineStringSì (se URL)PDF4me immagine pubblica URL input - Fornire un'autorizzazione pubblica/aperta URL al file immagine sorgente (.jpg, .png, .gif, .bmp) da elaborare per l'estrazione del testo. PDF4me scarica ed elabora il file fornito URL. Obbligatorio quando il tipo di dati di input è "URL"https://abc.com/demo.jpg
Nome del file di outputStringPDF4me configurazione del nome del file di output - Specificare il nome per il file di testo estratto generato con l'estensione corretta (.json, .txt). Questo è un parametro di input che configura il nome del file di output. PDF4me Garantisce una denominazione univoca e convalida la conformità del formato dei file.image_text_extract.json
AsyncBooleanNOPDF4me elaborazione asincrona - Abilita l'elaborazione asincrona per immagini di grandi dimensioni o quando il tempo di elaborazione non è critico. Quando abilitata, l'operazione viene eseguita in background e restituisce immediatamentetrue
Nome dell'output dei dati binariStringPDF4me configurazione della variabile di output - Definisci il nome della variabile per accedere ai dati di estrazione del testo generati nel tuo n8n flusso di lavoro. Questi dati possono essere utilizzati come dati di input nelle azioni successive all'interno del flusso di lavoro.data

Formati immagine supportati

FormatoDescrizioneEstensioni dei fileDimensione massimaCasi d'uso ottimali
JPEGGruppo congiunto di esperti fotografici con compressione con perdita ottimizzata per le fotografie.jpg, .jpeg50 MBDocumenti scansionati, fotografie con testo, contenuti web
PNGGrafica di rete portatile con compressione senza perdita di dati e supporto per la trasparenza.png50 MBScreenshot, grafica con testo, documenti di alta qualità
GIFFormato di interscambio grafico con supporto per le animazioni e tavolozza di colori limitata.gif50 MBTesto animato, grafica semplice con contenuto testuale
BMPFormato immagine bitmap con dati pixel non compressi.bmp50 MBDocumenti scansionati di alta qualità, grafica professionale

Produzione

Parametri di output

ParametroTipoDescrizioneEsempio
successoBooleanPDF4me indicatore dello stato di estrazione del testo - Boolean Indicatore che segnala il successo o il fallimento del processo di estrazione del testo. PDF4me resi true per operazioni di successo e false per eventuali errori, consentendo una gestione degli errori efficace nei flussi di lavoro automatizzatitrue
messaggioStringPDF4me messaggio sullo stato dell'estrazione del testo - Messaggio di stato leggibile dall'uomo che fornisce dettagli sul risultato del processo di estrazione del testo. Include la conferma di successo o i dettagli di errore per la risoluzione dei problemi.Image text extracted successfully
Nome fileStringPDF4me nome del file di estrazione del testo generato - Il nome completo del file di testo estratto, generato correttamente e con l'estensione appropriata. PDF4me Garantisce una denominazione univoca e convalida la conformità del formato dei file per una perfetta integrazione con i processi a valle.image_text_extract.json
tipo mimeStringPDF4me produzione MIME tipo - MIME Tipo di file di testo estratto generato (ad esempio, "application/json", "text/plain"). Utile per la convalida del tipo di contenuto e la corretta gestione dei file nelle applicazioni web.application/json
Dimensione fileNumeroPDF4me dimensione del file di estrazione del testo in byte - La dimensione esatta del file di estrazione del testo generato in byte, fornita da PDF4me per la pianificazione dello storage e il monitoraggio del trasferimento dei file0

N8N Risposta all'azione

IL PDF4me Testo estratto immagine API Restituisce una risposta che può essere visualizzata in diversi formati. Scegli la visualizzazione più adatta alle tue esigenze:

JSON Formato di risposta

Il grezzo JSON risposta da API:

[
{
"success": true,
"message": "Image text extracted successfully",
"fileName": "image_text_extract.json",
"mimeType": "application/json",
"fileSize": 0
}
]

Casi d'uso

OCR Riconoscimento e digitalizzazione del testo

  • Estrarre testo da documenti, ricevute e moduli scansionati per l'elaborazione digitale.
  • Converti appunti scritti a mano e materiali stampati in un formato di testo ricercabile.
  • Elaborare i biglietti da visita e le informazioni di contatto per l'inserimento automatico dei dati.

Analisi del contenuto basata sulle immagini

  • Estrarre testo da screenshot e immagini per l'analisi e l'indicizzazione dei contenuti.
  • Elaborare le immagini dei social media con sovrapposizioni di testo per l'analisi del sentiment.
  • Analizzare gli imballaggi e le etichette dei prodotti per i sistemi di gestione dell'inventario.

Servizi di accessibilità e traduzione

  • Estrarre testo dalle immagini per creare contenuti accessibili agli utenti ipovedenti.
  • Elaborare documenti multilingue per flussi di lavoro di traduzione automatizzata
  • Convertire testo basato su immagini in formato audio per applicazioni di accessibilità.

Ricerca e analisi dei dati

  • Estrarre testo da documenti di ricerca, articoli e documenti accademici.
  • Elaborare documenti storici e archivi per progetti di ricerca digitale.
  • Analizzare sondaggi basati su immagini e moduli di feedback per la raccolta dei dati

Richiedi assistenza