Extraire du texte d'une image à l'aide de n8n action
PDF4me Texte d'extraction d'image extrait le contenu textuel des images à l'aide de OCR technologie par le biais n8n Flux de travail automatisés. Traitement des images via n8n déclencheurs, données binaires, chaînes base64 ou publiques URLCe logiciel permet la reconnaissance et l'extraction automatiques de texte avec prise en charge multilingue, une reconnaissance de caractères de haute précision, la préservation de la mise en page et la génération d'un texte structuré pour la numérisation de documents et l'extraction de données. Cette solution est idéale pour le traitement de documents numérisés, l'automatisation de la saisie de données et la numérisation de cartes de visite. OCR, numérisation de reçus, extraction de texte à partir de photos et automatisation OCR des flux de travail nécessitant une reconnaissance de texte précise avec prise en charge multilingue et une intégration transparente.
Installation
Ajoutez le PDF4me Ajoutez le nœud « Extraction de texte d'image » à votre n8n Suivez le flux de travail et configurez les paramètres requis. Pour les instructions de configuration initiale, consultez notre documentation. n8n Guide d'intégration.
Prérequis :
- PDF4me API informations d'identification
- n8n accès au flux de travail
Configuration:
- Ajouter PDF4me nœud vers flux de travail
- Sélectionnez l'action « Extraire le texte de l'image ».
- Configurer les paramètres d'entrée (voir ci-dessous)

Paramètres
Liste complète des paramètres de l'action « Extraire le texte d'une image ». Configurez ces paramètres pour contrôler l'extraction de texte à partir d'images.
Important: Les paramètres marqués d'un astérisque (***) sont obligatoires et doivent être fournis pour que l'action fonctionne correctement.
| Paramètre | Taper | Description | Exemple | |
|---|---|---|---|---|
| Type de données d'entrée | String | Oui | PDF4me sélection du format d'entrée d'image Choisissez le format de vos données d'image source. PDF4me prend en charge plusieurs types d'entrée avec des exigences de champ différentes | |
| 1) Données binaires | Oui (un seul requis) | 1) Données binaires - Utilisez le champ binaire d'entrée pour référencer le fichier image du nœud précédent. | Binary Data | |
| 2) Chaîne Base64 | Oui (un seul requis) | 2) Base64 Chaîne - Utiliser "Base64 Champ « Contenu de l'image » pour les données d'image encodées | Base64 String | |
| 3) URL | Oui (un seul requis) | 3) URL - Utiliser « Image » URLchamp permettant de fournir une autorisation publique/ouverte URL au fichier image à traiter | URL | |
| Champ binaire d'entrée | Binaire | Oui (si données binaires) | PDF4me fichier image binaire en entrée - Fichier image source de référence (.jpg, .png, .gif, .bmp) de la version précédente n8n Téléchargement de nœud ou de fichier. PDF4me Traite les fichiers image binaires avec détection et validation automatiques du format. Requis lorsque le type de données d'entrée est « Données binaires ». | {{ $binary.data }} |
| Contenu d'image Base64 | String | Oui (si la chaîne est au format Base64) | PDF4me entrée d'image encodée en base64 - Fournir les données de l'image source (.jpg, .png, .gif, .bmp) sous forme de chaîne encodée en base64 pour une transmission sécurisée. PDF4me Décode et traite automatiquement le contenu de l'image. Requis lorsque le type de données d'entrée est «Base64 Chaîne" | /9j/4AAQSkZJRgAB... |
| URL de l'image | String | Oui (si URL) | PDF4me image publique URL saisir - Fournir une autorisation publique/ouverte URL au fichier image source (.jpg, .png, .gif, .bmp) à traiter pour l'extraction de texte. PDF4me télécharge et traite le fichier fourni URL. Obligatoire lorsque le type de données d'entrée est «URL" | https://abc.com/demo.jpg |
| Nom du fichier de sortie | String | Oui | PDF4me configuration du nom de fichier de sortie - Spécifiez le nom du fichier d'extraction de texte généré, avec l'extension appropriée (.json, .txt). Il s'agit d'un paramètre d'entrée qui configure le nom du fichier de sortie. PDF4me garantit une dénomination unique et valide la conformité du format de fichier | image_text_extract.json |
| Async | Boolean | Non | PDF4me traitement asynchrone Activez le traitement asynchrone pour les images volumineuses ou lorsque le temps de traitement n'est pas critique. Une fois activé, l'opération s'exécute en arrière-plan et renvoie un résultat immédiatement. | true |
| Nom de la sortie de données binaires | String | Oui | PDF4me configuration des variables de sortie - Définissez le nom de la variable permettant d'accéder aux données d'extraction de texte générées dans votre n8n Ces données peuvent être utilisées comme données d'entrée dans les actions suivantes de votre flux de travail. | data |
Formats d'image pris en charge
| Format | Description | Extensions de fichiers | Taille maximale | Meilleurs cas d'utilisation |
|---|---|---|---|---|
| JPEG | Groupe d'experts photographiques conjoint avec compression avec perte optimisée pour les photographies | .jpg, .jpeg | 50 Mo | Documents numérisés, photographies avec texte, contenu web |
| PNG | Graphiques réseau portables avec compression sans perte et prise en charge de la transparence | .png | 50 Mo | Captures d'écran, graphiques avec texte, documents de haute qualité |
| GIF | Format d'échange graphique avec prise en charge des animations et palette de couleurs limitée | .gif | 50 Mo | Texte animé, graphismes simples avec contenu textuel |
| BMP | Format d'image bitmap avec données de pixels non compressées | .bmp | 50 Mo | Documents numérisés de haute qualité, graphismes professionnels |
Sortir
Paramètres de sortie
| Paramètre | Taper | Description | Exemple |
|---|---|---|---|
| succès | Boolean | PDF4me indicateur d'état d'extraction de texte - Boolean Un indicateur signalant la réussite ou l'échec du processus d'extraction de texte. PDF4me retours true pour des opérations réussies et false pour toute erreur, permettant une gestion robuste des erreurs dans les flux de travail automatisés | true |
| message | String | PDF4me message d'état d'extraction de texte - Message d'état lisible par l'utilisateur fournissant des détails sur le résultat du processus d'extraction de texte. Inclut une confirmation de réussite ou des détails d'erreur pour le dépannage. | Image text extracted successfully |
| nom de fichier | String | PDF4me nom du fichier d'extraction de texte généré - Le nom complet du fichier d'extraction de texte généré avec succès, avec l'extension appropriée. PDF4me garantit une dénomination unique et valide la conformité du format de fichier pour une intégration transparente avec les processus en aval | image_text_extract.json |
| type mime | String | PDF4me sortir MIME taper - MIME Type du fichier d'extraction de texte généré (par exemple, « application/json », « text/plain »). Utile pour la validation du type de contenu et la gestion correcte des fichiers dans les applications web. | application/json |
| taille du fichier | Nombre | PDF4me Taille du fichier d'extraction de texte en octets - La taille exacte en octets du fichier d'extraction de texte généré, fournie par PDF4me pour la planification du stockage et la surveillance des transferts de fichiers | 0 |
N8N Réponse à l'action
Le PDF4me Texte d'extraction d'image API renvoie une réponse pouvant être affichée dans plusieurs formats. Choisissez l'affichage qui correspond le mieux à vos besoins :
- JSON
- Table
- Schema
- Binary
JSON Format de réponse
Le cru JSON réponse de la API:
[
{
"success": true,
"message": "Image text extracted successfully",
"fileName": "image_text_extract.json",
"mimeType": "application/json",
"fileSize": 0
}
]
Vue tableau
Données de réponse présentées sous forme de tableau structuré :
| Paramètre | Valeur |
|---|---|
| success | true |
| message | Image text extracted successfully |
| fileName | image_text_extract.json |
| mimeType | application/json |
| fileSize | 0 |
Vue schématique
Structure des données et types de réponses :
1 item
success: ☑ true
message: AB Image text extracted successfully
fileName: AB image_text_extract.json
mimeType: AB application/json
fileSize: # 0
Indicateurs de type :
AB= String#= Nombre☑= Boolean[]= Array
Vue des données binaires
Données et informations du fichier d'extraction de texte proprement dit :
data
─────────────────────────────
File Name: image_text_extract.json
File Extension: json
Mime Type: application/json
File Size: 0 bytes
Status: Image text extracted successfully
Accès aux données binaires :
- n8n Objet binaire:
$binary.data.data - Base64 Contenu: Disponible pour une utilisation directe
- Opérations sur les fichiersPrêt à être téléchargé, envoyé par courriel ou stocké.
Cas d'utilisation
OCR Reconnaissance et numérisation de texte
- Extraire le texte des documents numérisés, des reçus et des formulaires en vue de leur traitement numérique
- Convertir les notes manuscrites et les documents imprimés en format texte consultable
- Traitement des cartes de visite et des informations de contact pour la saisie automatisée des données
Analyse de contenu basée sur l'image
- Extraire du texte à partir de captures d'écran et d'images pour l'analyse et l'indexation du contenu
- Traiter des images des médias sociaux avec des superpositions de texte pour l'analyse des sentiments
- Analyser l'emballage et l'étiquetage des produits pour les systèmes de gestion des stocks
Services d'accessibilité et de traduction
- Extraire le texte des images pour créer du contenu accessible aux utilisateurs malvoyants
- Traitement des documents multilingues pour les flux de travail de traduction automatisée
- Convertir du texte sous forme d'image au format audio pour les applications d'accessibilité
Recherche et exploration de données
- Extraire du texte à partir de documents de recherche, d'articles et de documents académiques
- Traiter les documents historiques et les archives pour les projets de recherche numérique
- Analyser les enquêtes et les formulaires de commentaires basés sur des images à des fins de collecte de données