Aller au contenu principal

Extraire du texte d'une image à l'aide de n8n action

PDF4me Texte d'extraction d'image extrait le contenu textuel des images à l'aide de OCR technologie par le biais n8n Flux de travail automatisés. Traitement des images via n8n déclencheurs, données binaires, chaînes base64 ou publiques URLCe logiciel permet la reconnaissance et l'extraction automatiques de texte avec prise en charge multilingue, une reconnaissance de caractères de haute précision, la préservation de la mise en page et la génération d'un texte structuré pour la numérisation de documents et l'extraction de données. Cette solution est idéale pour le traitement de documents numérisés, l'automatisation de la saisie de données et la numérisation de cartes de visite. OCR, numérisation de reçus, extraction de texte à partir de photos et automatisation OCR des flux de travail nécessitant une reconnaissance de texte précise avec prise en charge multilingue et une intégration transparente.

Articles de blog connexes
Il n'y a pas encore d'article de blog consacré à cette fonctionnalité — à venir prochainement.
En attendant, n'hésitez pas à consulter le blog de PDF4me pour découvrir des tutoriels et des procédures de travail adaptés à toutes les plateformes.
Consultez le blog

Installation

Ajoutez le PDF4me Ajoutez le nœud « Extraction de texte d'image » à votre n8n Suivez le flux de travail et configurez les paramètres requis. Pour les instructions de configuration initiale, consultez notre documentation. n8n Guide d'intégration.

Prérequis :

  • PDF4me API informations d'identification
  • n8n accès au flux de travail

Configuration:

  1. Ajouter PDF4me nœud vers flux de travail
  2. Sélectionnez l'action « Extraire le texte de l'image ».
  3. Configurer les paramètres d'entrée (voir ci-dessous)
Texte d'extraction d'image

Paramètres

Liste complète des paramètres de l'action « Extraire le texte d'une image ». Configurez ces paramètres pour contrôler l'extraction de texte à partir d'images.

Important: Les paramètres marqués d'un astérisque (***) sont obligatoires et doivent être fournis pour que l'action fonctionne correctement.

ParamètreTaperDescriptionExemple
Type de données d'entréeStringOuiPDF4me sélection du format d'entrée d'image
Choisissez le format de vos données d'image source.
PDF4me prend en charge plusieurs types d'entrée avec des exigences de champ différentes
1) Données binairesOui (un seul requis)1) Données binaires - Utilisez le champ binaire d'entrée pour référencer le fichier image du nœud précédent.Binary Data
2) Chaîne Base64Oui (un seul requis)2) Base64 Chaîne - Utiliser "Base64 Champ « Contenu de l'image » pour les données d'image encodéesBase64 String
3) URLOui (un seul requis)3) URL - Utiliser « Image » URLchamp permettant de fournir une autorisation publique/ouverte URL au fichier image à traiterURL
Champ binaire d'entréeBinaireOui (si données binaires)PDF4me fichier image binaire en entrée - Fichier image source de référence (.jpg, .png, .gif, .bmp) de la version précédente n8n Téléchargement de nœud ou de fichier. PDF4me Traite les fichiers image binaires avec détection et validation automatiques du format. Requis lorsque le type de données d'entrée est « Données binaires ».{{ $binary.data }}
Contenu d'image Base64StringOui (si la chaîne est au format Base64)PDF4me entrée d'image encodée en base64 - Fournir les données de l'image source (.jpg, .png, .gif, .bmp) sous forme de chaîne encodée en base64 pour une transmission sécurisée. PDF4me Décode et traite automatiquement le contenu de l'image. Requis lorsque le type de données d'entrée est «Base64 Chaîne"/9j/4AAQSkZJRgAB...
URL de l'imageStringOui (si URL)PDF4me image publique URL saisir - Fournir une autorisation publique/ouverte URL au fichier image source (.jpg, .png, .gif, .bmp) à traiter pour l'extraction de texte. PDF4me télécharge et traite le fichier fourni URL. Obligatoire lorsque le type de données d'entrée est «URL"https://abc.com/demo.jpg
Nom du fichier de sortieStringOuiPDF4me configuration du nom de fichier de sortie - Spécifiez le nom du fichier d'extraction de texte généré, avec l'extension appropriée (.json, .txt). Il s'agit d'un paramètre d'entrée qui configure le nom du fichier de sortie. PDF4me garantit une dénomination unique et valide la conformité du format de fichierimage_text_extract.json
AsyncBooleanNonPDF4me traitement asynchrone Activez le traitement asynchrone pour les images volumineuses ou lorsque le temps de traitement n'est pas critique. Une fois activé, l'opération s'exécute en arrière-plan et renvoie un résultat immédiatement.true
Nom de la sortie de données binairesStringOuiPDF4me configuration des variables de sortie - Définissez le nom de la variable permettant d'accéder aux données d'extraction de texte générées dans votre n8n Ces données peuvent être utilisées comme données d'entrée dans les actions suivantes de votre flux de travail.data

Formats d'image pris en charge

FormatDescriptionExtensions de fichiersTaille maximaleMeilleurs cas d'utilisation
JPEGGroupe d'experts photographiques conjoint avec compression avec perte optimisée pour les photographies.jpg, .jpeg50 MoDocuments numérisés, photographies avec texte, contenu web
PNGGraphiques réseau portables avec compression sans perte et prise en charge de la transparence.png50 MoCaptures d'écran, graphiques avec texte, documents de haute qualité
GIFFormat d'échange graphique avec prise en charge des animations et palette de couleurs limitée.gif50 MoTexte animé, graphismes simples avec contenu textuel
BMPFormat d'image bitmap avec données de pixels non compressées.bmp50 MoDocuments numérisés de haute qualité, graphismes professionnels

Sortir

Paramètres de sortie

ParamètreTaperDescriptionExemple
succèsBooleanPDF4me indicateur d'état d'extraction de texte - Boolean Un indicateur signalant la réussite ou l'échec du processus d'extraction de texte. PDF4me retours true pour des opérations réussies et false pour toute erreur, permettant une gestion robuste des erreurs dans les flux de travail automatiséstrue
messageStringPDF4me message d'état d'extraction de texte - Message d'état lisible par l'utilisateur fournissant des détails sur le résultat du processus d'extraction de texte. Inclut une confirmation de réussite ou des détails d'erreur pour le dépannage.Image text extracted successfully
nom de fichierStringPDF4me nom du fichier d'extraction de texte généré - Le nom complet du fichier d'extraction de texte généré avec succès, avec l'extension appropriée. PDF4me garantit une dénomination unique et valide la conformité du format de fichier pour une intégration transparente avec les processus en avalimage_text_extract.json
type mimeStringPDF4me sortir MIME taper - MIME Type du fichier d'extraction de texte généré (par exemple, « application/json », « text/plain »). Utile pour la validation du type de contenu et la gestion correcte des fichiers dans les applications web.application/json
taille du fichierNombrePDF4me Taille du fichier d'extraction de texte en octets - La taille exacte en octets du fichier d'extraction de texte généré, fournie par PDF4me pour la planification du stockage et la surveillance des transferts de fichiers0

N8N Réponse à l'action

Le PDF4me Texte d'extraction d'image API renvoie une réponse pouvant être affichée dans plusieurs formats. Choisissez l'affichage qui correspond le mieux à vos besoins :

JSON Format de réponse

Le cru JSON réponse de la API:

[
{
"success": true,
"message": "Image text extracted successfully",
"fileName": "image_text_extract.json",
"mimeType": "application/json",
"fileSize": 0
}
]

Cas d'utilisation

OCR Reconnaissance et numérisation de texte

  • Extraire le texte des documents numérisés, des reçus et des formulaires en vue de leur traitement numérique
  • Convertir les notes manuscrites et les documents imprimés en format texte consultable
  • Traitement des cartes de visite et des informations de contact pour la saisie automatisée des données

Analyse de contenu basée sur l'image

  • Extraire du texte à partir de captures d'écran et d'images pour l'analyse et l'indexation du contenu
  • Traiter des images des médias sociaux avec des superpositions de texte pour l'analyse des sentiments
  • Analyser l'emballage et l'étiquetage des produits pour les systèmes de gestion des stocks

Services d'accessibilité et de traduction

  • Extraire le texte des images pour créer du contenu accessible aux utilisateurs malvoyants
  • Traitement des documents multilingues pour les flux de travail de traduction automatisée
  • Convertir du texte sous forme d'image au format audio pour les applications d'accessibilité

Recherche et exploration de données

  • Extraire du texte à partir de documents de recherche, d'articles et de documents académiques
  • Traiter les documents historiques et les archives pour les projets de recherche numérique
  • Analyser les enquêtes et les formulaires de commentaires basés sur des images à des fins de collecte de données

Obtenez de l'aide