Aller au contenu principal

Convertir PDF à modifier PDF En utilisant OCR en utilisant n8n action

PDF4me Convertir PDF à modifier PDF En utilisant OCR transformations scannées PDFconvertir des documents textuels et des documents contenant des images en documents consultables et modifiables PDFs à travers n8n Flux de travail automatisés. Processus PDFs loin n8n déclencheurs, données binaires, chaînes base64 ou publiques URLs à appliquer OCR technologie avec prise en charge multilingue, sélection du niveau de qualité (Brouillon/Haute), conditionnelle OCR Traitement, création de calques de texte, préservation de la mise en page et génération de contenu consultable : cette solution est idéale pour la numérisation de documents, le traitement de documents numérisés et la facturation. OCR, conversion d'archives, consultable PDF création et automatisation OCR des flux de travail nécessitant une reconnaissance de texte précise, une mise en forme préservée et une intégration transparente.

Articles de blog connexes
Il n'y a pas encore d'article de blog consacré à cette fonctionnalité — à venir prochainement.
En attendant, n'hésitez pas à consulter le blog de PDF4me pour découvrir des tutoriels et des procédures de travail adaptés à toutes les plateformes.
Consultez le blog

Installation

Ajoutez le PDF4me "Convertir PDF à modifier PDF En utilisant OCR" nœud à votre n8n Suivez le flux de travail et configurez les paramètres requis. Pour les instructions de configuration initiale, consultez notre documentation. n8n Guide d'intégration.

Prérequis :

  • PDF4me API informations d'identification
  • n8n accès au flux de travail

Configuration:

  1. Ajouter PDF4me nœud vers flux de travail
  2. Sélectionnez « Convertir » PDF à modifier PDF En utilisant OCR" action
  3. Configurer les paramètres d'entrée (voir ci-dessous)
Convertir un PDF en PDF modifiable à l'aide de la configuration OCR

Paramètres

Liste complète des paramètres pour la conversion PDF à modifier PDF En utilisant OCR action. Configurez ces paramètres pour contrôler OCR conversion.

Important: Les paramètres marqués d'un astérisque (***) sont obligatoires et doivent être fournis pour que l'action fonctionne correctement.

ParamètreTaperDescriptionExemple
Type de données d'entrée***StringPDF Sélection du format d'entrée
• Choisissez le format de votre PDF entrée de document
PDF4me prend en charge plusieurs types d'entrée pour OCR conversion
• Options : Données binaires, Base64 Chaîne, ou URL
Binary Data
Champ binaire d'entréeBinaireBinaire PDF Entrée de fichier (Obligatoire si données binaires)
• Référence PDF fichier du précédent n8n Téléchargement de nœud ou de fichier
• Fonctionne avec les données scannées PDFs, basé sur l'image PDFet contenu mixte
• Obligatoire lorsque le type de données d'entrée est « Données binaires »
{{ $binary.data }}
Contenu PDF Base64StringBase64 Encodé PDF Saisir (Obligatoire si Base64 Chaîne)
• Fournir PDF contenu sous forme de chaîne encodée en base64
• Prend en charge diverses PDF formats y compris les documents numérisés
• Obligatoire lorsque le type de données d'entrée est «Base64 Chaîne"
JVBE...
URL du PDFStringPublique PDF URL Saisir (Obligatoire si URL)
• Fournir une autorisation publique/ouverte URL au PDF déposer
• Télécharge et traite le document pour OCR conversion
• Obligatoire lorsque le type de données d'entrée est «URL"
https://abc.com/scanned.pdf
Nom du document***StringNom du fichier d'entrée
• Spécifiez le nom de l'entrée PDF déposer
• Important pour OCR qualité et précision de la reconnaissance de texte
• Doit inclure l'extension .pdf
scanned_document.pdf
Type de qualité***StringOCR Sélection de qualité
• Choisissez le OCR niveau de qualité du traitement
• Brouillon : convient à une utilisation normale PDFs (1 API appel par fichier)
• Haute résolution : convient aux images/documents numérisés (2 API appels par page)
Draft
OCR uniquement en cas de besoin***Booleanconditionnel OCR Traitement
• Vrai : appliquer OCR seulement lorsque PDF est basé sur l'image ou non consultable
• Faux : appliquer OCR à tout le contenu, quelles que soient les couches de texte existantes
• Optimise le traitement et API consommation
True
Langue***StringOCR Paramètres de langue
• Précisez la langue principale du texte dans le PDF
• Optimise OCR précision pour une meilleure reconnaissance de texte
• L’anglais est la langue par défaut, d’autres langues sont disponibles.
English
Format de sortie***BooleanContrôle du format de sortie
• Vrai : activer les options de mise en forme avancées pour les éléments modifiables PDF
• Assure une meilleure préservation de l'agencement et de la structure
• Recommandé pour préserver la mise en forme des documents
true
Fusionner toutes les feuilles***BooleanContrôle de fusion des feuilles
• Vrai : fusionner toutes les feuilles/pages en un seul document continu
• Faux : conserver la structure et la mise en forme de chaque page
• Choisir en fonction de la structure de sortie souhaitée
True
Nom du fichier de sortie***StringNom du fichier de sortie
• Spécifiez le nom du fichier modifiable généré PDF déposer
• Doit inclure l'extension .pdf
PDF4me garantit une validation unique du nom et du format
editable_pdf_output.pdf
Nom du champ binaire de sortie***StringCartographie des données binaires
• Définir le nom de la variable permettant d'accéder aux données modifiables générées PDF données
• Utilisé dans les actions de flux de travail suivantes
• Essentiel pour le flux de données du flux de travail
data

Options avancées

Les paramètres suivants sont disponibles dans la section Options avancées et sont facultatifs :

ParamètreTaperDescriptionExemple
Profils personnalisésStringProfils de configuration personnalisés
• Définir des options supplémentaires à l'aide de profils personnalisés
JSON-format de type contenant des éléments prédéfinis OCR paramètres
• Inclut la détection de la langue, la précision de la reconnaissance de texte et la préservation de la mise en forme
• Optionnel pour les besoins spécifiques
{ "language": "auto", "accuracy": "high", "preserveFormatting": true }

Sortir

Paramètres de sortie

ParamètreTaperDescriptionExemple
succèsBooleanPDF4me OCR indicateur d'état de conversion - Indicateur booléen signalant le succès ou l'échec de l'opération OCR Processus de conversion. Retours true pour des conversions réussies et false pour toute erreur, permettant une gestion robuste des erreurs dans les flux de travail automatiséstrue
messageStringPDF4me OCR message d'état de conversion - Message descriptif indiquant le résultat de la OCR Processus de conversion. Fournit des messages d'état clairs pour les conversions réussies et des informations d'erreur détaillées à des fins de dépannage.PDF converted to editable PDF using OCR successfully
nom de fichierStringPDF4me nom de fichier généré - Le nom complet du fichier modifiable traité avec succès PDF document avec l'extension appropriée. PDF4me garantit une dénomination unique et valide la conformité du format de fichier pour une intégration transparente avec les processus en avaleditable_pdf_output.pdf
type mimeStringPDF4me MIME type identificateur - La norme MIME type pour le modifiable généré PDF fichier, toujours défini sur application/pdf par PDF4me's OCR moteur de traitement. Cela garantit une gestion et une reconnaissance correctes des fichiers sur tous les systèmes et applications.application/pdf
taille du fichierNombrePDF4me taille du fichier en octets - La taille exacte de l'élément modifiable généré PDF Taille du fichier en octets, fournie pour la planification du stockage, l'optimisation de la bande passante et la surveillance des transferts de fichiers. Indispensable pour la gestion documentaire en entreprise et l'automatisation des flux de travail.121875
type de qualitéStringPDF4me OCR paramètre de qualité utilisé - Le paramètre de qualité qui a été appliqué pendant le OCR Processus de conversion. Indique le niveau de qualité utilisé pour la reconnaissance de texte et le traitement des documents. Les valeurs courantes sont « Brouillon », « Élevé » et « Archivé ».Draft
ocrQuandNécessaireStringPDF4me OCR paramètre de traitement conditionnel - Indique si OCR Appliqué de manière conditionnelle (uniquement en cas de besoin) ou à l'ensemble du contenu. Affiche le paramètre réellement utilisé lors du traitement à des fins de vérification et de débogage.true
langueStringPDF4me OCR paramètre de langue utilisé - Le paramètre de langue qui a été appliqué pendant OCR Processus de conversion. Affiche la langue utilisée pour la reconnaissance de texte afin d'optimiser la précision et le traitement.English
fusionner toutes les feuillesBooleanPDF4me paramètre de fusion de feuilles utilisé - Indique si toutes les feuilles ou pages ont été fusionnées en un seul document lors du traitement. Affiche le paramètre appliqué à la gestion de la structure du document.false

N8N Réponse à l'action

Le PDF4me Convertir PDF à modifier PDF En utilisant OCR API renvoie une réponse pouvant être affichée dans plusieurs formats. Choisissez l'affichage qui correspond le mieux à vos besoins :

JSON Format de réponse

Le cru JSON réponse de la API:

{
"success": true,
"message": "PDF converted to editable PDF using OCR successfully",
"fileName": "editable_pdf_output.pdf",
"mimeType": "application/pdf",
"fileSize": 121875,
"qualityType": "Draft",
"ocrWhenNeeded": "true",
"language": "English",
"mergeAllSheets": false
}

Cas d'utilisation

Numérisation et archivage de documents

  • Convertissez les documents papier et les fichiers numérisés en formats numériques consultables et modifiables.
  • Numériser les archives historiques et les documents patrimoniaux pour un accès et une préservation modernes
  • Transformer les formulaires et documents physiques en versions numériques modifiables

Gestion et recherche de contenu

  • Rendre les documents numérisés consultables par les systèmes de gestion de contenu
  • Activer la fonction de recherche en texte intégral sur les documents qui n'étaient pas auparavant consultables.
  • Convertir à partir d'images PDFs dans un contenu accessible et modifiable pour une meilleure expérience utilisateur

Automatisation et traitement des flux de travail

  • Automatisez la conversion des documents numérisés dans les flux de travail de traitement de documents.
  • Traiter les documents papier entrants pour l'extraction et l'analyse automatisées des données
  • Activer le traitement en aval du contenu de documents précédemment statiques

Obtenez de l'aide