Aller au contenu principal

Diviser PDF par texte utilisant n8n action

PDF4me Diviser PDF par texte divise PDF documents basés sur les modèles de texte et le contenu détectés par n8n Flux de travail automatisés. Processus PDFs via n8n déclencheurs, données binaires, chaînes base64 ou publiques URLs Cette solution permet de trouver automatiquement des chaînes de caractères spécifiques, de segmenter les documents en fonction du texte et d'organiser les fichiers selon leur contenu détecté pour un nommage intelligent. Elle est idéale pour la séparation des factures, le fractionnement des contrats, le traitement par lots de documents, l'organisation par contenu, le classement automatisé et les flux de travail de tri de documents textuels nécessitant une détection précise du texte, un fractionnement intelligent des documents et une intégration fluide.

Articles de blog connexes
Il n'y a pas encore d'article de blog consacré à cette fonctionnalité — à venir prochainement.
En attendant, n'hésitez pas à consulter le blog de PDF4me pour découvrir des tutoriels et des procédures de travail adaptés à toutes les plateformes.
Consultez le blog

Installation

Ajoutez le PDF4me "Diviser PDF par nœud "Texte" à votre n8n Suivez le flux de travail et configurez les paramètres requis. Pour les instructions de configuration initiale, consultez notre documentation. n8n Guide d'intégration.

Prérequis :

  • PDF4me API informations d'identification
  • n8n accès au flux de travail

Configuration:

  1. Ajouter PDF4me nœud vers flux de travail
  2. Sélectionnez « Fractionner » PDF action par texte
  3. Configurer les paramètres d'entrée (voir ci-dessous)
Fractionner le PDF par texte

Paramètres

Liste complète des paramètres pour le Split PDF Action par texte. Configurez ces paramètres pour contrôler les actions basées sur le texte. PDF division.

Important: Les paramètres marqués d'un astérisque (***) sont obligatoires et doivent être fournis pour que l'action fonctionne correctement.

ParamètreTaperDescriptionExemple
Type de données d'entrée***StringPDF Sélection du format d'entrée
• Choisissez le format de votre PDF saisie de données
PDF4me prend en charge plusieurs types d'entrée
• Options : Données binaires, chaîne Base64 ou URL
Binary Data
Nom de la propriété binaireStringBinaire PDF Entrée de fichier (Obligatoire si données binaires)
• Référence PDF fichier du précédent n8n Téléchargement de nœud ou de fichier
PDF4me processus binaires PDF fichiers avec détection automatique du format
• Obligatoire lorsque le type de données d'entrée est « Données binaires »
data
Contenu du document Base64StringBase64 Encodé PDF Saisir (Obligatoire si chaîne Base64)
• Fournir PDF données sous forme de chaîne encodée en base64
PDF4me décode et traite automatiquement le PDF contenu
• Obligatoire lorsque le type de données d'entrée est «Base64 Chaîne"
UEsDBBQABgAI...
URL du fichierStringPublique PDF URL Saisir (Obligatoire si URL)
• Fournir une autorisation publique/ouverte URL au PDF déposer
PDF4me télécharge et traite le fichier depuis URL
• Obligatoire lorsque le type de données d'entrée est «URL"
https://abc.com/sample.pdf
Texte à rechercher***StringSpécifications de recherche textuelle
• Spécifiez la chaîne de texte exacte à rechercher dans le PDF
PDF4me utilise ce texte comme point de séparation pour diviser le document
• Correspondance sensible à la casse pour une détection de texte précise
page 1, line 10.
Page de texte fractionnée***StringSélection de position fractionnée
• Choisissez où diviser le PDF par rapport au texte détecté
• Options : Après (séparation après la page), Avant (séparation avant la page)
PDF4me offre une position fractionnée flexible
After
Nommage des fichiers***StringConvention d'appellation des fichiers de sortie
• Choisissez le mode de génération de la division PDF Les fichiers doivent être nommés
• Options : Nom selon l'ordre (séquentiel), Nom selon la page (avec numéros de page)
• Permet d'organiser les fichiers de sortie
Name As Per Order
Nom de fichier***StringSpécification du nom du fichier de sortie
• Spécifiez le nom de la division générée PDF déposer
• Doit inclure l'extension .pdf
PDF4me garantit une validation unique du nom et du format
output.pdf
Nom du champ binaire de sortie***StringCartographie des données binaires
• Définir le nom de la variable permettant d'accéder à la division générée PDF données
• Utilisé dans les actions de flux de travail suivantes
• Essentiel pour le flux de données du flux de travail
data

Options avancées

Les paramètres suivants sont disponibles dans la section Options avancées et sont facultatifs :

ParamètreTaperDescriptionExemple
Profils personnalisésStringProfils de configuration personnalisés
• Définir des options supplémentaires à l'aide de profils personnalisés
JSON-format contenant des paramètres prédéfinis
• Prend en charge outputDataFormat, preserveMetadata, etc.
• Optionnel pour les besoins spécifiques
{ "outputDataFormat": "base64", "preserveMetadata": true, "optimizeForPrinting": false, "compressionLevel": "medium" }

Sortir

Paramètres de sortie

ParamètreTaperDescriptionExemple
succèsBooleanPDF4me indicateur d'état de l'opération de fractionnement de texte - Boolean drapeau indiquant le succès ou l'échec de la PDF Processus de division du texte. PDF4me retours true pour des opérations réussies et false pour toute erreur, permettant une gestion robuste des erreurs dans les flux de travail automatiséstrue
messageStringPDF4me message d'état de l'opération de fractionnement de texte - Message d'état lisible par l'utilisateur fournissant des détails sur le résultat du processus de segmentation du texte. Inclut une confirmation de réussite ou des détails d'erreur pour le dépannage.PDF split by text successfully
nom de fichierStringPDF4me division générée PDF nom de fichier - Le nom complet du fichier fractionné généré avec succès PDF document avec l'extension .pdf appropriée. PDF4me garantit une dénomination unique et valide la conformité du format de fichier pour une intégration transparente avec les processus en avaltext_split_output.pdf
type mimeStringPDF4me sortir MIME taper - MIME type du généré PDF fichier, toujours « application/pdf » pour PDF documents. Utile pour la validation du type de contenu et la gestion correcte des fichiers dans les applications webapplication/pdf
taille du fichierNombrePDF4me diviser PDF taille du fichier en octets - La taille exacte de la division générée PDF fichier en octets, fourni par PDF4me Pour la planification du stockage, l'optimisation de la bande passante et la surveillance des transferts de fichiers. Indispensable pour la gestion documentaire en entreprise et l'automatisation des flux de travail.125430
Nom du documentStringPDF4me Référence du nom du document - Le nom du document fractionné traité, à des fins de référence et de suivi. Ce nom correspond à celui du document. fileName pour assurer la cohérence des flux de travail de gestion documentairetext_split_output.pdf
textSplitTerminéBooleanPDF4me confirmation de fin de la division du texte - Boolean drapeau confirmant que le PDF L'opération de fractionnement du texte a été effectuée avec succès. Ceci permet de vérifier que le fractionnement du texte a été appliqué correctement.true
Correspondances de texte trouvéesNombrePDF4me nombre de correspondances textuelles détectées - Le nombre de correspondances textuelles qui ont été trouvées avec succès et utilisées comme points de séparation dans le PDF document. Utile pour suivre l'efficacité de la détection de texte et la précision du fractionnement3
fichiers générésNombrePDF4me nombre de fichiers fractionnés générés - Le nombre d'individus PDF Fichiers générés avec succès à partir de l'opération de fractionnement de texte. Utiles pour le suivi de l'achèvement du fractionnement et des résultats de la segmentation des documents.4

N8N Réponse à l'action

Le PDF4me Diviser PDF par texte API renvoie une réponse pouvant être affichée dans plusieurs formats. Choisissez l'affichage qui correspond le mieux à vos besoins :

JSON Format de réponse

Le cru JSON réponse de la API:

[
{
"success": true,
"message": "PDF split by text successfully",
"fileName": "text_split_output.pdf",
"mimeType": "application/pdf",
"fileSize": 125430,
"docName": "text_split_output.pdf",
"textSplitCompleted": true,
"textMatchesFound": 3,
"filesGenerated": 4
}
]

Cas d'utilisation

Traitement des documents et gestion de contenu

  • Divisez les documents volumineux en fonction de marqueurs de texte ou d'en-têtes de section spécifiques afin de créer des fichiers organisés et faciles à gérer pour différents services ou processus.
  • Traiter les documents juridiques en les divisant selon des marqueurs de clauses ou des séparateurs de sections spécifiques afin de créer des fichiers individuels pour chaque section juridique.
  • Automatisez la séparation des rapports et des manuels en fonction des titres de chapitres ou des en-têtes de sections pour une meilleure organisation du contenu

Automatisation des processus métier

  • Fractionnez les lots de factures en recherchant des modèles de texte spécifiques tels que « N° de facture » ou « Paiement dû » afin de créer des fichiers de facture individuels pour chaque transaction.
  • Traitez les contrats et les accords en les segmentant à l'aide de marqueurs de texte spécifiques tels que « Section » ou « Article » afin de créer des fichiers distincts pour chaque section.
  • Automatisez l'organisation des documents financiers en les segmentant selon des modèles de texte tels que « Rapport trimestriel » ou « Résumé annuel » pour différentes périodes de reporting.

Gestion de la distribution de contenu et des flux de travail

  • Fractionnez les documents confidentiels à l'aide de marqueurs de texte spécifiques afin de créer des fichiers distincts pour les différentes parties prenantes, en fonction de leurs exigences d'accès.
  • Traiter les supports de formation en les segmentant selon des modèles textuels tels que « Module » ou « Leçon » afin de créer des modules d’apprentissage individuels pour différents publics.
  • Automatisez l'organisation de la documentation technique en la segmentant à l'aide de marqueurs de texte tels que « Référence API » ou « Guide utilisateur » pour différents types d'utilisateurs.

Obtenez de l'aide