Diviser PDF par texte utilisant n8n action
PDF4me Diviser PDF par texte divise PDF documents basés sur les modèles de texte et le contenu détectés par n8n Flux de travail automatisés. Processus PDFs via n8n déclencheurs, données binaires, chaînes base64 ou publiques URLs Cette solution permet de trouver automatiquement des chaînes de caractères spécifiques, de segmenter les documents en fonction du texte et d'organiser les fichiers selon leur contenu détecté pour un nommage intelligent. Elle est idéale pour la séparation des factures, le fractionnement des contrats, le traitement par lots de documents, l'organisation par contenu, le classement automatisé et les flux de travail de tri de documents textuels nécessitant une détection précise du texte, un fractionnement intelligent des documents et une intégration fluide.
Installation
Ajoutez le PDF4me "Diviser PDF par nœud "Texte" à votre n8n Suivez le flux de travail et configurez les paramètres requis. Pour les instructions de configuration initiale, consultez notre documentation. n8n Guide d'intégration.
Prérequis :
- PDF4me API informations d'identification
- n8n accès au flux de travail
Configuration:
- Ajouter PDF4me nœud vers flux de travail
- Sélectionnez « Fractionner » PDF action par texte
- Configurer les paramètres d'entrée (voir ci-dessous)

Paramètres
Liste complète des paramètres pour le Split PDF Action par texte. Configurez ces paramètres pour contrôler les actions basées sur le texte. PDF division.
Important: Les paramètres marqués d'un astérisque (***) sont obligatoires et doivent être fournis pour que l'action fonctionne correctement.
| Paramètre | Taper | Description | Exemple |
|---|---|---|---|
| Type de données d'entrée*** | String | PDF Sélection du format d'entrée • Choisissez le format de votre PDF saisie de données • PDF4me prend en charge plusieurs types d'entrée • Options : Données binaires, chaîne Base64 ou URL | Binary Data |
| Nom de la propriété binaire | String | Binaire PDF Entrée de fichier (Obligatoire si données binaires) • Référence PDF fichier du précédent n8n Téléchargement de nœud ou de fichier • PDF4me processus binaires PDF fichiers avec détection automatique du format • Obligatoire lorsque le type de données d'entrée est « Données binaires » | data |
| Contenu du document Base64 | String | Base64 Encodé PDF Saisir (Obligatoire si chaîne Base64) • Fournir PDF données sous forme de chaîne encodée en base64 • PDF4me décode et traite automatiquement le PDF contenu • Obligatoire lorsque le type de données d'entrée est «Base64 Chaîne" | UEsDBBQABgAI... |
| URL du fichier | String | Publique PDF URL Saisir (Obligatoire si URL) • Fournir une autorisation publique/ouverte URL au PDF déposer • PDF4me télécharge et traite le fichier depuis URL • Obligatoire lorsque le type de données d'entrée est «URL" | https://abc.com/sample.pdf |
| Texte à rechercher*** | String | Spécifications de recherche textuelle • Spécifiez la chaîne de texte exacte à rechercher dans le PDF • PDF4me utilise ce texte comme point de séparation pour diviser le document • Correspondance sensible à la casse pour une détection de texte précise | page 1, line 10. |
| Page de texte fractionnée*** | String | Sélection de position fractionnée • Choisissez où diviser le PDF par rapport au texte détecté • Options : Après (séparation après la page), Avant (séparation avant la page) • PDF4me offre une position fractionnée flexible | After |
| Nommage des fichiers*** | String | Convention d'appellation des fichiers de sortie • Choisissez le mode de génération de la division PDF Les fichiers doivent être nommés • Options : Nom selon l'ordre (séquentiel), Nom selon la page (avec numéros de page) • Permet d'organiser les fichiers de sortie | Name As Per Order |
| Nom de fichier*** | String | Spécification du nom du fichier de sortie • Spécifiez le nom de la division générée PDF déposer • Doit inclure l'extension .pdf • PDF4me garantit une validation unique du nom et du format | output.pdf |
| Nom du champ binaire de sortie*** | String | Cartographie des données binaires • Définir le nom de la variable permettant d'accéder à la division générée PDF données • Utilisé dans les actions de flux de travail suivantes • Essentiel pour le flux de données du flux de travail | data |
Options avancées
Les paramètres suivants sont disponibles dans la section Options avancées et sont facultatifs :
| Paramètre | Taper | Description | Exemple |
|---|---|---|---|
| Profils personnalisés | String | Profils de configuration personnalisés • Définir des options supplémentaires à l'aide de profils personnalisés • JSON-format contenant des paramètres prédéfinis • Prend en charge outputDataFormat, preserveMetadata, etc. • Optionnel pour les besoins spécifiques | { "outputDataFormat": "base64", "preserveMetadata": true, "optimizeForPrinting": false, "compressionLevel": "medium" } |
Sortir
Paramètres de sortie
| Paramètre | Taper | Description | Exemple |
|---|---|---|---|
| succès | Boolean | PDF4me indicateur d'état de l'opération de fractionnement de texte - Boolean drapeau indiquant le succès ou l'échec de la PDF Processus de division du texte. PDF4me retours true pour des opérations réussies et false pour toute erreur, permettant une gestion robuste des erreurs dans les flux de travail automatisés | true |
| message | String | PDF4me message d'état de l'opération de fractionnement de texte - Message d'état lisible par l'utilisateur fournissant des détails sur le résultat du processus de segmentation du texte. Inclut une confirmation de réussite ou des détails d'erreur pour le dépannage. | PDF split by text successfully |
| nom de fichier | String | PDF4me division générée PDF nom de fichier - Le nom complet du fichier fractionné généré avec succès PDF document avec l'extension .pdf appropriée. PDF4me garantit une dénomination unique et valide la conformité du format de fichier pour une intégration transparente avec les processus en aval | text_split_output.pdf |
| type mime | String | PDF4me sortir MIME taper - MIME type du généré PDF fichier, toujours « application/pdf » pour PDF documents. Utile pour la validation du type de contenu et la gestion correcte des fichiers dans les applications web | application/pdf |
| taille du fichier | Nombre | PDF4me diviser PDF taille du fichier en octets - La taille exacte de la division générée PDF fichier en octets, fourni par PDF4me Pour la planification du stockage, l'optimisation de la bande passante et la surveillance des transferts de fichiers. Indispensable pour la gestion documentaire en entreprise et l'automatisation des flux de travail. | 125430 |
| Nom du document | String | PDF4me Référence du nom du document - Le nom du document fractionné traité, à des fins de référence et de suivi. Ce nom correspond à celui du document. fileName pour assurer la cohérence des flux de travail de gestion documentaire | text_split_output.pdf |
| textSplitTerminé | Boolean | PDF4me confirmation de fin de la division du texte - Boolean drapeau confirmant que le PDF L'opération de fractionnement du texte a été effectuée avec succès. Ceci permet de vérifier que le fractionnement du texte a été appliqué correctement. | true |
| Correspondances de texte trouvées | Nombre | PDF4me nombre de correspondances textuelles détectées - Le nombre de correspondances textuelles qui ont été trouvées avec succès et utilisées comme points de séparation dans le PDF document. Utile pour suivre l'efficacité de la détection de texte et la précision du fractionnement | 3 |
| fichiers générés | Nombre | PDF4me nombre de fichiers fractionnés générés - Le nombre d'individus PDF Fichiers générés avec succès à partir de l'opération de fractionnement de texte. Utiles pour le suivi de l'achèvement du fractionnement et des résultats de la segmentation des documents. | 4 |
N8N Réponse à l'action
Le PDF4me Diviser PDF par texte API renvoie une réponse pouvant être affichée dans plusieurs formats. Choisissez l'affichage qui correspond le mieux à vos besoins :
- JSON
- Table
- Schema
- Binary
JSON Format de réponse
Le cru JSON réponse de la API:
[
{
"success": true,
"message": "PDF split by text successfully",
"fileName": "text_split_output.pdf",
"mimeType": "application/pdf",
"fileSize": 125430,
"docName": "text_split_output.pdf",
"textSplitCompleted": true,
"textMatchesFound": 3,
"filesGenerated": 4
}
]
Vue tableau
Données de réponse présentées sous forme de tableau structuré :
| Paramètre | Valeur |
|---|---|
| success | true |
| message | PDF split by text successfully |
| fileName | text_split_output.pdf |
| mimeType | application/pdf |
| fileSize | 125430 |
| docName | text_split_output.pdf |
| textSplitCompleted | true |
| textMatchesFound | 3 |
| filesGenerated | 4 |
Vue schématique
Structure des données et types de réponse :
1 item
success: ☑ true
message: AB PDF split by text successfully
fileName: AB text_split_output.pdf
mimeType: AB application/pdf
fileSize: # 125430
docName: AB text_split_output.pdf
textSplitCompleted: ☑ true
textMatchesFound: # 3
filesGenerated: # 4
Indicateurs de type :
AB= String#= Nombre☑= Boolean
Vue des données binaires
Les données et métadonnées réelles du fichier PDF divisé :
data
─────────────────────────────
File Name: text_split_output.pdf
File Extension: pdf
Mime Type: application/pdf
File Size: 122.5 KB
Accès aux données binaires :
- n8n Objet binaire:
$binary.data.data - Base64 Contenu: Disponible pour une utilisation directe
- Opérations sur les fichiersPrêt à être téléchargé, envoyé par courriel ou stocké.
Cas d'utilisation
Traitement des documents et gestion de contenu
- Divisez les documents volumineux en fonction de marqueurs de texte ou d'en-têtes de section spécifiques afin de créer des fichiers organisés et faciles à gérer pour différents services ou processus.
- Traiter les documents juridiques en les divisant selon des marqueurs de clauses ou des séparateurs de sections spécifiques afin de créer des fichiers individuels pour chaque section juridique.
- Automatisez la séparation des rapports et des manuels en fonction des titres de chapitres ou des en-têtes de sections pour une meilleure organisation du contenu
Automatisation des processus métier
- Fractionnez les lots de factures en recherchant des modèles de texte spécifiques tels que « N° de facture » ou « Paiement dû » afin de créer des fichiers de facture individuels pour chaque transaction.
- Traitez les contrats et les accords en les segmentant à l'aide de marqueurs de texte spécifiques tels que « Section » ou « Article » afin de créer des fichiers distincts pour chaque section.
- Automatisez l'organisation des documents financiers en les segmentant selon des modèles de texte tels que « Rapport trimestriel » ou « Résumé annuel » pour différentes périodes de reporting.
Gestion de la distribution de contenu et des flux de travail
- Fractionnez les documents confidentiels à l'aide de marqueurs de texte spécifiques afin de créer des fichiers distincts pour les différentes parties prenantes, en fonction de leurs exigences d'accès.
- Traiter les supports de formation en les segmentant selon des modèles textuels tels que « Module » ou « Leçon » afin de créer des modules d’apprentissage individuels pour différents publics.
- Automatisez l'organisation de la documentation technique en la segmentant à l'aide de marqueurs de texte tels que « Référence API » ou « Guide utilisateur » pour différents types d'utilisateurs.