Diviser PDF par texte - Séparateur de contenu API
PDF4me Diviser PDF par texte est une solution puissante de niveau entreprise qui divise PDF documents en recherchant des modèles de texte spécifiques grâce à des fonctions avancées API intégration. Cette intégration complète. PDF fractionnement efficace des processus de service PDF documents contenant du texte, offrant une reconnaissance de texte intelligente, un filtrage automatique des pages, un découpage précis des documents et des fonctionnalités avancées PDF Des capacités de traitement pour une gestion documentaire améliorée et des flux de travail automatisés. API processus PDF répartition par source de réception PDF documents par REST API appels, utilisant une technologie avancée de reconnaissance de texte et des algorithmes de filtrage intelligents pour un fractionnement précis des documents et des services professionnels PDF Traitement. Avec une prise en charge complète de la reconnaissance de texte, du filtrage intelligent des pages, du fractionnement automatique des documents et des fonctionnalités professionnelles. PDF Cette solution de traitement est idéale pour la gestion documentaire, le traitement automatisé, le fractionnement de texte et les applications d'entreprise. PDF Flux de travail nécessitant un fractionnement fiable des documents, avec une précision garantie et une qualité de sortie constante. Fractionner PDF par documents texte facilement avec API pour les avancés PDF traitement et gestion documentaire.
Authentification de votre API Demande
Pour accéder au PDF4me REST APIChaque requête doit inclure des informations d'authentification valides. L'authentification garantit la sécurité des communications et confirme votre identité en tant qu'utilisateur autorisé. REST API.
Caractéristiques principales
- Reconnaissance de texte: Reconnaissance intelligente de texte et correspondance de modèles à partir de PDF documents
- Division automatisée: Diviser PDF documents basés sur des modèles de texte spécifiques et des critères de filtrage
- Filtrage des pagesFiltrer les pages en fonction de leur contenu textuel pour un fractionnement précis des documents
- Préservation de la qualité: Maintenir PDF qualité lors des opérations de fractionnement
- Résultats professionnels: Haute qualité PDF fractionnement avec reconnaissance de texte précise
- Sans couture API Intégration: RESTful API conçu pour l'automatisation PDF flux de travail de traitement et intégration des systèmes d'entreprise
REST API Point de terminaison
Le PDF4me REST API utilise la norme HTTP Méthodes d'interaction avec les ressources. Toutes basées sur du texte. PDF Les opérations de fractionnement sont effectuées via un point de terminaison unique :
- Méthode: POST
- Point final :
/api/v2/SplitByText
Soutenu PDF Fonctionnalités de fractionnement
Le API offre un soutien complet pour divers PDF capacités de segmentation et de traitement de texte :
Traitement de texte
- Reconnaissance de texte: Reconnaissance intelligente de texte et correspondance de modèles à partir de PDF documents
- Correspondance de motifs: Rechercher des modèles de texte et du contenu spécifiques pour les opérations de filtrage et de segmentation
- Formats multiples: Prise en charge de différents formats de texte et types de contenu
- Résultats professionnelsReconnaissance de texte de haute qualité avec correspondance de modèles précise
- Traitement avancé: Prise en charge des structures de texte complexes et des exigences de reconnaissance
Division de documents
- Division automatisée: Diviser PDF documents basés sur des modèles de texte spécifiques et des critères de filtrage
- Filtrage des pagesFiltrer les pages en fonction de leur contenu textuel pour un fractionnement précis des documents
- Traitement intelligent: Division intelligente des documents avec identification des pages basée sur le texte
- Résultats professionnels: Haute qualité PDF fractionnement avec séparation précise des pages
- Traitement avancé: Prise en charge des structures de documents complexes et des exigences de fractionnement
Traitement du contenu
- Préservation de la qualité: Maintenir PDF qualité lors des opérations de fractionnement
- Prise en charge des formats: Soutien à divers PDF formats et types de documents
- Amélioration professionnelle: Haute qualité PDF traitement avec division précise
- Options flexibles: Paramètres de traitement personnalisables pour des exigences spécifiques
REST API Paramètres
Liste complète des paramètres pour le Split PDF par texte REST APILes paramètres sont organisés par catégorie pour une meilleure compréhension et une mise en œuvre plus aisée.
Important: Les paramètres marqués d'un astérisque (*) sont obligatoires et doivent être fournis pour le API pour fonctionner correctement.
Paramètres requis
| Paramètre | Taper | Description | Exemple |
|---|---|---|---|
| Contenu du fichier* | Base64 | Le contenu complet du PDF document encodé en Base64 format pour le traitement de segmentation textuelle. Ce paramètre contient l'intégralité PDF Données de fichiers nécessaires à la reconnaissance de texte, au filtrage des pages et aux flux de travail de fractionnement des documents. Essentielles pour la gestion sécurisée des documents et API-basé PDF opérations de fractionnement. | JVBERi... |
| Nom de fichier* | String | La source PDF Nom de fichier du document avec l'extension .pdf appropriée pour les opérations de segmentation textuelle. Ce paramètre identifie le document d'entrée pour la reconnaissance de texte, le filtrage des pages et les flux de travail de segmentation. Requis pour l'identification des documents et la gestion du pipeline de traitement. PDF opérations de fractionnement. | document.pdf |
| Texte* | String | Le modèle de texte ou le contenu spécifique à rechercher et à utiliser comme critère de segmentation au sein du PDF Ce paramètre permet la correspondance de modèles de texte pour une identification précise des pages et des opérations de fractionnement. Il active le fractionnement automatisé des documents, la gestion de contenu et les flux de travail de traitement textuel avec des capacités de correspondance de modèles exactes. | Chapter 1 |
| Page de texte divisée* | String | Spécifiez le comportement de fractionnement des pages lorsque des motifs de texte sont détectés. Ce paramètre contrôle la manière dont le PDF Le document est divisé lorsque des critères textuels sont remplis, ce qui permet un contrôle précis de la logique de division des documents et de la séparation des pages pour les flux de travail de traitement textuel. | After |
| Nommer les fichiers* | String | Spécifiez la convention d'appellation pour la division PDF Ce paramètre détermine le nom des fichiers de sortie, assurant ainsi une nomenclature et une organisation cohérentes pour les documents fractionnés. Il prend en charge différents modèles de nommage pour une meilleure gestion et organisation des fichiers. | document_part_{page} |
Sortir
Le PDF4me Diviser PDF par texte REST API renvoie une réponse pouvant être affichée dans plusieurs formats. Choisissez l'affichage qui correspond le mieux à vos besoins :
- JSON
- Table
- Schema
- Binary
JSON Format de réponse
Le cru JSON réponse de la API:
{
"File Content": "Output file content from the PDF4me action",
"File Name": "Output file name from the PDF4me action"
}
Vue tableau
Données de réponse présentées sous forme de tableau structuré :
| Paramètre | Valeur |
|---|---|
| Contenu du fichier | Contenu du fichier de sortie du PDF4me action |
| Nom de fichier | Nom du fichier de sortie à partir de PDF4me action |
Vue schématique
Structure des données et types de réponses :
2 items
File Content: Binary Output file content from the PDF4me action
File Name: String Output file name from the PDF4me action
Indicateurs de type :
Binary= Données binairesString= Données textuelles
Vue des données binaires
La véritable division PDF données du fichier :
data
─────────────────────────────
File Content: Output file content from the PDF4me action
File Name: Output file name from the PDF4me action
Accès aux données binaires :
- PDF ContenuPrêt pour le téléchargement ou un traitement ultérieur.
- Diviser PDF: Complet PDF avec segmentation textuelle appliquée
Exemple de requête
En-tête
Content-Type: application/json
Authorization: YOUR_API_KEY
Note: Obtenez votre API clé de la PDF4me Tableau de bord
Charge utile
{
"docContent": "Please put PDF base64 content",
"docName": "output.pdf",
"text": "Nadal, who officially turned professional in 2001",
"splitTextPage": "before",
"fileNaming": "NameAsPerOrder"
}
Exemples de code
Le PDF4me Diviser PDF par texte REST API propose des exemples de code dans plusieurs langages de programmation. Choisissez le langage qui convient le mieux à votre environnement de développement :
- C#
- Java
- JavaScript
- Python
- Salesforce
- n8n
- Google Script
- AWS Lambda
Java Échantillon
Java implémentation avec gestion complète des erreurs et traitement des réponses :
JavaScript Échantillon
Node.js et compatible avec les navigateurs JavaScript mise en œuvre:
Python Échantillon
Python implémentation avec la bibliothèque requests et JSON manutention:
Google Script Échantillon
Google Apps Script mise en œuvre pour Google Workspace intégration :
PDF Fonctionnalités de fractionnement
Traitement de texte
- Reconnaissance de texte: Reconnaissance intelligente de texte et correspondance de modèles à partir de PDF documents
- Correspondance de motifs: Rechercher des modèles de texte et du contenu spécifiques pour les opérations de filtrage et de segmentation
- Formats multiples: Prise en charge de différents formats de texte et types de contenu
- Résultats professionnelsReconnaissance de texte de haute qualité avec correspondance de modèles précise
- Traitement avancé: Prise en charge des structures de texte complexes et des exigences de reconnaissance
Division de documents
- Division automatisée: Diviser PDF documents basés sur des modèles de texte spécifiques et des critères de filtrage
- Filtrage des pagesFiltrer les pages en fonction de leur contenu textuel pour un fractionnement précis des documents
- Traitement intelligent: Division intelligente des documents avec identification des pages basée sur le texte
- Résultats professionnels: Haute qualité PDF fractionnement avec séparation précise des pages
- Traitement avancé: Prise en charge des structures de documents complexes et des exigences de fractionnement
Traitement du contenu
- Préservation de la qualité: Maintenir PDF qualité lors des opérations de fractionnement
- Prise en charge des formats: Soutien à divers PDF formats et types de documents
- Amélioration professionnelle: Haute qualité PDF traitement avec division précise
- Options flexibles: Paramètres de traitement personnalisables pour des exigences spécifiques
Cas d'utilisation et applications industrielles
- Use Cases
Cas d'utilisation
- Traitement des documents: Diviser les documents PDF volumineux en fonction d'identifiants textuels pour un traitement automatisé
- Traitement du chapitreDiviser les fichiers PDF (livres ou documents) par titres de chapitres pour une gestion automatisée du contenu
- Traitement des factures: Segmenter les PDF des factures par modèles de texte pour automatiser les flux de travail comptables
- Traitement des rapports: Diviser les fichiers PDF des rapports par en-têtes de section pour une organisation automatisée du contenu
- ConformitéSéparer les documents de conformité par identifiants textuels pour un traitement réglementaire automatisé
- Automatisation des flux de travailAutomatiser les flux de travail de fractionnement des PDF pour les opérations d'entreprise
- Gestion de contenuRépartir les documents de contenu par catégories de texte pour une organisation automatisée
- Traitement par lots: Traiter de grands volumes de documents avec un fractionnement automatisé basé sur le texte