Aller au contenu principal

Extraire la pièce jointe de PDF dans Make

Extraire la pièce jointe de PDF est un Make module qui récupère tous les fichiers intégrés dans un PDF document automatiquement au sein d'un scénario. Il gère PDF portefeuilles, standard PDF pièces jointes, et PDF/A-3 fichiers sources, renvoyant chaque fichier extrait sous forme de Base64-élément encodé dans un tableau Attachments prêt à être traité individuellement par un itérateur.

Que fait ce module ?
PDF4me Extraire la pièce jointe de PDF récupère tous les fichiers intégrés d'un PDF document ou PDF portefeuille à l'intérieur d'un Make scénario. Fournir le PDF sous forme de tampon binaire, et le module renvoie un tableau Attachments où chaque élément contient le nom et les données du fichier (Base64Chaîne a ). Make Itérateur permettant de traiter chaque fichier individuellement : téléchargement vers un stockage cloud, envoi par e-mail aux destinataires, importation des fichiers de données dans une base de données ou transmission à un autre module.
Utilisez un itérateur pour traiter chaque pièce jointe séparément.

Le module renvoie toutes les pièces jointes sous forme de tableau dans un seul fichier de sortie. Ajoutez un Make Itérateur module immédiatement après pour diviser le tableau en paquets individuels, un par pièce jointe. Chaque paquet contient Nom de fichier et Données de fichier (Base64) vous pouvez ainsi acheminer les fichiers vers différentes destinations en fonction de leur type ou de leur nom.

Les données du fichier sont Base64-encodé

Chaque pièce jointe extraite est renvoyée sous forme de Base64 la chaîne dans le Données de fichier champ. La plupart Make Les intégrations de stockage (Google Drive, Dropbox, OneDrive) sont acceptées Base64 directement. Si un module en aval nécessite une entrée binaire, convertissez-la en utilisant le Make toBinary(FileData, 'base64') fonction avant le mappage.

Travaille avec PDF portefeuilles et PDF/A-3 archives

Au-delà des normes PDF pièces jointes, ce module gère PDF portefeuilles (conteneurs multi-fichiers) et PDF/A-3 Documents d'archivage avec fichiers sources intégrés. Pour PDF/A-3, les fichiers sources (Word, Excel, XML) sont extraits tandis que l'archive PDF reste intact dans le stockage de conformité, conformément à la PDF/A-3 spécification.

Articles de blog connexes
Il n'y a pas encore d'article de blog consacré à cette fonctionnalité — à venir prochainement.
En attendant, n'hésitez pas à consulter le blog de PDF4me pour découvrir des tutoriels et des procédures de travail adaptés à toutes les plateformes.
Consultez le blog

Authentification de votre API Demande

Pour accéder au PDF4me Web API à travers MakeChaque requête doit inclure des informations d'authentification valides. L'authentification garantit une communication sécurisée entre votre compte et votre compte. Make scénarios et PDF4meServices d'extraction de pièces jointes de .

Module « Faire PDF4me Extraire la pièce jointe du PDF » affichant le nom du fichier et les champs du document mappés à partir d'un module précédent

Carte Nom de fichier et Document à partir de l'étape de téléchargement précédente, enchaînez un Make Itérateur pour traiter chaque pièce jointe extraite.

Comment configurer l'extraction de pièces jointes à partir de PDF dans Make

  1. Ajouter PDF4me > Extraire la pièce jointe de PDF à votre situation.
  2. Sélectionnez votre Connexion ou cliquez Ajouter pour en créer un avec votre API clé.
  3. Carte Nom de fichier (avec l'extension .pdf) du module précédent ou entrez un nom statique.
  4. Carte Document (binaire) PDF tampon) à partir d'un Google Drive, Dropbox, d'un e-mail ou HTTP Étape de téléchargement.
  5. Ajouter un Make Itérateur après ce module et mappez-le sur le Pièces jointes Sortie du tableau.
  6. Connectez les modules en aval à la sortie de l'itérateur : chargement vers un stockage cloud, envoi par e-mail, importation de données ou routage par type de fichier.

Paramètres

ParamètreRequisCe que cela faitExemple
File NameRequiredFilename of the source PDF including the .pdf extension. Map from the previous module's file name output or enter a static name.portfolio.pdf
DocumentRequiredBinary PDF file content. Map from a Google Drive, Dropbox, email, or HTTP download step. The PDF must contain embedded attachments for the module to return results.[PDF Buffer]

Sortir

ChampTaperCe qu'il contient
AttachmentsArrayCollection of all extracted attachment objects. Feed into a Make Iterator to process each file individually.
File NameStringFilename of the individual attachment including its extension (e.g. source_data.xlsx).
File DataBase64Content of the individual attachment encoded as Base64. Map to a storage upload module or decode with toBinary() for modules that require binary input.

Quels types de fichiers pouvez-vous extraire d'un PDF?

Tout type de fichier intégré en pièce jointe est pris en charge : feuilles de calcul (XLSX, CSV), documents Word (DOCX), images (PNG, JPG), les codes postaux ou autres PDFsCela inclut les fichiers dans PDF portefeuilles (le format conteneur multi-fichiers d'Adobe) et les fichiers sources intégrés dans PDF/A-3 archives selon les ISO 19005-3 standardLe module préserve les formats de fichiers et les extensions d'origine dans le champ Nom de fichier renvoyé.

Exemples de flux de travail

Extraire et organiser les fichiers de preuves issus de la soumission de conformité PDFs

  1. Déclenchement: Soumission de conformité PDF reçu (pièce jointe à l'e-mail ou dossier de surveillance)
  2. Télécharger PDFRécupérez le dossier de conformité
  3. Extraire les pièces jointesRécupérer tous les fichiers de preuves intégrés
  4. ItérateurTraiter chaque pièce jointe extraite individuellement
  5. Classer par extension: Itinéraire vers le dossier de conformité approprié (feuilles de calcul, images, documents)
  6. Télécharger: Enregistrez chaque fichier dans le dossier approprié dans SharePoint ou Google Drive
  7. Enregistrer: Enregistrer tous les fichiers extraits dans une base de données de conformité
  8. Avertir l'équipe: Alerter l'équipe de conformité concernant la soumission traitée

Foire aux questions

What types of files can this module extract from a PDF?+
The module extracts any file type embedded as an attachment: spreadsheets, Word documents, images, CSVs, ZIPs, or other PDFs. This includes files in PDF portfolios and source files embedded in PDF/A-3 archive documents. Original file formats and extensions are preserved in the returned File Name field.
How do I process multiple attachments returned by the module?+
The module returns an Attachments array. Use a Make Iterator immediately after to split the array into individual bundles, one per attachment. Each bundle contains File Name and File Data (Base64). You can then upload each file to Google Drive, Dropbox, or SharePoint, or apply routing logic based on the file extension.
What is the File Data format and how do I use it?+
File Data is returned as a Base64-encoded string. Most Make storage modules (Google Drive, Dropbox, OneDrive) accept Base64 data directly in their upload fields. If a module requires binary input, use the Make function toBinary(File Data, "base64") to convert before mapping. No separate decoding step is needed for standard storage integrations.
Does this module work with PDF/A-3 source file extraction?+
Yes. PDF/A-3 is the only PDF/A variant that permits embedded file attachments. If your archive workflow produces PDF/A-3 documents with embedded source files such as Word, Excel, or XML, this module retrieves them for editing or reprocessing while the PDF/A-3 archive document remains intact in your compliance storage.

Obtenez de l'aide