Saltar al contenido principal

Extraer archivo adjunto de PDF en Make

Extraer archivo adjunto de PDF es un Make módulo que recupera todos los archivos incrustados dentro de un PDF documenta automáticamente dentro de un escenario. Se encarga de PDF portafolios, estándar PDF archivos adjuntos y PDF/A-3 archivos fuente, devolviendo cada archivo extraído como un Base64-elemento codificado en una matriz Attachments listo para que un Iterador lo procese individualmente.

Lo que hace este módulo
PDF4me Extraer archivo adjunto de PDF recupera todos los archivos incrustados de un PDF documento o PDF portafolio dentro de un Make escenario. Proporcione el PDF como un búfer binario y el módulo devuelve una matriz Attachments donde cada elemento contiene el nombre del archivo y los datos del archivo (Base64). Cadena a Make Iterador para procesar cada archivo individualmente: subirlo al almacenamiento en la nube, enviarlo por correo electrónico a los destinatarios, importar archivos de datos a una base de datos o pasarlos a otro módulo.
Utilice un iterador para procesar cada archivo adjunto por separado.

El módulo devuelve todos los archivos adjuntos como una matriz en un único paquete de salida. Agregue un Make Iterador El módulo inmediatamente después divide la matriz en paquetes individuales, uno por cada archivo adjunto. Cada paquete contiene Nombre del archivo y Datos del archivo (Base64) para que puedas enrutar archivos a diferentes destinos según su tipo o nombre.

Los datos del archivo son Base64-codificado

Cada archivo adjunto extraído se devuelve como un Base64 cadena en el Datos del archivo campo. La mayoría Make Se aceptan integraciones de almacenamiento (Google Drive, Dropbox, OneDrive). Base64 directamente. Si un módulo posterior requiere entrada binaria, conviértalo usando el Make toBinary(FileData, 'base64') función antes del mapeo.

Funciona con PDF carteras y PDF/A-3 archivos

Más allá del estándar PDF adjuntos, este módulo maneja PDF carteras (contenedores de archivos múltiples) y PDF/A-3 Documentos de archivo con archivos fuente incrustados. Para PDF/A-3, los archivos fuente (Word, Excel, XML) se extraen mientras el archivo PDF permanece intacto en almacenamiento de cumplimiento, según el PDF/A-3 especificación.

Entradas de blog relacionadas
Aún no hay ninguna entrada de blog sobre esta función; estará disponible próximamente.
Mientras tanto, echa un vistazo al blog de PDF4me para encontrar tutoriales y flujos de trabajo para todas las plataformas.
Visita el blog

Autenticando su API Pedido

Para acceder al PDF4me Web API a través de MakeCada solicitud debe incluir las credenciales de autenticación adecuadas. La autenticación garantiza una comunicación segura entre su Make escenarios y PDF4meservicios de extracción de archivos adjuntos.

El módulo Make PDF4me Extraer Adjunto de PDF muestra los campos Nombre de archivo y Documento asignados desde un módulo anterior.

Mapa Nombre del archivo y Documento desde el paso de descarga anterior, luego encadena un Make Iterador para procesar cada archivo adjunto extraído.

Cómo configurar la extracción de archivos adjuntos PDF en Make

  1. Agregar PDF4me > Extraer archivo adjunto de PDF a tu escenario.
  2. Seleccione su Conexión o haga clic Agregar para crear uno con tu API llave.
  3. Mapa Nombre del archivo (con extensión .pdf) del módulo anterior o introduzca un nombre estático.
  4. Mapa Documento (binario) PDF buffer) desde un Google Drive, Dropbox, correo electrónico o HTTP paso de descarga.
  5. Agregar un Make Iterador después de este módulo y mapearlo al Archivos adjuntos Salida de matriz.
  6. Conecte los módulos posteriores a la salida del iterador: cárguelos al almacenamiento en la nube, envíelos por correo electrónico, importe datos o enrute por tipo de archivo.

Parámetros

ParámetroRequeridoLo que haceEjemplo
File NameRequiredFilename of the source PDF including the .pdf extension. Map from the previous module's file name output or enter a static name.portfolio.pdf
DocumentRequiredBinary PDF file content. Map from a Google Drive, Dropbox, email, or HTTP download step. The PDF must contain embedded attachments for the module to return results.[PDF Buffer]

Producción

CampoTipoLo que contiene
AttachmentsArrayCollection of all extracted attachment objects. Feed into a Make Iterator to process each file individually.
File NameStringFilename of the individual attachment including its extension (e.g. source_data.xlsx).
File DataBase64Content of the individual attachment encoded as Base64. Map to a storage upload module or decode with toBinary() for modules that require binary input.

¿Qué tipos de archivos puede extraer de un archivo? PDF¿

Se admite cualquier tipo de archivo incrustado como adjunto: hojas de cálculo (XLSX, CSV), documentos de Word (DOCX), imágenes (PNG, JPG), códigos postales u otros PDFsEsto incluye archivos en PDF carteras (formato de contenedor de archivos múltiples de Adobe) y archivos fuente incrustados en PDF/A-3 archivos según el ISO 19005-3 estándarEl módulo conserva los formatos y extensiones de archivo originales en el campo Nombre de archivo devuelto.

Ejemplos de flujo de trabajo

Extraer y organizar los archivos de evidencia de la presentación de cumplimiento PDFs

  1. DesencadenarPresentación de cumplimiento PDF recibido (archivo adjunto de correo electrónico o carpeta de vigilancia)
  2. Descargar PDF: Recuperar el paquete de cumplimiento
  3. Extraer archivos adjuntos: Recuperar todos los archivos de evidencia incrustados
  4. Iterador: Procesar cada archivo adjunto extraído individualmente
  5. Clasificar por extensión: Enrutar a la carpeta de cumplimiento correspondiente (hojas de cálculo, imágenes, documentos)
  6. Subir: Guarda cada archivo en la carpeta correcta en SharePoint o Google Drive
  7. Registro: Registrar todos los archivos extraídos en una base de datos de cumplimiento.
  8. Notificar al equipo: Alertar al equipo de cumplimiento sobre el envío procesado

Preguntas frecuentes

What types of files can this module extract from a PDF?+
The module extracts any file type embedded as an attachment: spreadsheets, Word documents, images, CSVs, ZIPs, or other PDFs. This includes files in PDF portfolios and source files embedded in PDF/A-3 archive documents. Original file formats and extensions are preserved in the returned File Name field.
How do I process multiple attachments returned by the module?+
The module returns an Attachments array. Use a Make Iterator immediately after to split the array into individual bundles, one per attachment. Each bundle contains File Name and File Data (Base64). You can then upload each file to Google Drive, Dropbox, or SharePoint, or apply routing logic based on the file extension.
What is the File Data format and how do I use it?+
File Data is returned as a Base64-encoded string. Most Make storage modules (Google Drive, Dropbox, OneDrive) accept Base64 data directly in their upload fields. If a module requires binary input, use the Make function toBinary(File Data, "base64") to convert before mapping. No separate decoding step is needed for standard storage integrations.
Does this module work with PDF/A-3 source file extraction?+
Yes. PDF/A-3 is the only PDF/A variant that permits embedded file attachments. If your archive workflow produces PDF/A-3 documents with embedded source files such as Word, Excel, or XML, this module retrieves them for editing or reprocessing while the PDF/A-3 archive document remains intact in your compliance storage.

Obtén ayuda