Saltar al contenido principal

Extraer archivo adjunto de PDF usando n8n acción

PDF4me Extraer archivo adjunto de PDF extrae archivos incrustados de PDF documentos a través de n8n Flujos de trabajo de automatización. Proceso PDFs lejos n8n disparadores, datos binarios, cadenas base64 o público URLs para detectar y extraer automáticamente documentos adjuntos, imágenes, hojas de cálculo, archivos de datos y otro contenido incrustado con integridad de archivo preservada, retención de metadatos y compatibilidad con múltiples formatos (PDF(DOC, XLS, imágenes, etc.). Esta solución es ideal para el análisis de documentos, la recuperación de archivos, la extracción de evidencia, la gestión de archivos adjuntos, los flujos de trabajo de extracción de datos y el procesamiento integral de documentos que requieren una extracción de archivos integrados confiable con una integración perfecta.

Entradas de blog relacionadas
Aún no hay ninguna entrada de blog sobre esta función; estará disponible próximamente.
Mientras tanto, echa un vistazo al blog de PDF4me para encontrar tutoriales y flujos de trabajo para todas las plataformas.
Visita el blog

Configuración

Añade el PDF4me "Extraer archivo adjunto de PDF" nodo a tu n8n flujo de trabajo y configure los parámetros necesarios. Para obtener instrucciones de configuración inicial, consulte nuestra n8n Guía de integración.

Requisitos previos:

  • PDF4me API credenciales
  • n8n acceso al flujo de trabajo

Configuración:

  1. Agregar PDF4me nodo a flujo de trabajo
  2. Seleccione "Extraer archivo adjunto de PDF" acción
  3. Configure los parámetros de entrada (véase más abajo).
Extraer archivo adjunto del PDF

Parámetros

Lista completa de parámetros para la función Extraer archivo adjunto de PDF acción. Configure estos parámetros para controlar la extracción de archivos adjuntos.

Importante: Los parámetros marcados con un asterisco (***) son obligatorios y deben proporcionarse para que la acción funcione correctamente.

ParámetroTipoDescripciónEjemplo
Tipo de datos de entrada***StringPDF Selección del formato de entrada
• Elija el formato de su PDF entrada de datos
PDF4me admite varios tipos de entrada
• Opciones: Datos binarios, Base64 Cuerda o URL
Binary Data
Campo binario de entradaBinarioBinario PDF Entrada de archivo (Obligatorio si se trata de datos binarios)
• Referencia PDF archivo de anterior n8n carga de nodos o archivos
PDF4me procesos binarios PDF archivos con detección automática de formato
• Obligatorio cuando el tipo de datos de entrada es "Datos binarios".
{{ $binary.data }}
Contenido del documento Base64StringBase64 Codificado PDF Aporte (Obligatorio si Base64 Cadena)
• Proporcionar PDF datos como cadena codificada en base64
PDF4me decodifica y procesa automáticamente el PDF contenido
• Obligatorio cuando el tipo de datos de entrada es "Base64 Cadena"
UEsDBBQABgAI...
URL del archivoStringPúblico PDF URL Aporte (Obligatorio si URL)
• Proporcionar un permiso público/abierto URL hacia PDF archivo
PDF4me descarga y procesa el archivo desde URL
• Obligatorio cuando el tipo de datos de entrada es "URL"
https://abc.com/sample.pdf
Nombre del documento***StringFuente PDF Referencia
• Especifique el nombre de la fuente PDF archivo
• Para fines de referencia y seguimiento en la extracción
• Ayuda con el seguimiento del procesamiento
document.pdf

Opciones avanzadas

Los siguientes parámetros están disponibles en la sección Opciones avanzadas y son opcionales:

ParámetroTipoDescripciónEjemplo
Perfiles personalizadosObjectConfiguración de extracción
• Objeto de configuración avanzada para personalizar el comportamiento de extracción.
• Admite formatos de salida y opciones de procesamiento.
JSON formato para especificación de parámetros flexibles
• Opcional para requisitos especializados
{"outputDataFormat": "json", "extractMetadata": true}

Tipos de archivos adjuntos compatibles

CategoríaTipos de archivoDescripción
DocumentosPDF, DOC, DOCXTXT, RTF, ODTDocumentos de texto y archivos de oficina
ImágenesJPG, JPEG, PNG, GIF, BMP, TIFF, SVGArchivos de imagen y gráficos
hojas de cálculoXLS, XLSX, CSV, ODSArchivos de datos y hojas de cálculo
DatosJSON, XML, HTML, CSSArchivos web y de datos

Producción

Parámetros de salida

ParámetroTipoDescripciónEjemplo
documentosArrayPDF4me Referencia del documento de entrada - Referencia a los documentos de entrada originales procesados para la extracción. Nulo para este tipo de operación.null
Documentos de salidaArrayPDF4me colección de archivos adjuntos extraídos - Matriz de objetos adjuntos extraídos correctamente que contienen datos de archivo, metadatos y propiedades de la fuente. PDF documento[{"fileName": "sample.txt", "barcodeText": null, "docText": null, "image": null}]
ID de rastreoStringPDF4me identificador de rastreo de procesamiento - Identificador de seguimiento único para rastrear la solicitud de extracción a través de PDF4mecanalización de procesamiento para fines de depuración y auditoríanull
ID de trabajoStringPDF4me identificador de trabajo - ID de trabajo único para la operación de extracción. Nulo para operaciones síncronas, con valor para procesamiento asíncrono.null
URL de estadoStringPDF4me seguimiento del estado URL - URL Para comprobar el estado de las operaciones de extracción asíncronas. Nulo para las operaciones síncronas.null
Uso de la suscripciónObjectPDF4me datos de uso de la suscripción - Información sobre API Uso y consumo de suscripción para la operación de extracciónnull
_metadatosObjectPDF4me metadatos de operación - Objeto de metadatos completo que contiene información de procesamiento, marcas de tiempo y detalles de la operación.{"success": true, "message": "Attachments extracted successfully"}
_metadatos.éxitoBooleanPDF4me indicador de estado de extracción - Boolean Bandera que indica si el proceso de extracción del archivo adjunto fue exitoso o fallido. PDF4me devoluciones true para extracciones exitosas y false por cualquier errortrue
_metadatos.mensajeStringPDF4me mensaje de estado de extracción - Mensaje de estado legible para humanos que proporciona detalles sobre el resultado del proceso de extracción. Incluye confirmación de éxito o detalles de error para la resolución de problemas.Attachments extracted successfully
_metadatos.marca de tiempo de procesamientoStringPDF4me marca de tiempo de procesamiento - Marca de tiempo ISO 8601 que indica cuándo se completó la operación de extracción por PDF4memotor de extracción2025-09-23T20:04:09.290Z
_metadatos.sourceFileNameStringPDF4me nombre del archivo del documento fuente - Nombre de archivo original del PDF documento que fue procesado para la extracción de archivos adjuntosdocument.pdf
_metadatos.operaciónStringPDF4me tipo de operación - Tipo de operación realizada por PDF4me's API, siempre "extractAttachmentFromPdf" para esta acciónextractAttachmentFromPdf

Estructura del objeto adjunto extraído

CampoTipoDescripciónEjemplo
Nombre del archivoStringPDF4me nombre del archivo extraído - Nombre de archivo original del adjunto extraído tal como aparece en la fuente PDF documentosample.txt
texto del código de barrasStringPDF4me contenido del código de barras - Texto extraído de los códigos de barras que se encuentren en el archivo adjunto. Nulo si no hay códigos de barras.null
docTextStringPDF4me contenido del texto del documento - Contenido de texto extraído del archivo adjunto. Nulo si el archivo adjunto no es un documento de texto.null
imagenStringPDF4me datos de imagen - Base64 Datos de imagen codificados si el archivo adjunto es una imagen. Nulo para archivos adjuntos que no sean imágenes.null

N8N Respuesta a la acción

El PDF4me Extraer archivo adjunto de PDF API Devuelve una respuesta que se puede visualizar en varios formatos. Elija la vista que mejor se adapte a sus necesidades:

JSON Formato de respuesta

El crudo JSON respuesta de la API:

[
{
"documents": null,
"outputDocuments": [
{
"fileName": "sample.txt",
"barcodeText": null,
"docText": null,
"image": null
}
],
"traceId": null,
"jobId": null,
"statusUrl": null,
"subscriptionUsage": null,
"_metadata": {
"success": true,
"message": "Attachments extracted successfully",
"processingTimestamp": "2025-09-23T20:04:09.290Z",
"sourceFileName": "document.pdf",
"operation": "extractAttachmentFromPdf"
}
}
]

Casos de uso

Recuperación de contenido de documentos

  • Restauración de archivos integrados: Utilice el outputDocuments matriz para recuperar archivos que estaban incrustados dentro PDF documentos, restableciendo el acceso a los materiales originales de la fuente
  • Recuperación de nombres de archivo: Extraer los nombres de archivo originales del fileName campo para mantener la correcta identificación y organización de los archivos
  • Recuperación de documentos perdidos: Restaurar documentos que estaban previamente incrustados en PDFpero ya no están disponibles en sus formatos originales.

Procesamiento y análisis de contenido

  • Análisis de apego: Procesar archivos individuales desde el outputDocuments recopilación para analizar el contenido, extraer datos o realizar operaciones específicas en cada tipo de archivo.
  • Procesamiento de códigos de barras: Utilice el barcodeText Campo para extraer y procesar información de códigos de barras de archivos adjuntos con fines de inventario, seguimiento o identificación.
  • Extracción de contenido de texto: Aprovechar el docText Campo para extraer contenido textual de archivos adjuntos de documentos para flujos de trabajo de búsqueda, análisis o procesamiento de datos.

Automatización e integración de flujos de trabajo

  • Distribución de archivos: Distribuye automáticamente los archivos adjuntos extraídos a los sistemas, carpetas o usuarios apropiados según el tipo de archivo y el análisis de contenido.
  • Archivo de contenido: Utilice el _metadata.traceId y los resultados de la extracción para mantener registros de auditoría mientras se organizan los archivos extraídos en sistemas de archivo estructurados.
  • Integración de múltiples sistemasIntegrar los archivos extraídos con sistemas externos de gestión documental, plataformas de almacenamiento en la nube o aplicaciones empresariales.

Obtén ayuda