Extraer archivo adjunto de PDF usando n8n acción
PDF4me Extraer archivo adjunto de PDF extrae archivos incrustados de PDF documentos a través de n8n Flujos de trabajo de automatización. Proceso PDFs lejos n8n disparadores, datos binarios, cadenas base64 o público URLs para detectar y extraer automáticamente documentos adjuntos, imágenes, hojas de cálculo, archivos de datos y otro contenido incrustado con integridad de archivo preservada, retención de metadatos y compatibilidad con múltiples formatos (PDF(DOC, XLS, imágenes, etc.). Esta solución es ideal para el análisis de documentos, la recuperación de archivos, la extracción de evidencia, la gestión de archivos adjuntos, los flujos de trabajo de extracción de datos y el procesamiento integral de documentos que requieren una extracción de archivos integrados confiable con una integración perfecta.
Configuración
Añade el PDF4me "Extraer archivo adjunto de PDF" nodo a tu n8n flujo de trabajo y configure los parámetros necesarios. Para obtener instrucciones de configuración inicial, consulte nuestra n8n Guía de integración.
Requisitos previos:
- PDF4me API credenciales
- n8n acceso al flujo de trabajo
Configuración:
- Agregar PDF4me nodo a flujo de trabajo
- Seleccione "Extraer archivo adjunto de PDF" acción
- Configure los parámetros de entrada (véase más abajo).

Parámetros
Lista completa de parámetros para la función Extraer archivo adjunto de PDF acción. Configure estos parámetros para controlar la extracción de archivos adjuntos.
Importante: Los parámetros marcados con un asterisco (***) son obligatorios y deben proporcionarse para que la acción funcione correctamente.
| Parámetro | Tipo | Descripción | Ejemplo |
|---|---|---|---|
| Tipo de datos de entrada*** | String | PDF Selección del formato de entrada • Elija el formato de su PDF entrada de datos • PDF4me admite varios tipos de entrada • Opciones: Datos binarios, Base64 Cuerda o URL | Binary Data |
| Campo binario de entrada | Binario | Binario PDF Entrada de archivo (Obligatorio si se trata de datos binarios) • Referencia PDF archivo de anterior n8n carga de nodos o archivos • PDF4me procesos binarios PDF archivos con detección automática de formato • Obligatorio cuando el tipo de datos de entrada es "Datos binarios". | {{ $binary.data }} |
| Contenido del documento Base64 | String | Base64 Codificado PDF Aporte (Obligatorio si Base64 Cadena) • Proporcionar PDF datos como cadena codificada en base64 • PDF4me decodifica y procesa automáticamente el PDF contenido • Obligatorio cuando el tipo de datos de entrada es "Base64 Cadena" | UEsDBBQABgAI... |
| URL del archivo | String | Público PDF URL Aporte (Obligatorio si URL) • Proporcionar un permiso público/abierto URL hacia PDF archivo • PDF4me descarga y procesa el archivo desde URL • Obligatorio cuando el tipo de datos de entrada es "URL" | https://abc.com/sample.pdf |
| Nombre del documento*** | String | Fuente PDF Referencia • Especifique el nombre de la fuente PDF archivo • Para fines de referencia y seguimiento en la extracción • Ayuda con el seguimiento del procesamiento | document.pdf |
Opciones avanzadas
Los siguientes parámetros están disponibles en la sección Opciones avanzadas y son opcionales:
| Parámetro | Tipo | Descripción | Ejemplo |
|---|---|---|---|
| Perfiles personalizados | Object | Configuración de extracción • Objeto de configuración avanzada para personalizar el comportamiento de extracción. • Admite formatos de salida y opciones de procesamiento. • JSON formato para especificación de parámetros flexibles • Opcional para requisitos especializados | {"outputDataFormat": "json", "extractMetadata": true} |
Tipos de archivos adjuntos compatibles
| Categoría | Tipos de archivo | Descripción |
|---|---|---|
| Documentos | PDF, DOC, DOCXTXT, RTF, ODT | Documentos de texto y archivos de oficina |
| Imágenes | JPG, JPEG, PNG, GIF, BMP, TIFF, SVG | Archivos de imagen y gráficos |
| hojas de cálculo | XLS, XLSX, CSV, ODS | Archivos de datos y hojas de cálculo |
| Datos | JSON, XML, HTML, CSS | Archivos web y de datos |
Producción
Parámetros de salida
| Parámetro | Tipo | Descripción | Ejemplo |
|---|---|---|---|
| documentos | Array | PDF4me Referencia del documento de entrada - Referencia a los documentos de entrada originales procesados para la extracción. Nulo para este tipo de operación. | null |
| Documentos de salida | Array | PDF4me colección de archivos adjuntos extraídos - Matriz de objetos adjuntos extraídos correctamente que contienen datos de archivo, metadatos y propiedades de la fuente. PDF documento | [{"fileName": "sample.txt", "barcodeText": null, "docText": null, "image": null}] |
| ID de rastreo | String | PDF4me identificador de rastreo de procesamiento - Identificador de seguimiento único para rastrear la solicitud de extracción a través de PDF4mecanalización de procesamiento para fines de depuración y auditoría | null |
| ID de trabajo | String | PDF4me identificador de trabajo - ID de trabajo único para la operación de extracción. Nulo para operaciones síncronas, con valor para procesamiento asíncrono. | null |
| URL de estado | String | PDF4me seguimiento del estado URL - URL Para comprobar el estado de las operaciones de extracción asíncronas. Nulo para las operaciones síncronas. | null |
| Uso de la suscripción | Object | PDF4me datos de uso de la suscripción - Información sobre API Uso y consumo de suscripción para la operación de extracción | null |
| _metadatos | Object | PDF4me metadatos de operación - Objeto de metadatos completo que contiene información de procesamiento, marcas de tiempo y detalles de la operación. | {"success": true, "message": "Attachments extracted successfully"} |
| _metadatos.éxito | Boolean | PDF4me indicador de estado de extracción - Boolean Bandera que indica si el proceso de extracción del archivo adjunto fue exitoso o fallido. PDF4me devoluciones true para extracciones exitosas y false por cualquier error | true |
| _metadatos.mensaje | String | PDF4me mensaje de estado de extracción - Mensaje de estado legible para humanos que proporciona detalles sobre el resultado del proceso de extracción. Incluye confirmación de éxito o detalles de error para la resolución de problemas. | Attachments extracted successfully |
| _metadatos.marca de tiempo de procesamiento | String | PDF4me marca de tiempo de procesamiento - Marca de tiempo ISO 8601 que indica cuándo se completó la operación de extracción por PDF4memotor de extracción | 2025-09-23T20:04:09.290Z |
| _metadatos.sourceFileName | String | PDF4me nombre del archivo del documento fuente - Nombre de archivo original del PDF documento que fue procesado para la extracción de archivos adjuntos | document.pdf |
| _metadatos.operación | String | PDF4me tipo de operación - Tipo de operación realizada por PDF4me's API, siempre "extractAttachmentFromPdf" para esta acción | extractAttachmentFromPdf |
Estructura del objeto adjunto extraído
| Campo | Tipo | Descripción | Ejemplo |
|---|---|---|---|
| Nombre del archivo | String | PDF4me nombre del archivo extraído - Nombre de archivo original del adjunto extraído tal como aparece en la fuente PDF documento | sample.txt |
| texto del código de barras | String | PDF4me contenido del código de barras - Texto extraído de los códigos de barras que se encuentren en el archivo adjunto. Nulo si no hay códigos de barras. | null |
| docText | String | PDF4me contenido del texto del documento - Contenido de texto extraído del archivo adjunto. Nulo si el archivo adjunto no es un documento de texto. | null |
| imagen | String | PDF4me datos de imagen - Base64 Datos de imagen codificados si el archivo adjunto es una imagen. Nulo para archivos adjuntos que no sean imágenes. | null |
N8N Respuesta a la acción
El PDF4me Extraer archivo adjunto de PDF API Devuelve una respuesta que se puede visualizar en varios formatos. Elija la vista que mejor se adapte a sus necesidades:
- JSON
- Table
- Schema
- Binary
JSON Formato de respuesta
El crudo JSON respuesta de la API:
[
{
"documents": null,
"outputDocuments": [
{
"fileName": "sample.txt",
"barcodeText": null,
"docText": null,
"image": null
}
],
"traceId": null,
"jobId": null,
"statusUrl": null,
"subscriptionUsage": null,
"_metadata": {
"success": true,
"message": "Attachments extracted successfully",
"processingTimestamp": "2025-09-23T20:04:09.290Z",
"sourceFileName": "document.pdf",
"operation": "extractAttachmentFromPdf"
}
}
]
Vista de tabla
Datos de respuesta en formato de tabla estructurada:
| Parámetro | Valor |
|---|---|
| documents | null |
| outputDocuments[0].fileName | sample.txt |
| outputDocuments[0].barcodeText | null |
| outputDocuments[0].docText | null |
| outputDocuments[0].image | null |
| traceId | null |
| jobId | null |
| statusUrl | null |
| subscriptionUsage | null |
| _metadata.success | true |
| _metadata.message | Attachments extracted successfully |
| _metadata.processingTimestamp | 2025-09-23T20:04:09.290Z |
| _metadata.sourceFileName | document.pdf |
| _metadata.operation | extractAttachmentFromPdf |
Vista de esquema
Estructura de datos y tipos de respuesta:
1 item
documents: null
outputDocuments: [
{
fileName: AB sample.txt
barcodeText: null
docText: null
image: null
}
]
traceId: null
jobId: null
statusUrl: null
subscriptionUsage: null
_metadata: {
success: ☑ true
message: AB Attachments extracted successfully
processingTimestamp: AB 2025-09-23T20:04:09.290Z
sourceFileName: AB document.pdf
operation: AB extractAttachmentFromPdf
}
Indicadores de tipo:
AB= String#= Número☑= Boolean{}= Object[]= Array
Vista de datos binarios
Los datos y metadatos del archivo adjunto:
outputDocuments
─────────────────────────────
File Count: {{ $json.outputDocuments.length }}
Success Status: {{ $json._metadata.success }}
Processing Time: {{ $json._metadata.processingTimestamp }}
Casos de uso
Recuperación de contenido de documentos
- Restauración de archivos integrados: Utilice el
outputDocumentsmatriz para recuperar archivos que estaban incrustados dentro PDF documentos, restableciendo el acceso a los materiales originales de la fuente - Recuperación de nombres de archivo: Extraer los nombres de archivo originales del
fileNamecampo para mantener la correcta identificación y organización de los archivos - Recuperación de documentos perdidos: Restaurar documentos que estaban previamente incrustados en PDFpero ya no están disponibles en sus formatos originales.
Procesamiento y análisis de contenido
- Análisis de apego: Procesar archivos individuales desde el
outputDocumentsrecopilación para analizar el contenido, extraer datos o realizar operaciones específicas en cada tipo de archivo. - Procesamiento de códigos de barras: Utilice el
barcodeTextCampo para extraer y procesar información de códigos de barras de archivos adjuntos con fines de inventario, seguimiento o identificación. - Extracción de contenido de texto: Aprovechar el
docTextCampo para extraer contenido textual de archivos adjuntos de documentos para flujos de trabajo de búsqueda, análisis o procesamiento de datos.
Automatización e integración de flujos de trabajo
- Distribución de archivos: Distribuye automáticamente los archivos adjuntos extraídos a los sistemas, carpetas o usuarios apropiados según el tipo de archivo y el análisis de contenido.
- Archivo de contenido: Utilice el
_metadata.traceIdy los resultados de la extracción para mantener registros de auditoría mientras se organizan los archivos extraídos en sistemas de archivo estructurados. - Integración de múltiples sistemasIntegrar los archivos extraídos con sistemas externos de gestión documental, plataformas de almacenamiento en la nube o aplicaciones empresariales.