Saltar al contenido principal

Conseguir PDF Metadatos utilizando n8n acción

PDF4me Conseguir PDF Metadatos extrae información completa del documento y propiedades técnicas de PDF archivos a través de n8n Flujos de trabajo de automatización. Proceso PDFs a través de n8n disparadores, datos binarios, cadenas base64 o público URLs Para recuperar metadatos detallados, incluyendo propiedades del documento, número de páginas, tamaño del archivo, fecha de creación, información del autor y especificaciones técnicas. Esta solución de nivel empresarial es ideal para sistemas de gestión documental, flujos de trabajo de cumplimiento, análisis de contenido, registros de auditoría e inspección automatizada de documentos que requieren un análisis preciso de las propiedades y una extracción de metadatos fiable y sin interrupciones. n8n integración.

Entradas de blog relacionadas
Aún no hay ninguna entrada de blog sobre esta función; estará disponible próximamente.
Mientras tanto, echa un vistazo al blog de PDF4me para encontrar tutoriales y flujos de trabajo para todas las plataformas.
Visita el blog

Configuración

Añade el PDF4me Nodo "Obtener metadatos PDF" para su n8n flujo de trabajo y configure los parámetros necesarios. Para obtener instrucciones de configuración inicial, consulte nuestra n8n Guía de integración.

Requisitos previos:

  • PDF4me API credenciales
  • n8n acceso al flujo de trabajo

Configuración:

  1. Agregar PDF4me nodo a flujo de trabajo
  2. Seleccione la acción "Obtener metadatos del PDF".
  3. Configure los parámetros de entrada (véase más abajo).
Obtener metadatos del PDF

Parámetros

Lista completa de parámetros para la acción Obtener metadatos de PDF. Configure estos parámetros para controlar PDF Extracción de metadatos.

Importante: Los parámetros marcados con un asterisco (***) son obligatorios y deben proporcionarse para que la acción funcione correctamente.

ParámetroTipoDescripciónEjemplo
Tipo de datos de entrada***StringPDF Selección del formato de entrada
• Elija el formato de su PDF entrada de datos
PDF4me admite varios tipos de entrada
• Opciones: Datos binarios, Base64 Cuerda o URL
Binary Data
Campo binario de entradaBinarioBinario PDF Entrada de archivo (Obligatorio si se trata de datos binarios)
• Referencia PDF archivo de anterior n8n carga de nodos o archivos
PDF4me procesos binarios PDF archivos con detección automática de formato
• Obligatorio cuando el tipo de datos de entrada es "Datos binarios".
{{ $binary.data }}
Contenido del documento Base64StringBase64 Codificado PDF Aporte (Obligatorio si se trata de una cadena Base64)
• Proporcionar PDF datos como cadena codificada en base64
PDF4me decodifica y procesa automáticamente el PDF contenido
• Obligatorio cuando el tipo de datos de entrada es "Base64 Cadena"
UEsDBBQABgAI...
URL del archivoStringPúblico PDF URL Aporte (Obligatorio si se trata de una URL)
• Proporcionar un permiso público/abierto URL hacia PDF archivo
PDF4me descarga y procesa el archivo desde el proporcionado URL
• Obligatorio cuando el tipo de datos de entrada es "URL"
https://abc.com/sample.pdf
Nombre del archivo de salida***StringNombre del archivo de salida de metadatos
• Especifique el nombre del archivo de metadatos generado.
• Debe incluir la extensión .json
PDF4me garantiza la validación de nombres y formatos únicos.
pdf_metadata.json
Nombre de salida de datos binarios***StringMapeo de datos binarios
• Defina el nombre de la variable para acceder a los datos binarios de metadatos generados.
• Se utiliza en acciones de flujo de trabajo posteriores
• Esencial para el flujo de datos del flujo de trabajo
data
AsíncronoBooleanProcesamiento asíncrono
• Habilitar el procesamiento asíncrono para archivos grandes
• Cuando está habilitada, la operación se ejecuta en segundo plano y regresa inmediatamente.
• Recomendado para grandes PDF archivos
true

Opciones avanzadas

Los siguientes parámetros están disponibles en la sección Opciones avanzadas y son opcionales:

ParámetroTipoDescripciónEjemplo
Perfiles personalizadosStringNoPDF4me perfiles de configuración personalizados - Establecer opciones adicionales para el PDF4me Operación Obtener metadatos de PDF usando perfiles personalizados. Un perfil personalizado es una cadena en JSONFormato similar que contiene parámetros predefinidos para la configuración avanzada de extracción de metadatos. Admite opciones como outputDataFormat, preserveMetadata, optimizeForPrinting, compressionLevel, detectionSensitivity, preserveAnnotations y colorSpaceOptimization.{ "outputDataFormat": "json", "preserveMetadata": true, "optimizeForPrinting": false, "compressionLevel": "medium" }

Producción

Parámetros de salida

ParámetroTipoDescripciónEjemplo
éxitoBooleanPDF4me Indicador de estado de extracción de metadatos - Boolean Indicador que señala si el proceso de extracción de metadatos se realizó correctamente o no. PDF4me devoluciones true para operaciones exitosas y false para cualquier error, lo que permite un manejo de errores robusto en flujos de trabajo automatizadostrue
mensajeStringPDF4me Mensaje de estado de extracción de metadatos - Mensaje de estado legible para humanos que proporciona detalles sobre el resultado del proceso de extracción de metadatos. Incluye confirmación de éxito o detalles de error para la resolución de problemas.PDF metadata extracted successfully
Nombre del archivoStringPDF4me nombre de archivo de metadatos generado - El nombre completo del archivo de metadatos generado correctamente con la extensión .json adecuada. PDF4me Garantiza una nomenclatura única y valida el cumplimiento del formato de archivo para una integración perfecta con los procesos posteriores.pdf_metadata.json
tipo mimeStringPDF4me producción MIME tipo - MIME tipo del archivo de metadatos generado, siempre "application/json" para JSON Archivos de metadatos. Útiles para la validación del tipo de contenido y el manejo adecuado de archivos en aplicaciones web.application/json
Tamaño del archivoNúmeroPDF4me Tamaño del archivo de metadatos en bytes - El tamaño exacto del archivo de metadatos generado en bytes, proporcionado por PDF4me Para la planificación del almacenamiento, la optimización del ancho de banda y la monitorización de la transferencia de archivos. Imprescindible para la gestión documental empresarial y la automatización del flujo de trabajo.125430
Nombre del documentoStringPDF4me Referencia del nombre del documento - El nombre del documento procesado para fines de referencia y seguimiento. Este nombre coincide con el nombre del archivo para mayor coherencia en los flujos de trabajo de gestión documental.pdf_metadata.json
metadatosextraídosBooleanPDF4me confirmación de la extracción de metadatos - Boolean bandera que confirma que los metadatos se han extraído correctamente del PDF Documento. Útil para verificar que la extracción de metadatos se haya aplicado correctamente.true
campos de metadatosNúmeroPDF4me recuento de campos de metadatos - El número de campos de metadatos que se extrajeron correctamente de la PDF Documento. Útil para realizar un seguimiento de la integridad de la extracción y los resultados del análisis del documento.25

N8N Respuesta a la acción

El PDF4me Obtener metadatos del PDF API Devuelve una respuesta que se puede visualizar en varios formatos. Elija la vista que mejor se adapte a sus necesidades:

JSON Formato de respuesta

El crudo JSON respuesta de la API:

[
{
"success": true,
"message": "PDF metadata extracted successfully",
"fileName": "pdf_metadata.json",
"mimeType": "application/json",
"fileSize": 125430,
"docName": "pdf_metadata.json",
"metadataExtracted": true,
"metadataFields": 25
}
]

Casos de uso

Análisis e inspección de documentos

  • Extraer las propiedades del documento y la información técnica para la auditoría de cumplimiento.
  • Analizar PDF Estructura y contenido para la evaluación y validación de la calidad.
  • Inspeccione los metadatos del documento para realizar análisis de seguridad y verificación de contenido.

Gestión y organización de contenidos

  • Extraer metadatos para la categorización y el etiquetado automatizados de documentos.
  • Analizar las propiedades de los documentos para la optimización de la búsqueda y la indexación.
  • Información del documento de proceso para la integración del sistema de gestión de contenido

Inteligencia de documentos empresariales

  • Automatice la extracción de metadatos en los flujos de trabajo de procesamiento de documentos.
  • Analizar las propiedades de los documentos para la inteligencia empresarial y la elaboración de informes.
  • Extraer detalles técnicos para la gestión del ciclo de vida y el archivo de documentos.

Obtén ayuda