Extraer metadatos de un documento de Word usando n8n acción
PDF4me Extraer metadatos de un documento de Word permite extraer metadatos y propiedades completas de documentos de Word a través de n8n Flujos de trabajo automatizados con capacidades de análisis detallado de documentos. Esta potente función de extracción de metadatos admite propiedades de documentos integradas, propiedades personalizadas, estadísticas de documentos, información del autor, fechas de creación y seguimiento de revisiones con formato y localización específicos para cada idioma, ideal para la gestión de documentos, el seguimiento del cumplimiento normativo y los flujos de trabajo de análisis de contenido.
Configuración
Añade el PDF4me Nodo "Extraer metadatos de un documento de Word" para su n8n flujo de trabajo y configure los parámetros necesarios. Para obtener instrucciones de configuración inicial, consulte nuestra n8n Guía de integración.
Requisitos previos:
- PDF4me API credenciales
- n8n acceso al flujo de trabajo
Configuración:
- Agregar PDF4me nodo a flujo de trabajo
- Seleccione la acción "Extraer metadatos del documento de Word".
- Configure los parámetros de entrada (véase más abajo).

Parámetros
Lista completa de parámetros para la acción Extraer metadatos de un documento de Word. Configure estos parámetros para controlar el comportamiento de la extracción de metadatos.
Importante: Los parámetros marcados con un asterisco (***) son obligatorios. Los parámetros avanzados permiten un control preciso del formato de los metadatos.
| Parámetro | Tipo | Descripción | Ejemplo |
|---|---|---|---|
| Tipo de datos de entrada*** | String | Selección del formato de entrada del documento de Word • Elija el formato de entrada de datos de su documento de Word • PDF4me admite varios tipos de entrada • Opciones: Datos binarios, Base64 Cuerda o URL | Binary Data |
| Campo binario de entrada*** | Binario | Entrada de archivo de palabras binarias (Obligatorio si se trata de datos binarios) • Referencia al archivo de Word (.docx, .doc) del archivo anterior. n8n carga de nodos o archivos • PDF4me Procesa archivos binarios de Word con detección automática de formato. • Obligatorio cuando el tipo de datos de entrada es "Datos binarios". | {{ $binary.data }} |
| Contenido de palabras en Base64*** | String | Base64 Entrada de palabra codificada (Obligatorio si se trata de una cadena Base64) • Proporcione el contenido de Word (.docx, .doc) como una cadena codificada en base64 para una transmisión segura. • PDF4me decodifica y procesa automáticamente el contenido de Word. • Obligatorio cuando el tipo de datos de entrada es "Cadena Base64" | UEsDBBQABgAI... |
| URL del documento de Word*** | String | Documento público de Word URL Aporte (Obligatorio si se trata de una URL) • Proporcionar un permiso público/abierto URL al archivo de Word (.docx, .doc) que se va a procesar • PDF4me descarga y procesa el archivo de Word desde el proporcionado URL • Obligatorio cuando el tipo de datos de entrada es "URL" | https://abc.com/document.docx |
| Nombre del documento de Word*** | String | Nombre del archivo de entrada del documento de Word • Especifique el nombre del archivo de Word de entrada con la extensión adecuada (.docx, .doc). • PDF4me Utiliza esto para la detección de formato y la optimización del procesamiento. | document.docx |
| Nombre de la cultura | String | Cultura/Localidad del documento • Código cultural para el formato de fecha/hora (p. ej., "en-US", "de-DE", "fr-FR") • Predeterminado: InvariantCulture (formato consistente) • Afecta al formato de visualización de fecha/hora en los metadatos. | en-US |
Producción
Parámetros de salida
| Parámetro | Tipo | Descripción | Ejemplo |
|---|---|---|---|
| Nombre del archivo | String | Nombre del archivo del documento de Word original - El nombre del archivo de documento de Word de entrada | myWordFile.docx |
| éxito | Boolean | PDF4me estado de operación - Boolean Indicador que señala si la operación de extracción de metadatos se realizó correctamente o no. PDF4me devoluciones true para operaciones exitosas y false por cualquier error | true |
| Nombre de la cultura | String | Código cultural/local - Código de idioma utilizado para el formato de fecha/hora (por ejemplo, "en-US", "de-DE", "fr-FR") | en-US |
| metadatos | Object | Objeto de metadatos anidado - Contiene una estructura de metadatos del documento con un objeto de metadatos anidado que contiene todas las propiedades del documento, incluyendo Autor, Título, Asunto, Palabras clave, Comentarios, Categoría, Empresa, Gerente, Creado, Última modificación, Última impresión, Número de revisión, Tiempo total de edición, Páginas, Palabras, Caracteres, Párrafos. | {"metadata": {"Author": "Ynoox Testtwo", "Company": "HP Inc.", "Words": 921}} |
| mensaje | String | Mensaje de operación - Mensaje descriptivo que indica el resultado de la operación de extracción de metadatos. | Word metadata extracted successfully |
N8N Respuesta a la acción
El PDF4me Extraer metadatos de un documento de Word API Devuelve una respuesta que se puede visualizar en varios formatos. Elija la vista que mejor se adapte a sus necesidades:
- JSON
- Table
- Schema
JSON Formato de respuesta
El crudo JSON respuesta de la API:
[
{
"fileName": "myWordFile.docx",
"success": true,
"cultureName": "en-US",
"metadata": {
"document": null,
"fileName": null,
"success": true,
"errorMessage": null,
"metadata": {
"Author": "Ynoox Testtwo",
"Title": "",
"Subject": "",
"Keywords": "",
"Comments": "",
"Category": "",
"Company": "HP Inc.",
"Manager": "",
"Created": "5/16/2019 6:04:00 AM",
"LastModified": "8/7/2024 7:04:00 AM",
"LastPrinted": "5/16/2019 6:04:00 AM",
"RevisionNumber": 5,
"TotalEditingTime": 2,
"Pages": 3,
"Words": 921,
"Characters": 5256,
"Paragraphs": 12
}
},
"message": "Word metadata extracted successfully"
}
]
Vista de tabla
Datos de respuesta en formato de tabla estructurada:
| Parámetro | Valor |
|---|---|
| fileName | myWordFile.docx |
| success | true |
| cultureName | en-US |
| metadata | Objeto anidado que contiene metadatos del documento |
| message | Word metadata extracted successfully |
Estructura del objeto de metadatos:
| Parámetro | Valor |
|---|---|
| documento | null |
| fileName | null |
| success | true |
| errorMessage | null |
| metadata | Objeto que contiene las propiedades del documento. |
Propiedades del documento (metadata.metadata):
| Propiedad | Valor |
|---|---|
| Author | Ynoox Testtwo |
| Title | "" |
| Subject | "" |
| Keywords | "" |
| Comments | "" |
| Category | "" |
| Company | HP Inc. |
| Manager | "" |
| Created | 5/16/2019 6:04:00 AM |
| LastModified | 8/7/2024 7:04:00 AM |
| LastPrinted | 5/16/2019 6:04:00 AM |
| RevisionNumber | 5 |
| TotalEditingTime | 2 |
| Pages | 3 |
| Words | 921 |
| Characters | 5256 |
| Paragraphs | 12 |
Vista de esquema
Estructura de datos y tipos de respuesta:
1 item
fileName: T myWordFile.docx
success: ☑ true
cultureName: T en-US
metadata: {} Object
document: null
fileName: null
success: ☑ true
errorMessage: null
metadata: {} Object
Author: T Ynoox Testtwo
Title: T ""
Subject: T ""
Keywords: T ""
Comments: T ""
Category: T ""
Company: T HP Inc.
Manager: T ""
Created: T 5/16/2019 6:04:00 AM
LastModified: T 8/7/2024 7:04:00 AM
LastPrinted: T 5/16/2019 6:04:00 AM
RevisionNumber: # 5
TotalEditingTime: # 2
Pages: # 3
Words: # 921
Characters: # 5256
Paragraphs: # 12
message: T Word metadata extracted successfully
Indicadores de tipo:
T= String (Texto)#= Número☑= Boolean[]= Array{}= Objectnull= Valor nulo
Casos de uso
Automatización de documentos empresariales
- Gestión de documentos: Extraer metadatos para la organización y catalogación de documentos.
- Seguimiento del cumplimiento: Seguimiento de las propiedades de los documentos para el cumplimiento normativo
- Análisis de contenidoAnalizar las estadísticas y propiedades del documento.
- Búsqueda de documentos: Utilizar metadatos para la búsqueda y recuperación de documentos.
Procesamiento de documentos impulsado por IA
- Compatibilidad con múltiples formatosProcesar documentos de Word en formato .docx y .doc.
- Procesamiento multilingüe: Compatibilidad con diferentes idiomas y regiones
- Extracción inteligente de metadatosExtracción automática de todas las propiedades del documento.
Inteligencia empresarial y análisis
- Análisis de documentosAnalizar las propiedades y estadísticas del documento.
- Monitoreo del cumplimientoAsegúrese de que los documentos cumplan con los requisitos de metadatos.
- Métricas de rendimiento: Seguimiento de la precisión y eficiencia del procesamiento